Tạo ảnh bằng AI
Biến từ ngữ thành hình ảnh ngay trong trình duyệt — mô hình Stable Diffusion thật chạy cục bộ trên GPU của bạn. Không tải lên, không đăng ký, không API: prompt không bao giờ rời khỏi thiết bị.
Cách tạo ảnh AI từ văn bản
Mô tả điều bạn muốn thấy. Ghi cụ thể chủ đề, phong cách và bối cảnh — ví dụ «một con cáo đỏ trong khu rừng tuyết, tranh màu nước, ánh sáng dịu». Nhấn Tạo ảnh và xem thanh tiến trình.
Lần đầu dùng, mô hình khoảng 2,4 GB được tải vào bộ nhớ trình duyệt. Chỉ một lần; các lần sau khởi động ngay từ bộ nhớ đệm.
Khi ảnh hiện ra, đổi mô tả hoặc giữ nguyên rồi tạo lại — mỗi lần đều gieo giá trị ngẫu nhiên mới, kết quả nào cũng độc nhất.
Lưu ảnh ưng ý dạng PNG bằng nút Tải xuống. Ảnh 512×512 pixel, hợp làm avatar, minh họa blog và bản phác ý tưởng.
Nếu không có gì xảy ra, trình duyệt của bạn có thể thiếu GPU. Công cụ cần WebGPU (Chrome/Edge bản mới). Máy không có GPU tương thích sẽ không tạo được ảnh.
Mẹo thực tế
Mô hình thật chạy trên GPU của bạn, không phải máy chủ
Phần lớn «công cụ tạo ảnh AI miễn phí» chỉ là lớp vỏ mỏng bọc một API trả phí. Chữ của bạn bay đến trung tâm dữ liệu, xếp hàng chờ, hết quota miễn phí rất nhanh. Công cụ này khác: nó tải SD-Turbo — Stable Diffusion một bước thật sự — và chạy toàn bộ quy trình trong trình duyệt của bạn, trên GPU qua WebGPU. Kiến trúc này mang lại lợi ích thật. Không gì bị tải lên, không có chính sách quyền riêng tư phải lo, không có tài khoản để mất. Tốc độ là tốc độ phần cứng của bạn, không phải tâm trạng của hàng đợi chung. Sau lần tải đầu, công cụ chạy được cả khi không có mạng.
Vì sao một bước: sự đánh đổi của SD-Turbo
Stable Diffusion cổ điển khử nhiễu trong 20–50 bước. SD-Turbo được chưng cất để xong trong một bước, nên chạy ở tốc độ tương tác trên GPU phổ thông. Việc chưng cất dùng huấn luyện đối kháng: mô hình học cách nhảy thẳng đến ảnh cuối. Cái giá là hữu hình. Mô hình nhiều bước cho chi tiết mịn hơn, tay và mặt chuẩn hơn. Đổi lại, SD-Turbo trả kết quả trong vài giây trên card tầm trung và dùng ít bộ nhớ hơn — chính điều này khiến việc chạy trong trình duyệt khả thi.
Viết prompt hiệu quả
Quy tắc giống các mô hình Stable Diffusion khác: chủ thể, rồi hành động hoặc tư thế, rồi phong cách, ánh sáng và không khí — «một con cáo đỏ trong rừng tuyết, tranh màu nước, ánh sáng dịu». Danh từ cụ thể thắng tính từ mơ hồ. Từ phong cách như màu nước, pixel art đổi kết quả đáng tin cậy; «làm cho đẹp» không có tác dụng. Mô hình một bước này không hỗ trợ chỉ dẫn phủ định («không có mây») — hãy viết điều bạn muốn, không phải điều bạn không muốn. Nếu kết quả gần đúng, giữ nguyên mô tả và tạo lại — tính ngẫu nhiên sẽ cho một phiên bản khác của cùng cảnh.
Biết giới hạn để kỳ vọng trung thực
Đầu ra là 512×512 pixel, độ phân giải gốc của dòng mô hình này. Chữ và logo sẽ méo mó — mô hình sinh ảnh nhỏ không biết đánh vần. Tay, mặt trong đám đông và chi tiết cơ khí tinh xảo thành nhiễu loạn. Cảnh phức tạp nhiều vật thể dễ nhão. Chân thực như ảnh chụp khả thi với chủ thể đơn giản, kém tin cậy với cảnh phức tạp. Nếu bạn cần độ phân giải in ấn, chữ đọc được hay người chân thực, mô hình đám mây vẫn dẫn trước. Hãy coi công cụ này là sổ phác thảo tức thì: concept art nhanh, ý tưởng avatar, moodboard và tranh minh họa nhỏ, tạo riêng tư trên phần cứng bạn đang có.
Giấy phép, an toàn và sử dụng tốt
SD-Turbo là mô hình trọng số mở do Stability AI công bố; chạy cục bộ nghĩa là hình ảnh thuộc về bạn. Hãy tôn trọng luật hiện hành, không tạo nội dung gây hiểu lầm, hình ảnh thù ghét hay chân dung người thật khi chưa được đồng ý. Mô hình không lọc nội dung — trách nhiệm về thứ bạn tạo thuộc về bạn, như cọ vẽ hay máy ảnh. Vì quá trình tạo hình diễn ra hoàn toàn trên thiết bị của bạn, công cụ này cũng là minh chứng lặng lẽ cho hướng đi của AI: mô hình hữu ích không còn cần trung tâm dữ liệu. Khi trình duyệt truy cập GPU hoàn thiện hơn, chính kiến trúc này sẽ chở các mô hình lớn hơn — còn câu chuyện quyền riêng tư thì vẫn vậy.