工具AI 工具使用指南常见问题打开编辑器
免费 · 浏览器内运行 · 14 种语言

AI 图片生成器

在你的浏览器里把文字变成图片 —— 真正的 Stable Diffusion 模型在你自己的显卡上本地运行。不上传、不注册、无 API:你的提示词一个字都不会离开设备。

如何用文字生成 AI 图片

01

描述你想看到的内容。主题、风格、场景写具体一点 —— 例如「雪林里的红狐狸,水彩画,柔光」。点生成,看进度条即可。

02

第一次使用时会下载约 2.4GB 的模型到浏览器存储,只需一次;之后每次打开都从缓存秒启动。

03

图片出来后可以换描述再点生成,也可以原样再点 —— 每次生成都会掷新的随机数,结果每张都不同。

04

满意的图点下载保存为 PNG。图片是 512×512 像素,适合做头像、博客配图和概念草图。

05

如果没反应,可能是浏览器不支持 GPU。本工具需要 WebGPU(较新版本的 Chrome 或 Edge);显卡不兼容的机器无法使用。

实用技巧

一个真的跑在你显卡上的模型,而不是服务器

大多数「免费 AI 图片生成器」只是付费云 API 的薄包装:你的文字飞到数据中心、排队、免费额度飞快用完。这个工具不一样:它把 SD-Turbo —— 真正的单步 Stable Diffusion 模型 —— 下载到你的浏览器里,文字编码、去噪 UNet、VAE 解码全部通过 WebGPU 在你的显卡上执行。 这种架构带来真实的好处:什么都不上传,没有隐私政策可担心,没有账号可丢;速度取决于你的硬件而不是共享队列的心情;首次下载完成后断网也能用 —— 模型住在你的浏览器存储里。

为什么只要一步:SD-Turbo 的速度取舍

经典 Stable Diffusion 用 20 到 50 步逐步去噪。SD-Turbo 被蒸馏成单步完成,所以能在消费级显卡上以交互速度出图。蒸馏靠对抗训练完成:模型学会了直接跳到最终画面,而不是逐步打磨。 代价也是可见的:多步模型细节更细腻、手和脸更协调。作为交换,SD-Turbo 在中端显卡上几秒出结果、占用内存更小 —— 这正是浏览器端部署能够成立的原因。

写出有效的提示词

提示词规则和其他 Stable Diffusion 模型一致:先说主体,再说动作或姿态,然后说风格、光线、氛围 ——「雪林里的红狐狸,水彩画,柔光」。具体的名词胜过空泛的形容词;水彩、像素、线稿、油画这类风格词可靠地改变画风,「让它好看」这种抽象指令没有用。 本模型不支持否定式指令(「没有云」),所以写你要的、而不是你不要的。如果结果接近但不够好,保持原描述再生成一次 —— 随机性会给同一个场景一个新的演绎。

认清边界,预期才诚实

输出是 512×512 像素,这是这类模型的原生分辨率。文字和标志会乱码 —— 小型生成模型不会拼写;手部、人群中的脸、精细机械结构会出现伪影;多物体的复杂场景容易糊成一团。照片级真实感在简单主体上可以做到,复杂画面则不可靠。 如果你需要印刷分辨率、可靠的文字渲染或写实人像,云端模型仍在前列。这个工具最好的理解方式 = 即时速写本:快速概念图、头像灵感、情绪板、小插图,用你已有的硬件私下生成。

许可、安全与良好使用

SD-Turbo 是 Stability AI 发布的开放权重模型,本地运行意味着生成的图归你使用。请遵守当地法律,不要生成误导性内容、仇恨图像,或未经同意的真人肖像。模型本身不做内容过滤 —— 你创作什么的责任在你,和画笔、相机同理。 因为生成完全在设备本地,这个工具也是 AI 走向的一个安静注脚:有意义的模型不再需要数据中心。随着浏览器 GPU 能力的成熟,同样的架构会承载更大的模型 —— 而隐私的故事不变。

相关工具

常见问题

这个 AI 图片生成器真的免费吗?+

真的。整个模型跑在你自己的设备上 —— 没有服务器、没有 API 账单、没有任何收费。你付出的只是自己显卡的算力和一次性约 2.4GB 的下载。

我的提示词会离开设备吗?+

不会。提示词、生成的图片和模型本身都留在你的浏览器里。首次下载完成后,断网也能用。

用的是什么模型?+

SD-Turbo —— 单步蒸馏版的 Stable Diffusion(fp16)。用一点点画质换速度:一步出图而不是几十步。

为什么图片只有 512×512?+

这是这类模型的原生分辨率。拿到修图软件里放大不会增加真实细节;更大的模型要多占好几个 GB。

为什么文字和细节有时会画错?+

小型生成模型对字母、数字、手部和精细细节处理较弱。写简单的提示词,把结果当概念图而不是成品看待。

能生成照片级真实感的图吗?+

简单场景有时可以。真实感方面云端模型(Imagen、Midjourney 等)强得多 —— 本工具是免费、私密、本地方案的诚实替代,边界清楚。