排序
Muse Image
官方背景 Muse Image 是 Meta 超级智能实验室(Meta Superintelligence Labs, MSL)于 2026 年 7 月发布的旗舰级图像生成模型,也是 Meta 迄今最先进的生图模型。它与同底座的视频模型 Muse Vide...
Kolors 可图:快手开源文生图模型,写实人像 + 中英双语文字一次到位
官方背景 Kolors 可图是快手推出的开源文生图大模型,目前迭代到 Kolors 2.1。它在架构上以 SDXL 为骨干,把文本编码器换成 ChatGLM,从而获得原生的中文语义理解能力——这也是它区别于绝大多...
HunyuanImage(混元生图)
官方背景 HunyuanImage(混元生图)是腾讯混元大模型家族中的图像生成产品线,由腾讯混元团队自研,与混元生文(Hy3)、生视频(HunyuanVideo)、生 3D 同属腾讯全链路自研的多模态矩阵。混元图像...
NovelAI:把”小说续写 + 动漫生图”装进一个加密工作区的订阅制创意平台
官方背景 NovelAI 是 Anlatan LLC 于 2021 年 6 月 15 日推出的订阅制创意平台,把'小说续写'与'动漫风图像生成'装进同一个浏览器工作区。团队从 AI Dungeon 内容收紧的缝隙中切入,主打对成人 ...
Stable Diffusion
官方背景 Stable Diffusion 是由 Stability AI 于 2022 年 8 月开源发布的潜在空间(Latent)文本生成图像扩散模型,是真正把 AI 生图带进普通人电脑的里程碑。它的核心算法源自慕尼黑大学 CompV...
Automatic1111:把 Stable Diffusion 带给所有人的开源 WebUI,本地生图的”事实标准”
官方背景 AUTOMATIC1111 于 2022 年 8 月开源的 Stable Diffusion WebUI,是基于 Gradio 的本地文生图 / 图生图图形界面,GitHub 80k+ stars,是无数人第一次跑起 AI 生图的入口。它本身不训练...
Midjourney:AI 图像生成的”审美天花板”,把提示词变成艺术级画作
官方背景 Midjourney 是由 David Holz 于 2022 年创立的独立 AI 研究实验室,以生成极具艺术质感与电影级光影的 AI 图像著称。它最初仅通过 Discord 机器人运行,如今已发展出独立的 Web 创作平...
GPT Image 2
GPT Image 2(gpt-image-2)是 OpenAI 于 2026 年 4 月 21 日发布的旗舰图像生成与编辑模型,作为 ChatGPT Images 2.0 的底层引擎全面替代 DALL·E 3 与 GPT Image 1.5。它是 OpenAI 首个引入'...
Ideogram:把文字”写”进图片的 AI 图像生成器,海报 Logo 社媒图一键出图
官方背景 Ideogram 是专注'图内文字渲染'的 AI 图像生成平台,2023 年成立、总部位于多伦多,当前主力模型 Ideogram 3.0(2025 年 3 月发布)。它把文字当作原生图形单元来生成,图内文字准确率...
Nano Banana Pro
Gemini 3 Pro Image(社区代号 Nano Banana Pro)是 Google DeepMind 2025 年 11 月 20 日首发预览、2026 年 5 月 28 日在 Vertex AI 与 Google Workspace 正式 GA、2026 年 6 月起以稳定别名 g...