Midjourney:AI 图像生成的”审美天花板”,把提示词变成艺术级画作
官方背景 Midjourney 是由 David Holz 于 2022 年创立的独立 AI 研究实验室,以生成极具艺术质感与电影级光影的 AI 图像著称。它最初仅通过 Discord 机器人运行,如今已发展出独立的 Web 创作平...
Codex:OpenAI 的云端编码智能体,把大模型变成会写代码的同事
官方背景 Codex 是 OpenAI 推出的云端编码智能体(coding agent),把前沿大模型直接变成可以'动手写代码'的同事。它最早随 Codex CLI 与 ChatGPT 中的编码能力亮相,随后演进为覆盖 Web、桌面 ...
Stable Diffusion
官方背景 Stable Diffusion 是由 Stability AI 于 2022 年 8 月开源发布的潜在空间(Latent)文本生成图像扩散模型,是真正把 AI 生图带进普通人电脑的里程碑。它的核心算法源自慕尼黑大学 CompV...
HunyuanImage(混元生图)
官方背景 HunyuanImage(混元生图)是腾讯混元大模型家族中的图像生成产品线,由腾讯混元团队自研,与混元生文(Hy3)、生视频(HunyuanVideo)、生 3D 同属腾讯全链路自研的多模态矩阵。混元图像...
Muse Image
官方背景 Muse Image 是 Meta 超级智能实验室(Meta Superintelligence Labs, MSL)于 2026 年 7 月发布的旗舰级图像生成模型,也是 Meta 迄今最先进的生图模型。它与同底座的视频模型 Muse Vide...
Seedream 5.0
官方背景 Seedream 5.0 是字节跳动 Seed(豆包大模型)团队自研的新一代图像生成基础模型,与视频模型 Seedance 同属字节多模态矩阵,底层依托豆包大模型体系。它于 2025 年迭代至 5.0,并通过火山...
Qwen-Image(通义万相)
官方背景 Qwen-Image(中文品牌'通义万相')是阿里通义实验室(Tongyi)于 2025 年推出的开源图像生成基础模型,对外以'通义万相'产品形态提供服务(tongyi.aliyun.com / 阿里云百炼 Model Studi...
ERNIE-Image(文心一格)
官方背景 ERNIE-Image 是百度基于'文心'(ERNIE)大模型体系打造的图像生成能力,对外以独立产品 文心一格(yige.baidu.com)提供服务,底层依托文心大模型的多模态底座与 ERNIE-ViLG 文生图技术...
HiDream-O1-Image
核心能力 HiDream-O1-Image 是由 HiDream-ai 在 2026 年 5 月 8 日以 MIT 协议开源的 8B 参数图像生成模型。它最关键的差异化是把 VAE、文本编码器、扩散主干三件套压缩进一个Pixel-level Unifi...