排序
FLUX 3:Black Forest Labs 的多模态世界模型,一次生成带原生音频的 20 秒视频
官方背景 FLUX 3 是德国 Black Forest Labs 于 2026 年 7 月 23 日发布的多模态基础模型,由 FLUX.1 / FLUX.2 图像系列升级而来。它不再只是图像生成器,而是用统一架构联合学习图像、视频、音...
Pika 2.2:Stanford 团队打造的 AI 视频生成器,把脑洞一键变成 10 秒电影感短片
官方背景 Pika Labs 2023 年由 Stanford AI Lab 博士 Demi Guo 与 Chenlin Meng 创立,pika.art。从 Pika 1.0 起步,连续迭代 1.5 / 2.0 / 2.1 / 2.2 与 Turbo、Pro 速度分支;社区累计 1100 万...
Luma Dream Machine:Ray3 视频生成模型,物理级真实感 AI 影片创作
官方背景 Luma AI(Luma Labs)是总部位于旧金山的 AI 视觉公司,成立于 2021 年,以 NeRF(神经辐射场)3D 重建技术起家,后转型为 AI 视频生成领域的头部玩家。其旗舰产品 Dream Machine基于...
Kling AI:快手可灵,把创意一键拍成电影
官方背景 可灵AI(Kling AI)是快手(Kuaishou)自研的多模态 AI 视频与图像生成平台,2024 年 6 月全球首发,底层采用 DiT 架构,率先打破海外视频模型垄断。2026 年 2 月 5 日,可灵全球上线 ...
通义万相
通义万相(Tongyi Wanxiang / Wan)是阿里巴巴通义实验室(Tongyi Lab of Alibaba Group)推出的 AI 视觉生成套件,也是目前业内首个以 Apache 2.0 协议开源的视频生成大模型系列,GitHub 累计 ...
海螺AI
海螺AI(Hailuo AI)是国产 AI 公司 MiniMax(稀宇科技)推出的 AI 视频创作平台,也是国内最早将文本/图片一键转化为高质量视频的消费级产品之一。它背后是 MiniMax 自研的 Hailuo 视频大模型...
Vidu
Vidu 是北京生数科技联合清华大学于 2024 年发布的中国首个长时长、高一致性、高动态性视频大模型,由清华大学计算机系教授、IEEE Fellow 朱军领衔创立。它基于全球首创的 U-ViT 融合架构(Diff...
Sora 2
Sora 2 是 OpenAI 于 2025 年底推出的旗舰级 AI 视频生成模型,最大突破在于原生同步音频——在同一次生成中同时产出画面、对话、音效与环境配乐,无需任何后期配音。它建立在 Diffusion Transf...
Gen-4.5
Gen-4.5 是 Runway 于 2025 年 12 月推出的旗舰级 AI 视频生成模型,目前(2026)在 Artificial Analysis 文本生成视频榜单以 1,247 Elo 稳居第一,超越 Kling、Veo、Pika 等主流对手。Runway ...
Veo 3
Veo 3 是 Google DeepMind 推出的旗舰级 AI 视频生成模型,于 2026 年初发布,首次在主流视频模型中实现'原生音频'——在同一生成过程中同步产出画面、环境音效、配乐与对口型台词,无需后期配...