排序
MiniMax H3:33B 全模态开源视频模型,2K 立体声每秒只要 8 毛
官方背景 MiniMax H3 是 MiniMax 于 2026 年 7 月 31 日发布、8 月 3 日开源的首款全模态生成模型,也是视频赛道首个达到商用级水平并开放权重的旗舰。它采用 H3-Base(33B Dense)开源 + H3-Co...
Hedra:一张图加一段声音,生出会说话会表演的 AI 视频
官方背景 Hedra 是一家生成式媒体初创,用 Character-3 等全模态模型,把「一张图 + 一段音频 / 文本」变成会说话、会唱、会表演的视频,全程无需拍摄。2025 年它推出 Character-3,用音频驱动...
通义万相
通义万相(Tongyi Wanxiang / Wan)是阿里巴巴通义实验室(Tongyi Lab of Alibaba Group)推出的 AI 视觉生成套件,也是目前业内首个以 Apache 2.0 协议开源的视频生成大模型系列,GitHub 累计 ...
Seedance
Seedance 是字节跳动 Seed 团队自研的多模态 AI 视频生成大模型,原生音画一体生成架构,被《黑神话:悟空》制作人冯骥评为'当前地表最强视频生成模型,没有之一'。当前最新为 Seedance 2.5(20...
可灵AI
可灵AI(Kling)是快手自研的新一代 AI 视频与图像生成平台,于 2024 年 6 月率先在全球推出 DiT 架构视频大模型,一度打破国外模型垄断,长期位居全球视频生成第一梯队。其全球站点已全新升级...
Pika 2.2:Stanford 团队打造的 AI 视频生成器,把脑洞一键变成 10 秒电影感短片
官方背景 Pika Labs 2023 年由 Stanford AI Lab 博士 Demi Guo 与 Chenlin Meng 创立,pika.art。从 Pika 1.0 起步,连续迭代 1.5 / 2.0 / 2.1 / 2.2 与 Turbo、Pro 速度分支;社区累计 1100 万...
PixVerse:一个提示词生成带原生音频的多镜头短片,全球 1 亿创作者的 AI 视频引擎
官方背景 PixVerse 是覆盖 175 个国家、服务 1 亿+ 创作者的全球化 AI 视频平台,2023 年成立、团队横跨亚洲与美国。2026-03-30 发布旗舰模型 V6 同日完成 C 轮融资、跻身独角兽;此前 2026-01 ...
即梦 Jimeng:字节 AI 创作平台首发 Seedance 2.5,30 秒原生直出还能连 Maya/Blender
官方背景 即梦 Jimeng 是字节跳动旗下的一站式 AI 创作平台,隶属剪映生态,主打图片生成、视频生成与智能编辑。2026 年 7 月 31 日,即梦成为字节新一代视频模型 Seedance 2.5 的首发落地阵地...
Sora 2
Sora 2 是 OpenAI 于 2025 年底推出的旗舰级 AI 视频生成模型,最大突破在于原生同步音频——在同一次生成中同时产出画面、对话、音效与环境配乐,无需任何后期配音。它建立在 Diffusion Transf...
Veo 3
Veo 3 是 Google DeepMind 推出的旗舰级 AI 视频生成模型,于 2026 年初发布,首次在主流视频模型中实现'原生音频'——在同一生成过程中同步产出画面、环境音效、配乐与对口型台词,无需后期配...