排序
Veo 3
Veo 3 是 Google DeepMind 推出的旗舰级 AI 视频生成模型,于 2026 年初发布,首次在主流视频模型中实现'原生音频'——在同一生成过程中同步产出画面、环境音效、配乐与对口型台词,无需后期配...
Hedra:一张图加一段声音,生出会说话会表演的 AI 视频
官方背景 Hedra 是一家生成式媒体初创,用 Character-3 等全模态模型,把「一张图 + 一段音频 / 文本」变成会说话、会唱、会表演的视频,全程无需拍摄。2025 年它推出 Character-3,用音频驱动...
Gen-4.5
Gen-4.5 是 Runway 于 2025 年 12 月推出的旗舰级 AI 视频生成模型,目前(2026)在 Artificial Analysis 文本生成视频榜单以 1,247 Elo 稳居第一,超越 Kling、Veo、Pika 等主流对手。Runway ...
Viggle:物理感知的 AI 动作迁移,把任意角色塞进参考视频里跳舞
官方背景 Viggle 是主打物理感知动作迁移的 AI 视频工具,核心技术是 JST-1 视频基础模型,能理解真实物理运动规律,把任意角色图套进参考视频的姿态里。它同时提供 Discord Bot 与 Web App,20...
Sora 2
Sora 2 是 OpenAI 于 2025 年底推出的旗舰级 AI 视频生成模型,最大突破在于原生同步音频——在同一次生成中同时产出画面、对话、音效与环境配乐,无需任何后期配音。它建立在 Diffusion Transf...
Haiper:DeepMind 与 TikTok 系团队打造的 AI 视频生成工具,DiT 架构主打真实感
官方背景 Haiper 是一家伦敦 AI 视觉创作公司,由来自 Google DeepMind 与 TikTok 的博士校友于 2021 年创立,2024 年初完成 1,380 万美元种子轮。其 Haiper 2.0 模型发布后不到 200 天便突破 4...
Vidu
Vidu 是北京生数科技联合清华大学于 2024 年发布的中国首个长时长、高一致性、高动态性视频大模型,由清华大学计算机系教授、IEEE Fellow 朱军领衔创立。它基于全球首创的 U-ViT 融合架构(Diff...
MiniMax H3:33B 全模态开源视频模型,2K 立体声每秒只要 8 毛
官方背景 MiniMax H3 是 MiniMax 于 2026 年 7 月 31 日发布、8 月 3 日开源的首款全模态生成模型,也是视频赛道首个达到商用级水平并开放权重的旗舰。它采用 H3-Base(33B Dense)开源 + H3-Co...
海螺AI
海螺AI(Hailuo AI)是国产 AI 公司 MiniMax(稀宇科技)推出的 AI 视频创作平台,也是国内最早将文本/图片一键转化为高质量视频的消费级产品之一。它背后是 MiniMax 自研的 Hailuo 视频大模型...
Hailuo AI 海螺:MiniMax 旗下电影感 AI 视频,角色一致性口碑第一
官方背景 Hailuo AI(海螺) 是 MiniMax 旗下的 AI 视频生成平台,2024 年 9 月上线,以电影感运动物理与角色一致性著称,被视为 2026 年最值得关注的文本 / 图像生视频工具之一。底层运行 Mini...