
第一章|视频后期,这次真要失业了
做自媒体的都懂一个痛:AI 视频模型生成一段素材,只是开始。后面还有一万件事——拖进 PR、加字幕、调色、做转场、配音乐、套模板……后期才是无底洞。
7月底,MiniMax 甩出 H3,直接把这套流程端到端吞了。它是 MiniMax 首个 开源视频模型,也是今年继 Seedance 之后第二个让人”后背发凉”的发布。花体字、字幕动画、动态片头,你只给一段文本,它直接端到端生成,默认还给你 2K 清晰度。
一句话总结:以前视频模型只给你”素材”,H3 直接还你”能一键发布的成品”。
第二章|H3 到底强在哪:手绘即特效
H3 最炸裂的能力叫 「手绘即特效」。过去你想在视频里加花体字、动态 logo、字幕动画,得后期软件折腾半天。现在?给个 tag,比如”苹果发布会风格”,它直接给你渲染出玻璃质感特效和渐变——连转场和背景音乐都一起生成了。
它支持三种生成方式:文生视频(纯文本出片)、图生视频(给首帧/尾帧锚定)、参考生视频(最多喂15个参考输入,图片+视频+音频一起上)。人物一致性、运动、镜头、声音、风格,一次锁死。
单次最长 15 秒,价格还便宜到离谱——768p 低至 0.1元/秒,2K 低至 0.2元/秒。一条2K视频也就两三块钱。
第三章|三步上手:网页、平台、API
零基础也能玩,三条入口:
一、海螺 AI(hailuoai.video)。最省事。注册登录,模型菜单选 H3,浏览器里直接生成,不用写代码,不用管 key。新手先在这测手感。
二、LibLibTV(liblib.tv)。进画布,加一个视频节点,模型选 MiniMax H3;要喂参考就把图片/音频/视频拖上画布连根线;写 prompt,设比例清晰度和时长,点生成,两分钟出片,节点上直接下载。
三、EvoLink API。开发者用。三个模型 ID 按输入类型分:minimax-h3-text-to-video、minimax-h3-image-to-video、minimax-h3-reference-to-video。异步提交拿 task ID 轮询下载,失败全额退。

第四章|实战:一条提示词出一支能发的片
AI 视频别指望一次成功,但提示词越具体越稳。一个能打的模板长这样:
主体 + 地点 + 动作 + 镜头 + 光线 + 风格 + 不要什么。
比如:”一位日本年轻女性走过雨后的东京街道,手拿透明雨伞,侧面跟拍,路面有反光,真实摄影风格”。比”生成一个美女视频”强一百倍。
对人物、商品、品牌物料有要求?先准备一张干净参考图,再让 H3 做动态展示,主体一致性比纯文生稳得多。同一个需求至少跑三个版本——真实摄影版、广告短片版、电影感版——挑最稳的继续磨。手快的话,从发现缺镜头到补上,十分钟搞定。
第五章|进阶:参考生视频锁死一切
H3 的 Omni-Reference 是多模态参考的杀器。最多15个输入,你给每个参考一个明确角色:这张管人物长相,那段管运动轨迹,这段音频管背景音乐和节奏,那张图管整体风格。
角色不冲突,执行就准。比如做一支时尚 MV:上传歌手定妆照锁脸,上传一段舞蹈视频迁移动作,上传一首歌定节奏,再写 prompt 描述镜头调度。出来的成片,脸、衣服、发型全程一致,运动流畅,音乐卡点——商业级素材,成本却只有传统方案的三分之一。
做电商、做 TVC、做产品展示的团队,这套能让你一天测十版不同创意,老板挑花眼。

第六章|避坑清单:新手最容易翻车的地方
一、一条只交代一个场景。H3 擅长单场景单状态,跨镜头叙事自己剪。反正便宜,多生成几条再拼,比让它一次干完更划算。
二、别信宣传片的完美。自己测真实需求才有用:人物手部、眼神、衣服运动自不自然?产品变形没?文字 logo 稳不稳?抽几次卡再下结论。
三、主体一致性靠参考图。纯文生人物容易每帧变脸。要角色固定,一定上图生视频或参考生视频。
四、音频同步要测。H3 主打原生立体声音频,但唱歌、说话、环境音的效果得实测,别假设它自动对了。
第七章|总结:当视频便宜到3块钱一条
过去半年视频模型一直在”能力”那头卷,H3 上线这天,比拼开始往”成本”那头走。当一条2K视频便宜到两三块钱,要不要为一个镜头动用 AI,不再是需要计算的决定。
对自媒体、电商、小团队来说,这意味着:你离”一个人就是一支视频团队”又近了一大步。打开海螺 AI,先跑三条测试片。等你的爆款从 H3 里蹦出来,记得回来报喜。
暂无评论内容