文章来自于果核剥壳公众号首发:https://mp.weixin.qq.com/s/vh_GPgJeSQexrwgaM1jQDg
Seedance 要小心了。
这句话放在不久前,可能没人信。毕竟 Seedance 刚出来时,那电影级的画面质感,确实让不少人觉得就是 AI 视频的终点了。
但真正靠 AIGC 吃饭的创作者,都明白一个现实:画面再好看,不听话等于零。
客户要求 logo 必须沿着指定路径滚动,它给你拍成星际穿越,你让它生成一段 15 秒的奶茶店广告,它给你整出个赛博朋克短片。
十次抽卡,九次跑偏,剩下那次虽然画面炸裂,但产品信息全错。
特别是配音AI 演员一张嘴,非人类的违和感直接出戏,调都没法调。

(海螺视频-全视角工坊)
控制难、成本高、落地难。 这三个痛点,把多少想用 AI 接商业单的人卡在了门外。
而就在大家还在等海外视频模型放新大招的时候,MiniMax 把桌子掀了——全新的 MiniMax H3 模型来了。
MiniMax H3 模型
大家需要注意一下的是:MiniMax 不是单纯的 AI 创作平台,它自己就有推出新模型的能力,然后给其他平台使用!

这也意味着 MiniMax H3 发布之后,其他家 AI 创作平台的工具能力也会得到提升,这算是源头提供者了。
这次的 H3 是轻量级模型,可以输出 5—15 秒的视频,重点强化了多模态上下文能力,直接在专业评测机构 Artificial Analysis 拿下了视频编辑排行榜(含音频)的第一名!

不再是一次只能处理一段视频+图片+文本,现在你可以同时把文本、图像、视频、音乐等文件丢进去,它更能理解你的创作意图。

果核实际上手体验后,感觉 H3 的指令遵循效果确实很不错,在一些场景上比 Seedance 听话,也更具有性价比。
Seedance 的价格大概在3块钱每秒,而H3的2K 画质视频¥0.53 元/秒,最低能到 ¥0.40/秒!

商业场景实测,以前几十分钟的活,现在几分钟搞定。
位置与指令精确控制
外为了测试它对于位置关系的理解,果核直接上了一个真实工作场景。
平常做软件介绍类视频的时候,经常需要让各个软件图标丝滑切换,场景过渡的时候观感更好也更高级。

以前的话,需要去学习AE的动画,自己套模板打关键帧,还有寻找制作场景素材,别提有多麻烦。

而现在我们可以在剪辑软件里摆放好位置,接个图丢进去直接说:
为@图片1生成一个张纸样式的背景,后续的背景都是这个,@图片1里的logo沿着贴纸化的山坡滚动到@图片2的位置,最后放大到@图片3的样子,整体风格为无缝动画。
就这么轻松。

之后生成的效果可以说是直接拿来就能用,以前花几十分钟的效果现在几分钟就做好了,位置关系的处理很准确,是想要的运动效果,审美也在线。
更离谱的是这是一次就跑出来的效果,不需要重复抽卡,大家应该知道这一点“含金量”有多高吧~
毕竟现在的AI视频模型每重新生成一次,那都是真要花真金白银的!
专业用途有那味
在广告生成的场景方面,我们小伙伴正好要做一个用来介绍的视频项目。
用AI生成的提示词是这样的:
白色背景手绘MG动画风格,小清新线条,艺术感:画面中心一个老板模样的卡通人物看着一张报表,报表上数字乱跳。旁边弹出一个50平米的奶茶店,里面密密麻麻挤满了人(呈现不合理状态)。一个红色的“假”字盖戳落下。 旁白: 商业体营运难?报表数据水分大,50平米奶茶店日客流竟报5000人!音效: 盖章声“砰!”,警报音效。

来分别看一下生成的效果,先是MiniMax H3的效果,是符合要求的。
报表数据有乱跳,配音也是那个味:

而Seedance这边就显得比较尴尬了,在默认状态下,它更倾向于有趣,而不是准确执行内容。

影视内容或许有更多可能性,但在实用性方面H3更好。
游戏转场
对于H3直接输出的时长来说,用得比较舒服的场景是转场和品牌Logo视频等场景,其中用来做游戏转场也是一绝。
有些游戏原本是没那么酷炫的,想要剪出一个酷炫的视频有些麻烦,你就可以把游戏截个图上传,然后输入你想要的场景和动作。

比如把一个像素游戏的BOSS遭遇场景,转换成3D效果。
这在以前的游戏剪辑里是想都不敢想的事情。

如果你还有游戏设定集里的BOSS正面照片,那完全不用担心画面细节跑偏。
大家可能很好奇Seedance的效果,这里放一个对比,提示词是一模一样的,用得也不是fast和mini模型。

Seedance的效果不是不好,而是不太遵循指令!

Seedance效果
像是在法杖发出光芒前就改变了风格,然后整体的效果夸张,总是想做成电影的感觉,但是我们的提示词没有那些要求。
在商业场景上也比较有质感,这一块放两个视频给大家参考一下,可以看到模特和电视剧化的开头都有那味了。


动作替换
我们先来一个简单的多媒体素材,把经典动态表情包里的人物替换成小熊猫,最后替换成风格化的图片。

效果是下面这样的,就是按要求来的。

动作迁移可以说是做得非常不错。
配音输出不违和
还有一个是果核觉得 MiniMax H3 超越其他模型且不好替代的地方,而且很能提升视频效果的地方,它生成出来的配音,效果不违和。
如果你体验过其他平台的Agent就知道,画面什么的通过调整都还可以,就是AI演员的配音太出戏了,有种与画面无关的感觉,想要调好目前还比较麻烦!
而 MiniMax H3 的直出效果是这样的,只能说很强了,没有那种像是非人类说话的违和感(字幕也是它自己生成的)。

除了模型直出声音,你用来修改其他视频的声音也是可以做到的,拿个朋友的视频(已征得同意)来修改一下,可以看到效果是不错的。

里面有一句都不尽人意,改成了都非常不错,也把衣服换成黑色的,人物氛围换成在黄昏光线下。
MiniMax本身的音频处理技术就很强,现在结合视频之后,感觉以后拍摄时拍错了内容,都可以用H3修正回来,对视频创作者来说是个值得关注的模型。
性价比也是能商用的关键。
在这种短片段,需要严格遵循场景要求的前提条件下,MiniMax H3是比较有性价比的模型,根据会员的不同 768P视频 价格在 0.23 到 0.48 之间,非常划算了!

现在默认的清晰度是1440P模式,后续会开放768P的模式,相同模型下可以节省更多积分,觉得满意再升级成1440P。
由于是在模型层面节省的成本,也就是说,以后你在其他AI视频创作平台选择MiniMax H3,大概率也是有优惠的。
需要一款音频出众,模型听话且更侧重商业化场景的模型,可以试着用起来了!
8 月 8 日前,Minimax Hub 所有用户。
可免费生成 3 次 H3 视频,支持 2K,体验地址:

微信扫一扫
支付宝扫一扫 