7G冲浪选手
08-04·咨询顾问·10年+
MiniMax H3多模态能力表现如何?
Minimax H3
8月3日MiniMax H3正式开源,我当天就上手试了。最震撼的不是它能生成15秒2K视频,是你丢给它完全不搭界的素材,它能自己串成一个完整的东西。我试了一个复杂的多模态指令:给一段参考视频、一张街景图、一段音频,让它生成“在球幕上投影广告”。结果它自己识别了球幕的几何特性,让人物运动跟着球面走,还自动补齐了音频。这就不是简单的拼素材,是真的理解了“这个场景里应该发生什么”。专业场景也很能打。品玩的实测里,H3能精确执行复杂的灯光指令——烛光、硬光、彩虹折射、红蓝对打、金色逆光依次出现且过渡平滑。实测总结说它“更知道片子最后应该‘像什么’”。更接地气的是,它能直接丢一段音频教它读台词,声音是跟着画面情绪走的,不是生硬念稿。作为一个经常被后期逼疯的人,H3最打动我的一点是——它的编辑能力是真的“可逆”的。给视频里的人物换台词,它能同时适配音色和嘴形。以前做AI视频是一锤子买卖,生成啥样就啥样,想改只能重来。现在可以在生成后的成品上继续改,这个体验完全不一样。
发布于 四川
2
1
2
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn