燕子不南飞
08-04·奇安信员工
MiniMax H3多模态能力表现如何?
H3发布后,我最在意的不是它能生成15秒2K视频,而是它把文字、图片、视频、音频统一进一个模型,还开源了。以前做多模态应用,得拼好几个模型:一个理解图片,一个生成视频,一个处理音频,中间还要自己搭管线。H3把这一摊压到一个模型里,0.8元每秒的定价只有同类旗舰的三分之一。H3短期内不会让闭源视频模型失去市场,但它会大幅降低多模态应用的工程门槛。当团队不用为每个模态单独付费时,更多场景才跑得起来。至于视频质量,复杂打斗和高速运动镜头还有崩坏,但日常商用场景的性价比已经很突出。开源后社区能不能跟上,才是决定它走多远的关键。
发布于 江西
分享
评论
未登录
友善发言
image-upload
评论
加载中