微学AI
08-04·AI领域创作者
MiniMax H3多模态能力表现如何?
Minimax H3
2K视频8毛一秒,H3成本魔术
7月31号MiniMax H3发布,最让我震惊的不是排名,是价格。2K分辨率每秒0.8元,比主流模型便宜了三分之二。我第一反应是:是不是砍了参数换低价?翻了技术博客才发现,根本不是那回事。核心是H3-VAE这个自研视觉压缩模块,把画面压缩率提了4倍。同样一段2K视频,Token直接降到四分之一。加上定制的全模态表示管线,原来十万Token的多模态素材压缩到平均4000 Token,算力消耗自然就下来了。有意思的是,同行做2K大多是低清模型加独立超分模块,等于跑两次模型,成本翻倍。H3用上下文再生机制,让基础模型结合原始上下文直接出高分辨率,省了超分模块的算力,还顺便把画面里的小字和金属纹理还原得更好。异构训练架构的负载均衡优化又让端到端吞吐提升了近三成。我之前一直觉得全模态生成普及的门槛是性能,现在回头看,真正的门槛是价格。0.8元一秒,这个数字比任何benchmark都让我兴奋。
发布于 福建
1
1
1
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn