微学AI
08-04·AI领域创作者
MiniMax H3多模态能力表现如何?
Minimax H3
2K视频8毛一秒,H3成本魔术
7月31号MiniMax H3发布,最让我震惊的不是排名,是价格。2K分辨率每秒0.8元,比主流模型便宜了三分之二。我第一反应是:是不是砍了参数换低价?翻了技术博客才发现,根本不是那回事。核心是H3-VAE这个自研视觉压缩模块,把画面压缩率提了4倍。同样一段2K视频,Token直接降到四分之一。加上定制的全模态表示管线,原来十万Token的多模态素材压缩到平均4000 Token,算力消耗自然就下来了。有意思的是,同行做2K大多是低清模型加独立超分模块,等于跑两次模型,成本翻倍。H3用上下文再生机制,让基础模型结合原始上下文直接出高分辨率,省了超分模块的算力,还顺便把画面里的小字和金属纹理还原得更好。异构训练架构的负载均衡优化又让端到端吞吐提升了近三成。我之前一直觉得全模态生成普及的门槛是性能,现在回头看,真正的门槛是价格。0.8元一秒,这个数字比任何benchmark都让我兴奋。
发布于 福建
1
1
1
未登录
友善发言
image-upload
评论
加载中