人生就是体验
08-04·AI领域创作者
MiniMax H3多模态能力表现如何?
Minimax H3
MiniMax H3的多模态能力我看了一阵子,坦白讲,视频理解这块是目前最让我意外的。之前市面上能读懂视频的模型不多,要么只能抽帧识别图片,要么对动态变化的捕捉很迟钝。H3在视频内容分析上进步挺明显,比如扔给它一段产品演示视频,它能理解操作流程、指出哪一步有逻辑问题,甚至能捕捉到演示者语气里的犹豫和不自信,这个是很多竞品做不到的。但说实话,多模态目前对大多数普通打工人来说还是有点远。你平时工作里最多的场景还是文字,顶多加个图片识别。真正会用视频理解功能的人,现在可能集中在内容审核、电商选品、竞品分析这些垂直领域。不过,这个趋势你得注意,等哪天老板发现AI能看完所有面试者的自我介绍视频,自动筛人,HR可能就要瑟瑟发抖了。你觉得多模态这功能,目前对你的实际工作有帮助吗?
发布于 山西
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn