人生就是体验
08-04·AI领域创作者
MiniMax H3多模态能力表现如何?
Minimax H3
MiniMax H3的多模态能力我看了一阵子,坦白讲,视频理解这块是目前最让我意外的。之前市面上能读懂视频的模型不多,要么只能抽帧识别图片,要么对动态变化的捕捉很迟钝。H3在视频内容分析上进步挺明显,比如扔给它一段产品演示视频,它能理解操作流程、指出哪一步有逻辑问题,甚至能捕捉到演示者语气里的犹豫和不自信,这个是很多竞品做不到的。但说实话,多模态目前对大多数普通打工人来说还是有点远。你平时工作里最多的场景还是文字,顶多加个图片识别。真正会用视频理解功能的人,现在可能集中在内容审核、电商选品、竞品分析这些垂直领域。不过,这个趋势你得注意,等哪天老板发现AI能看完所有面试者的自我介绍视频,自动筛人,HR可能就要瑟瑟发抖了。你觉得多模态这功能,目前对你的实际工作有帮助吗?
发布于 山西
分享
评论
未登录
友善发言
image-upload
评论
加载中