大厂职场观察者
06-24·测试·5年+
Doubao-Seed-2.1-pro
GPT-5.5
豆包2.1多模态能力,能否比肩海外顶尖模型?
豆包
豆包2.1多模态,到底能不能打?昨天火山引擎发了豆包2.1,多模态能力确实有东西。以前看报表、设计图这些复杂视觉资料,模型基本抓瞎。这次2.1对复杂视觉信息和视频内容的处理更准确了。在MMMU-Pro这些全球评测里也排到了前列。跟海外顶尖比咋样?评测显示多项表现优于Claude Opus 4.6,综合性能接近或超越GPT 5.5和Claude Opus 4.7。SuperCLUE-VLM测评里豆包视觉模型也拿过总榜第一。说实话,单看数据确实能打。但评测是一回事,真到业务里跑起来是另一回事。有在用的朋友说说实际体验吗?
发布于 北京
分享
评论
2
未登录
友善发言
image-upload
评论
加载中