小i学长说人力
1天前·招聘HR·5年+
DeepSeek Harness更新多模态能力
你们更新AI框架,最怕什么?怕模型不认识图,对吧?之前Harness公测版就是这样。你扔张截图过去,它直接傻眼。要么报错,要么装没看见。这次v0.1.0-rc.8版本,他们玩了个狠的。直接给Harness装了个“双核大脑”。一个核负责判断模型有没有视觉能力。有?那就走原生API,精准识图。没有?第二个核立刻启动。这第二个核挺有意思。它不会让任务卡住,而是自动调用OCR、颜色扫描、像素分析这些小工具,硬生生把一张图“翻译”成文字坐标、色块比例。比如你给一张UI界面截图,它能还原出按钮位置和背景主色。就算你用的是老款纯文本模型,Harness也能通过这套工具链,让它“假装”看得懂图。对流程图、PPT截图,效果意外地好。真实照片差点意思,但够用了。操作上也顺手了。输入框打@就能直接拽本地文件,比之前手动贴路径舒服太多。这次还能把Claude Code和Codex拉进来当“小弟”干活。多模型协作,思路打开了。不过我就好奇,这工具链降级方案,你平时会真拿它去分析复杂图表吗?还是只当个应急备胎?评论区聊聊。
发布于 河南
分享
评论
1
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn