微学AI
06-23·AI领域创作者
GLM-5.1
Gemini
Gemini 3.5
百度开源Unlimited OCR 3B够用吗?
DeepSeek-V4
GPT-5.5
Qwen3.7
榜单告诉我,3B小模型杀疯了
我专门去扒了OmniDocBench v1.5的端到端OCR榜单,本来想看热闹,结果越看越上头。第一名GLM-OCR 0.9B拿了94.62%,第二名是百度自家的PaddleOCR-VL-1.5 0.9B 94.50%,第三名DeepSeek-OCR-2 3B 91.09%,Unlimited OCR 3B 93.23%虽然没挤进前三,但在端到端类目里稳稳压住一票百亿千亿大模型。再看v1.6的更新版,Unlimited OCR拿下93.92%,把"激活参数"这个变量拉到极致。PaddleOCR-VL-1.6更狠,v1.6拿到96.33%,直接干翻Gemini-3-Pro、GPT-5.2、MinerU-2.5-Pro,全球第一。可有意思的是,不管怎么排,3B这个档位现在成了"性价比甜点"——比0.9B能扛长文档,比235B跑得快还能本地部署。以前OCR圈卷参数,跟手机圈卷摄像头像素一样邪乎,现在有人掏出一台三摄小钢炮告诉你"够用就行",市场就被教育了。够不够用这事,得看场景。我手里这台MacBook跑不动235B的Qwen3-VL,但500M激活的Unlimited OCR能跑,那它就够用。算力就是话语权,部署门槛就是够不够用的真正分水岭。
发布于 福建
1
评论
未登录
友善发言
image-upload
评论
加载中