Steven张宏伟
06-23 · 险峰长青
百度开源Unlimited OCR,3B模型刷新端到端SOTA百度开源Unlimited OCR,总参数3B、激活仅500M,在OmniDocBench v1.5、v1.6分别取得93.23%、93.92%,刷新端到端SOTA并超越235B的Qwen3-VL等大模型。核心技术R-SWA让模型始终可见完整原文、仅回看前128个token,把KV缓存固定为恒定队列,实现一次推理转录数十页文档不失忆、不降速。模型与代码已上线GitHub与HuggingFace,核心贡献者疑为DeepSeek出走的OCR大神魏浩然。
发布于 北京
1
评论
未登录
友善发言
image-upload
评论
加载中