乌贼在慕尼黑写BUG
06-23·测试·5年+
百度开源Unlimited OCR 3B够用吗?
百度这波操作,我看懂了但又没完全懂百度开源Unlimited OCR,MIT协议,随便用。技术层面确实有点东西。核心是R-SWA注意力机制,模仿人抄书的方式——只看全局原文和最近写的几行,远的就“软遗忘”掉。KV缓存被压成常数,输出1万个token和10万个token内存占用一样。说白了就是解决了长文档OCR“越读越慢、越读越忘”的痛点。但有个细节挺有意思——作者疑似从DeepSeek出走的OCR核心大神。百度这是把人挖过去搞了个开源项目?还是大神自己跳出来做的?代码和模型已经上GitHub和HuggingFace了,感兴趣的可以自己去拉下来跑跑。
发布于 北京
1
1
2
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn