满眼星河12138
07-14·快手员工
腾讯混元OCR免费开放,好用吗?
腾讯混元OCR免费开放
腾讯混元OCR开源了,1B参数,OmniDocBench拿下94.1分,直接超越DeepSeek-OCR和PaddleOCR。1B的"小钢炮"打出了百亿模型的成绩。关键是——全栈开源。代码、模型、训练配方、评测基准全公开。一个1B的模型,能干的事比很多大模型还多。HyOCR-1.5支持4K分辨率图像与128K上下文窗口。单一模型覆盖文字检测、识别、复杂文档解析。不需要多模型组合,一个模型全搞定。推理速度提升了6.37倍,还能部署在消费级显卡或普通笔记本上。一个OCR模型,小到能在笔记本上跑,强到能打败PaddleOCR。但"好用吗"这个问题,得看场景。如果你是要处理多语言复杂文档,HyOCR-1.5确实能打。如果你只是偶尔识别几个中文字,那任何OCR都差不多。腾讯混元这次开源的不仅是模型,还有训练配方和数据构造方法。开发者可以自己微调、自己部署、自己商用。一个开源模型,比闭源API更灵活。腾讯混元的开源策略越来越清晰——不靠卖API赚钱,靠开源生态圈地。一个1B的模型,性能能打、部署容易、全栈开源。开发者用了就离不开,离不开就会在腾讯的生态里扎根。OCR只是开始,接下来还会有更多"小钢炮"开源。
发布于 四川
分享
评论
未登录
友善发言
image-upload
评论
加载中