熊二爱上光头强
07-14·IT支持·1年
腾讯混元OCR免费开放,好用吗?
1B参数吊打同行,混元OCR真香
腾讯这波我服了。HunyuanOCR只有1B参数,OmniDocBench拿下94.1分,直接把DeepSeek-OCR和PaddleOCR-VL甩在后面。最关键的是端到端架构,一次前向推理搞定检测、识别、解析,不用再搭一堆级联模块。我之前给客户做票据抽取,传统OCR pipeline调了三天表格还是乱码。这模型一把梭,发票字段直接输出JSON,公式转LaTeX,连视频字幕都能抽。1B参数意味着一张消费级显卡就能跑,部署成本几乎为零。免费开源还适配vLLM,腾讯这次诚意确实拉满了。唯一要观望的就是复杂手写体和低清扫描件的长期表现。
发布于 江西
分享
评论
1
未登录
友善发言
image-upload
评论
加载中