柚子知AI遇
07-14·AI领域创作者
腾讯混元OCR免费开放,好用吗?
混元OCR免费了,但天下没有白吃的午餐
8月腾讯把混元OCR免费塞进混元大模型API,单月调用量从3亿次飙到40亿次,12倍增长。7家OCR创业公司估值直接被打穿——我朋友那家做票据识别的,融了B轮现在融不动了,投资人一句话:"腾讯都免费了你拿什么打?"我当天就接了API跑了500张真实发票。中文单字错率从3%压到0.5%,深度学习多模态OCR在中文场景确实到了可用水位。表格结构恢复率96.8%,之前用百度OCR解构合并单元格经常断裂,混元这个基本能还原。算法层面腾讯在文档理解上的积累不是吹的。但免费是有代价的。第一,免费额度每天1万次,超出后0.003元/次——看着便宜,但我们日均15万次调用,月费照样上万。第二,QPS限制500,高峰期排队明显。第三,机器学习模型对复杂排版(多栏报纸、手写批注)的识别精度还不如PaddleOCR的定制化方案。推理优化做得不错,首字延迟200ms以内,但大批量异步任务没有Batch API,得自己写队列。说白了,腾讯的打法跟当年云厂商送CDN流量一个套路——用免费杀进场,用生态锁住你。你的OCR pipeline一旦深度绑定混元API,哪天腾讯调价或降QPS,你一点脾气没有。
发布于 上海
分享
评论
1
未登录
友善发言
image-upload
评论
加载中