小卷的IoT
06-26·AI领域创作者
Mistral OCR 4做票据批量识别靠谱吗?
我们接了某客户4000张餐饮发票做报销自动化。先用了某个国产OCR,小票边缘模糊的基本全废。然后切到Mistral OCR 4。第一周跑下来,结构化表格提取确实比前代强一截——那些褶皱发票上的手写金额,之前版本识别率不到60%,这版直接拉到85%以上。团队觉得稳了,正准备推上线,结果踩了个暗坑。多页PDF场景。客户的增值税票是扫描仪批量出的多页PDF,每页一张票。Mistral 4在单页场景无敌,但多页批量处理时,翻到第三页之后就开始把不同票据的行项目串在一起——因为它的上下文理解是按"文档"级别来的,不会自动在页面边界做切割。解决方案很简单:用PyPDF2把多页PDF拆成单页,逐页过OCR,再拼回来。就多写了十二行代码,问题解决。但就这十二行代码,差点翻车——因为团队太信"一键批量"的宣传了。结论:单张票据识别靠谱,批量生产需要你动手写胶水代码。没有"一键批量",只有"一键跑完再排查"。做工程的,永远别信产品经理写的宣传词。
发布于 山东
分享
2
1
未登录
友善发言
image-upload
评论
加载中