AI 文件识别

AI 文件识别实际做到什么、做不到什么:由 76 张真实收据说起

卖 AI 的人很少讲限制。但如果你打算用它入账、入系统,你最需要知道的就是它哪里会失手。这篇用我们实测回来的数字来讲。

2026-09-06

先讲做得到的那部分

我们做过的收据识别项目 ThatReceipt76 张真实收据做过实测:金额准确度 94.7%、币别准确度 98.7%、每张大约 3 秒

这个数字最有用之处不是「多高」,而是「有得量」。任何人跟你说他的 OCR 很准,你都应该问回去:用哪批文件测?多少张?哪个字段?我们在开工之前会拿你自己的文件做同一件事,出来一个属于你那批文件的数字,而不是一个 marketing 数字。

抽到的字段可以直接入你后台,不用人手动打第二次 —— 这才是省下时间的那部分。单纯「认到那些字」但还要人手动复制粘贴,其实没省到多少。

香港文件不是一种文件

「文件识别」听上去是一个功能,实际上每种文件都要独立校准。

我们的 OCR 示范 现在支持结婚证书、身份证和出生纸三种,住址证明还在开发中。光是香港身份证就抽 9 个字段:中文姓名、英文姓名、姓名电码、出生日期、性别、符号、首次登记码、签发日期和身份证号码。

出生纸和结婚证书更加麻烦:识别引擎读出来的文字次序不可靠,同一张纸每次读出来的排列都可能不同。所以我们不靠 OCR,改用空间坐标 —— 即是看每个字实际印在纸的哪个位置,再按位置对回字段。这个做法麻烦很多,但抽得稳很多。

做不到的事情,我们照讲

水印盖住的字段会抽不到。扫描太浅、拍得斜、反光、折痕,全部会影响结果。这些不是软件写得差,是识别本身的物理限制 —— 人眼看不清楚的那些位,机器也一样看不清楚。

所以识别永远不会百分之百准。重要的字段(金额、证件号码、日期)应该保留一个人工复核步骤,或者设一个信心门槛,低过门槛就转人工。我们在设计流程的时候会直接跟你说哪些字段可以放心自动化、哪些要留人。

也不要拿示范的结果直接入账。示范是给你看个能力,不是一个经过你公司流程验证的系统。

你的文件会去哪里

这是最多人问的一条。

我们的 OCR 示范里面,你上传的那张图只在内存处理:传去 Google Cloud Vision 做文字识别,抽到的字段回传你的浏览器,我们这边不会写入任何数据库、存储桶或者文件。你可以在隐私政策看到同一句话写得更加详细。

正式生产用途的时候安排不同:系统运行在你自己的云端账户,文件和抽到的数据都留在你自己的环境,我们不会经手。这不止是隐私问题,也是所有权问题 —— 你随时可以收回权限而不会失去系统。

顺便一提:示范是免费的、不用留邮箱,你想试多少次都行(合理使用范围内)。

怎样开始,要多少钱

最便宜的开始方法是零成本:拿你自己一份真文件去试个示范,看下 它在你那种文件上面表现怎样。试完你会立刻知道这件事对你有没有用。

要做正式系统的话,AI 文件识别由 HK$32,000 起,包括一种文件类型校准、用你真实文件做准确度实测、同接入你自己的后台。每加一种文件类型由 HK$12,000 起。如果你的痛点不止是认字,而是整个流程(例如收据入账、对账),可以看自动化模块,由 HK$18,000 起

我们建议从最痛的那种文件开始 —— 通常是每个月数量最多、现在靠人手动打字的那种。做一种、验一种、省到时间再做下一种。

想知道你的生意实际该怎么做?

一封 email 讲你想在网上做到什么,我们回你书面范围与固定报价。

找我们聊 →
← 返回网志