「99% 準確」是每家發票 OCR 供應商都會放在首頁上的數字,而且它幾乎總是只對一件事成立:讀取一張來自系統過去見過的供應商、格式整潔且以打字輸入的發票。對於真正會在後續流程中造成問題的欄位,準確度會明顯下降,包括貨幣符號、VAT 與稅金明細,以及非標準格式的日期;如果沒有人檢查,錯誤擷取正是在這些地方會造成實際金錢損失。

按欄位而非按發票計算的準確度
供應商所宣稱的準確度幾乎總是以每張發票而非每個欄位計算,這掩蓋了真正錯誤集中的地方。現代 AI 型 OCR 工具(不是較舊的範本比對類型)在某些欄位上的表現很好,但在其他欄位上則明顯較差:
| 欄位 | 典型準確度 | 原因 |
|---|---|---|
| 發票號碼 | 非常高 | 幾乎總是有清楚標示,且位於一致的位置 |
| 總金額 | 高 | 通常是頁面上最大且最醒目的數字 |
| 貨幣 | 中等 | 符號歧義($ 可用於 USD、CAD、AUD 等貨幣)會導致不易察覺的誤讀 |
| 稅金/VAT 明細項目 | 中等至較低 | 版面配置會因國家及供應商的開票軟體而有極大差異 |
| 日期 | 中等 | DD/MM 與 MM/DD 的歧義是經典且難以察覺的錯誤 |
| 明細項目 | 較低 | 多行、多欄的表格是任何 OCR 系統最難處理的版面配置 |
錯誤真正造成損害的地方
漏掉發票號碼令人惱火,但很明顯,通常會有人立即注意到。誤讀貨幣符號或弄錯日期格式則很危險,正因為這些錯誤不明顯:數字看起來合理,獲得核准,而錯誤可能要到數週後對帳時才浮現,甚至永遠不會被發現。請針對這些特定的高風險欄位建立審核步驟,而不是使用沒有人真正遵循的泛泛「檢查所有內容」指示。
在信任工具之前,如何真正測試它
- 先把最糟糕的發票交給它處理。 手寫的、以傾斜角度掃描的、採用外國供應商格式的,而不是供應商示範中的那張乾淨範例發票。
- 特別檢查對你最重要的欄位。 如果你處理多種貨幣,請對貨幣辨識進行壓力測試。如果你與國際供應商合作,請對日期解析進行壓力測試。
- 衡量欄位層級的準確度,而非發票層級的準確度。一張十個欄位中有一個欄位錯誤的發票,仍算是需要被發現的錯誤,即使整體擷取結果「看起來正確」也是如此。
- 設定強制審核門檻。任何金額高於你所選金額的發票,在進入下一步前,都必須由人工查看擷取出的欄位,無論工具的信心分數為何。
延伸閱讀:應付帳款自動化,從發票到付款。另請參閱 最佳 AI 發票產生器。
常見問題
AI 式 OCR 是否比舊式規則式 OCR 更準確?
通常是,尤其是系統此前沒有看過範本的供應商所開立的發票。規則式 OCR 需要相符的範本;AI 式擷取對新版面格式的泛化能力更好。
實際上我應該期待什麼樣的發票準確率?
對於來自已知供應商、版面乾淨且以打字方式製作的發票,準確度可達九成後段。對於手寫、掃描品質不佳或格式不熟悉的發票,準確度會明顯降低。請將任何單一的已公布準確度數字視為最佳情況,而不是典型情況。
OCR 錯誤會通過三方比對嗎?
如果錯誤出現在比對不會檢查的欄位,就會,例如誤讀稅額行或日期,因為三方比對主要是根據採購訂單和收貨單檢查數量與總金額。
小型供應商使用手寫發票,是否會成為決定性問題?
這不算是決定性問題,但請特別為這些發票預留額外的審核時間。大多數工具都會標記低信心度的擷取結果,因此預設應將這些結果交由人工處理,而不是相信低信心度的讀取結果。
我如何知道工具宣稱的準確度是否可信?
請確認這個數字是按欄位還是按發票計算,以及測試是在供應商自行整理的樣本集上進行,還是在混合的真實批次上進行。如果對方無法清楚回答,請先用你的實際發票自行測試,再做決定。
重點
發票 OCR 的準確度確實存在,但表現並不均衡:明顯欄位的準確度很高,但貨幣、稅額行和日期的準確度明顯較低,而這正是無聲錯誤會造成最大損害的地方。請在工具實際可能遇到的最差情況發票上進行測試,而不是使用示範樣本,並針對最可能出錯的欄位建立審核步驟,以符合你的供應商組合。
在 KissMySkills 的 Claude 技能合集中瀏覽所有財務與會計技能。