發票 OCR + AI:實際上有多準確?

「99% 準確」是每家發票 OCR 供應商都會放在首頁上的數字,而且它幾乎總是只對一件事成立:讀取一張來自系統過去見過的供應商、格式整潔且以打字輸入的發票。對於真正會在後續流程中造成問題的欄位,準確度會明顯下降,包括貨幣符號、VAT 與稅金明細,以及非標準格式的日期;如果沒有人檢查,錯誤擷取正是在這些地方會造成實際金錢損失。

Warren - QuickBooks AP Automation AI Skill
擷取搭配比對,而不只是單獨擷取
Warren - QuickBooks AP Automation AI Skill
讀取發票,將擷取的欄位與 QuickBooks 採購訂單交叉比對,並標記任何無法對帳的內容,而不是盲目地將其過帳。
$79
取得 Skill →

按欄位而非按發票計算的準確度

供應商所宣稱的準確度幾乎總是以每張發票而非每個欄位計算,這掩蓋了真正錯誤集中的地方。現代 AI 型 OCR 工具(不是較舊的範本比對類型)在某些欄位上的表現很好,但在其他欄位上則明顯較差:

欄位 典型準確度 原因
發票號碼 非常高 幾乎總是有清楚標示,且位於一致的位置
總金額 通常是頁面上最大且最醒目的數字
貨幣 中等 符號歧義($ 可用於 USD、CAD、AUD 等貨幣)會導致不易察覺的誤讀
稅金/VAT 明細項目 中等至較低 版面配置會因國家及供應商的開票軟體而有極大差異
日期 中等 DD/MM 與 MM/DD 的歧義是經典且難以察覺的錯誤
明細項目 較低 多行、多欄的表格是任何 OCR 系統最難處理的版面配置

錯誤真正造成損害的地方

漏掉發票號碼令人惱火,但很明顯,通常會有人立即注意到。誤讀貨幣符號或弄錯日期格式則很危險,正因為這些錯誤不明顯:數字看起來合理,獲得核准,而錯誤可能要到數週後對帳時才浮現,甚至永遠不會被發現。請針對這些特定的高風險欄位建立審核步驟,而不是使用沒有人真正遵循的泛泛「檢查所有內容」指示。

在信任工具之前,如何真正測試它

  1. 先把最糟糕的發票交給它處理。 手寫的、以傾斜角度掃描的、採用外國供應商格式的,而不是供應商示範中的那張乾淨範例發票。
  2. 特別檢查對你最重要的欄位。 如果你處理多種貨幣,請對貨幣辨識進行壓力測試。如果你與國際供應商合作,請對日期解析進行壓力測試。
  3. 衡量欄位層級的準確度,而非發票層級的準確度。一張十個欄位中有一個欄位錯誤的發票,仍算是需要被發現的錯誤,即使整體擷取結果「看起來正確」也是如此。
  4. 設定強制審核門檻。任何金額高於你所選金額的發票,在進入下一步前,都必須由人工查看擷取出的欄位,無論工具的信心分數為何。

延伸閱讀:應付帳款自動化,從發票到付款。另請參閱 最佳 AI 發票產生器

常見問題

AI 式 OCR 是否比舊式規則式 OCR 更準確?

通常是,尤其是系統此前沒有看過範本的供應商所開立的發票。規則式 OCR 需要相符的範本;AI 式擷取對新版面格式的泛化能力更好。

實際上我應該期待什麼樣的發票準確率?

對於來自已知供應商、版面乾淨且以打字方式製作的發票,準確度可達九成後段。對於手寫、掃描品質不佳或格式不熟悉的發票,準確度會明顯降低。請將任何單一的已公布準確度數字視為最佳情況,而不是典型情況。

OCR 錯誤會通過三方比對嗎?

如果錯誤出現在比對不會檢查的欄位,就會,例如誤讀稅額行或日期,因為三方比對主要是根據採購訂單和收貨單檢查數量與總金額。

小型供應商使用手寫發票,是否會成為決定性問題?

這不算是決定性問題,但請特別為這些發票預留額外的審核時間。大多數工具都會標記低信心度的擷取結果,因此預設應將這些結果交由人工處理,而不是相信低信心度的讀取結果。

我如何知道工具宣稱的準確度是否可信?

請確認這個數字是按欄位還是按發票計算,以及測試是在供應商自行整理的樣本集上進行,還是在混合的真實批次上進行。如果對方無法清楚回答,請先用你的實際發票自行測試,再做決定。

重點

發票 OCR 的準確度確實存在,但表現並不均衡:明顯欄位的準確度很高,但貨幣、稅額行和日期的準確度明顯較低,而這正是無聲錯誤會造成最大損害的地方。請在工具實際可能遇到的最差情況發票上進行測試,而不是使用示範樣本,並針對最可能出錯的欄位建立審核步驟,以符合你的供應商組合。

在 KissMySkills 的 Claude 技能合集中瀏覽所有財務與會計技能。

~/get-started

實用的 Skills。不說空話。

瀏覽商店中的每個技能、prompt 套件和 agent。

瀏覽所有技能 →或試試免費工具