「撰寫我的個人簡介」 prompt → 「cold email」 名稱: serge </> Skill.md { 執行() }
MK
行銷與成長
行銷活動、SEO、廣告
LG
法律與財務
合約、CFO、稅務
Skill .md
適用於任何 AI
SK
AI Agents
端到端任務
AG
你的輸入

你每月浪費的 token 將顯示在這裡。
填寫你的使用量,然後點擊「計算」。

想停止浪費,而不只是測量浪費嗎?
讓你的 AI 成為解決這個問題的 prompt engineer。
Prompt Engineer Skill Noor 能將 Claude、ChatGPT 或任何 AI 聊天工具變成資深 prompt engineer - 內建生產級 prompt 設計、評估測試工具,以及 token/成本/延遲最佳化功能。無需任何 prompting 專業知識。
查看 Prompt Engineer Skill →

什麼是 AI token 成本計算器?

AI token 成本計算器會根據你實際的使用方式,估算你在 ChatGPT、Claude 或任何 AI 聊天工具上使用多少 token - 以及花費多少錢。這款免費的 AI token 成本計算器聚焦於一個特定且非常常見的浪費來源:每則訊息都重新將相同的角色、格式或品牌語氣指示貼入聊天中,而不是只載入一次。

輸入你每天開始的對話數量、每個對話包含多少則後續訊息,以及你重複提供的上下文大約有多長。計算器會估算你每月浪費的 token 數量、按照一般付費 API 定價計算的成本,以及當相同上下文儲存在持久性的 Skill 檔案或專案指示中,而不是放在剪貼簿裡時,能消除多少浪費。切換至團隊模式,即可查看將相同計算套用到整個團隊 AI 使用量的結果 - 通常數字會更大。

測量浪費是第一步。KissMySkills 上的 Prompt Engineer Skill Noor,能將 Claude、ChatGPT 或任何 AI 聊天工具變成資深 prompt engineer,設計可重複使用、可直接投入生產環境的 prompts 和 Skill 檔案,徹底杜絕這種浪費 - 無需任何 prompt engineering 背景。

為什麼 token 不是單字

每家供應商對英文都公布大致相同的估算:一個 token 約等於四個字元,或約四分之三個單字。Google 的說法是,100 個 token 約等於 60 到 80 個英文單字。Anthropic 給出的數字稍微精確一些,約為每個 token 3.5 個字元,並補充了一項重要注意事項 - 確切數量會因語言和內容類型而異。

這項注意事項的重要性超乎表面。即使是同一家供應商的不同模型,token 數量也不一定穩定:Anthropic 指出,其較新的 tokenizer 對相同文字產生的 token 約比舊版多 30%。相同的輸入、相同的供應商,帳單卻可能有實質差異。

因此,任何 token 估算 - 包括這一項 - 都應視為數量級估計。如果你需要實際數字,就不要估算,而是直接計算:每個主要供應商都提供 tokenizer,或在 API 回應中提供用量欄位,準確回報向你收取的費用。

輸出的費用是輸入的數倍

關於 token 定價,最重要的一點是:輸入和輸出的定價並不相同。輸入是你傳送的內容;輸出是模型生成的內容;輸出的費用始終比較高。

截至 2026 年 8 月,Anthropic 公布的每百萬 token 費率在整個產品線上都維持整齊的 5 倍比例 - Opus 5 的輸入費率為 5 美元、輸出費率為 25 美元,Haiku 4.5 則是 1 美元對 5 美元。OpenAI 目前的旗艦模型為 5 美元對 30 美元,比例是 6 倍,最便宜的層級則為 0.20 美元對 1.20 美元。Google 的 Gemini 系列約介於 4 倍到 8 倍之間。

等你讀到這段時,確切數字可能已經變了 - 請查看供應商的定價頁面。比例才是持久不變的重點:在這三家供應商中,輸出的費率約為輸入的四到八倍。這會帶來一個實際影響。精簡冗長的系統 prompt,只能節省輸入 token,而輸入 token 比較便宜。要求較短的回答,才能節省輸出 token,而輸出 token 並不便宜。如果確實有成本問題,先看看模型寫出了多少內容,再去看你傳送了多少內容。

為什麼第十輪比第一輪更貴

聊天 API 是無狀態的。OpenAI 說得很明白:每個文字生成請求都是獨立的,而你要建立多輪對話,就必須將先前的訊息作為參數再次傳送。Anthropic 描述的是相同的計費方式 - 每一輪的輸入都包含先前的完整對話記錄以及目前的訊息,而請求中的所有內容都會計入,包括系統 prompt 和你的工具定義。

因此,一段對話的成本並不是所有訊息成本的總和。第十輪會把第一到第九輪重新當作新的輸入計費。如果每一輪增加的文字量大致固定,整段對話的累計輸入計費量會隨輪數的平方增長,而不是線性增長。這個算式是我們推導的,不是供應商的說法,但它直接遵循兩家公司所記錄的重新傳送模型 - 這也是為什麼長對話會以令人意外的方式變得昂貴。

有兩項已記錄的機制可以抵消這種情況。提示快取會對寫入快取項目收取溢價,對讀取則提供大幅折扣:Anthropic 對五分鐘快取寫入收取基本輸入價格的 1.25 倍,快取讀取則為 0.1 倍,因此只要命中一次就能回本。OpenAI 同樣對寫入收取 1.25 倍的溢價,並對快取輸入提供 90% 的折扣,但要求前綴至少包含 1,024 個 token。此外,三家供應商都為非同步批次處理提供 50% 的折扣,而 Anthropic 表示快取折扣和批次折扣可以疊加。

這個計算器做不到的事

它不會估算你的完整帳單。它只模擬一種失敗模式 - 重複的上下文 - 而不是你的總支出。你的實際帳單主要取決於模型回寫的內容量,而這項工具看不到這一點。

美元金額可能不是你實際支付的費用。這點最重要,也很容易被忽略。ChatGPT Plus 和 Claude Pro 是固定費率訂閱,不是按 token 計費。如果你是在聊天訂閱中工作,而不是使用 API,這裡顯示的費用是浪費所對應的 API 等值金額,不是帳單上的實際收費。無論如何,浪費的 token 都是真實存在的 - 它們會消耗上下文視窗,也會讓你的速度變慢並減少實際工作的空間 - 但只有 API 使用者會在帳單上看到這筆費用。

它不知道你的折扣。快取、批次處理和議定費率都可能讓 API 帳單相差一個數量級,而這些因素都不在此模型中。

價格會變動。這頁上的每個數字都標有查核日期,是有原因的。供應商會調整費率、推出新的模型層級,偶爾也會更換底層的 tokenizer。若要據此做出預算決策,請先確認。