Tools mentioned in this article
Open the browser-based tool while you read and try the workflow immediately.
「這段提示詞如果換成 GPT-5.5,每個月會多花多少錢?」「換成便宜一點的模型能省多少?」——在使用 LLM 開發時,選擇模型時會需要在相同條件下比較費用作為判斷依據。LLM API 費用計算機 只要貼上提示詞、輸入預估的輸出 token 數,就能一次比較 Claude、GPT、Gemini 主要模型每次請求的費用——完全在瀏覽器內完成。

LLM API 計費的基本結構
主要供應商的 API 計費幾乎都遵循以下共通結構:
- 輸入(提示詞)與輸出(生成文字)的單價不同——輸出單價通常是輸入的 3~5 倍
- 計費單位是每百萬 token 的美元金額($/1M tokens)
- 依模型等級不同,單價可能相差好幾個數量級(旗艦與輕量模型之間可差到 10~100 倍)
換句話說,估算費用需要針對每個模型計算「輸入 token 數 × 輸入單價 + 輸出 token 數 × 輸出單價」。每次都要查價目表再拿計算機按,實在麻煩,因此這個工具幫您一次算好。
使用方法
- 開啟 LLM API 費用計算機,把提示詞(系統提示詞+預估的使用者輸入)貼進文字區。
- 輸入預估輸出 token 數(聊天回覆約 300~800、摘要約 200~500 可作為參考)。
- 各模型的費用表會依總金額由低到高排序顯示,也能看到輸入/輸出費用的細項,以及各模型的輸入/輸出單價($/1M)。
輸入 token 數會從提示詞自動計算。GPT 系列使用精確的 tokenizer(o200k_base/cl100k_base)計數,Claude、Gemini 則是根據字元組成的估算值(與 token 計數器 共用同一套估算邏輯)。
價格資料自動更新
模型的價格調整相當頻繁。這個工具的價目表採用在網站建置時自動從公開價目表取得、內嵌為靜態資料的方式。
- 執行時(瀏覽頁面時)不會有任何對外連線——計算完全在瀏覽器內完成
- 貼上的提示詞也不會傳送到伺服器
- 各項單價的取得時間可以在工具上確認
估算的侷限:不包含的部分
這個工具顯示的數字只是「每次請求的概略值」。實際帳單還會受到以下因素影響:
- 提示詞快取折扣——重複使用相同前綴可大幅降低輸入單價的機制,未納入計算
- 批次 API 折扣——非同步批次處理的折扣(許多供應商提供 50%)也未納入
- 聊天 API 的額外開銷——訊息結構或工具定義所消耗的額外 token 未計入輸入
- Claude/Gemini 的 token 數為估算值——可能有 ±10~20% 左右的誤差
如果需要月度預算規劃等精確數字,請查閱各供應商的官方價目頁面與帳務儀表板。若只是要做模型間的相對比較或掌握數量級,這個工具的估算已經足夠。
常見問題
顯示的費用有多準確?
GPT 系列採用精確的 tokenizer 計數,只要價目表是最新的,準確度就很高。Claude、Gemini 的 token 數是根據字元類型估算的,請預留 ±10~20% 左右的誤差。若用於模型間的相對比較或概略預算,精確度已經足夠。
價格資料是什麼時候的?
是網站建置時從公開價目表自動取得的數值,取得時間會顯示在工具上。供應商剛調整價格時可能會有反映上的時間差,簽約決策前請務必再確認官方價目頁面。
有考慮提示詞快取或批次折扣嗎?
沒有。顯示的是未套用任何折扣的標準單價估算。如果您有使用提示詞快取或批次 API,實際費用可能會比顯示金額低很多。
貼上的提示詞會被傳送出去嗎?
不會。無論是 token 計算還是費用計算,都完全在瀏覽器內完成,即使是不能外流的提示詞也能安心用來估算。