「這段提示詞如果換成 GPT-5.5,每個月會多花多少錢?」「換成便宜一點的模型能省多少?」——在使用 LLM 開發時,選擇模型時會需要在相同條件下比較費用作為判斷依據。LLM API 費用計算機 只要貼上提示詞、輸入預估的輸出 token 數,就能一次比較 Claude、GPT、Gemini 主要模型每次請求的費用——完全在瀏覽器內完成。

LLM API 費用計算機 ― 依費用由低到高列出各模型成本

LLM API 計費的基本結構

主要供應商的 API 計費幾乎都遵循以下共通結構:

  • 輸入(提示詞)與輸出(生成文字)的單價不同——輸出單價通常是輸入的 3~5 倍
  • 計費單位是每百萬 token 的美元金額($/1M tokens)
  • 依模型等級不同,單價可能相差好幾個數量級(旗艦與輕量模型之間可差到 10~100 倍)

換句話說,估算費用需要針對每個模型計算「輸入 token 數 × 輸入單價 + 輸出 token 數 × 輸出單價」。每次都要查價目表再拿計算機按,實在麻煩,因此這個工具幫您一次算好。

使用方法

  1. 開啟 LLM API 費用計算機,把提示詞(系統提示詞+預估的使用者輸入)貼進文字區。
  2. 輸入預估輸出 token 數(聊天回覆約 300~800、摘要約 200~500 可作為參考)。
  3. 各模型的費用表會依總金額由低到高排序顯示,也能看到輸入/輸出費用的細項,以及各模型的輸入/輸出單價($/1M)。

輸入 token 數會從提示詞自動計算。GPT 系列使用精確的 tokenizer(o200k_base/cl100k_base)計數,Claude、Gemini 則是根據字元組成的估算值(與 token 計數器 共用同一套估算邏輯)。

價格資料自動更新

模型的價格調整相當頻繁。這個工具的價目表採用在網站建置時自動從公開價目表取得、內嵌為靜態資料的方式。

  • 執行時(瀏覽頁面時)不會有任何對外連線——計算完全在瀏覽器內完成
  • 貼上的提示詞也不會傳送到伺服器
  • 各項單價的取得時間可以在工具上確認

估算的侷限:不包含的部分

這個工具顯示的數字只是「每次請求的概略值」。實際帳單還會受到以下因素影響:

  • 提示詞快取折扣——重複使用相同前綴可大幅降低輸入單價的機制,未納入計算
  • 批次 API 折扣——非同步批次處理的折扣(許多供應商提供 50%)也未納入
  • 聊天 API 的額外開銷——訊息結構或工具定義所消耗的額外 token 未計入輸入
  • Claude/Gemini 的 token 數為估算值——可能有 ±10~20% 左右的誤差

如果需要月度預算規劃等精確數字,請查閱各供應商的官方價目頁面與帳務儀表板。若只是要做模型間的相對比較或掌握數量級,這個工具的估算已經足夠。

常見問題

顯示的費用有多準確?

GPT 系列採用精確的 tokenizer 計數,只要價目表是最新的,準確度就很高。Claude、Gemini 的 token 數是根據字元類型估算的,請預留 ±10~20% 左右的誤差。若用於模型間的相對比較或概略預算,精確度已經足夠。

價格資料是什麼時候的?

是網站建置時從公開價目表自動取得的數值,取得時間會顯示在工具上。供應商剛調整價格時可能會有反映上的時間差,簽約決策前請務必再確認官方價目頁面。

有考慮提示詞快取或批次折扣嗎?

沒有。顯示的是未套用任何折扣的標準單價估算。如果您有使用提示詞快取或批次 API,實際費用可能會比顯示金額低很多。

貼上的提示詞會被傳送出去嗎?

不會。無論是 token 計算還是費用計算,都完全在瀏覽器內完成,即使是不能外流的提示詞也能安心用來估算。