對於大多數個人的互動式工作,Claude 訂閱與 API 的選擇並無懸念:通常是訂閱制勝出。但對於自動化管線、多使用者產品或高強度的日常編碼工作量,一旦 Token 使用量超過可計算的門檻,API 通常會更划算。我們於 2026 年 9 月 19 日更新了此分析,因為 Sonnet 5 的推廣定價已於 2026 年 8 月 31 日結束。Anthropic 自 2026 年 9 月 1 日起的標準 Sonnet 5 費率為:輸入 $3/MTok、輸出 $15/MTok,以及快取命中 (cache hits) $0.30/MTok。原始來源快照使用的是 $2/$10/$0.20 的推廣費率,顯示中等工作流程每月約 $9-12,而繁重工作流程則約為 $102(未快取)或 $70-100+/月。我們在下方展示了兩個時間點的數據、標準費率計算方式以及損益平衡公式。我們也標註了目前無法從公開證據中驗證的項目:確切的訂閱價格以及 Pro 版費率限制的 Token 配額。
重點摘要
- Claude Sonnet 5 自 2026 年 9 月 1 日起的標準 API 定價:輸入 $3/MTok、輸出 $15/MTok、快取命中 $0.30/MTok。截至 2026 年 8 月 31 日的原始推廣費率為 $2/$10/$0.20。來源:Anthropic 定價文件,觀察日期 2026-07-09;更新日期 2026-09-19。
- 在標準 Sonnet 5 定價下,快取命中成本為 $0.30/MTok,相較於新鮮輸入的 $3/MTok,這意味著輸入 Token 部分降低了 90% 的成本。輸出 Token 無法快取,因此總帳單節省幅度較小。我們的範例顯示節省幅度約為 23-28%。
- 批次處理 (Batch) 定價在 2026 年 8 月 31 日前將 Sonnet 5 降至 輸入 $1/MTok、輸出 $5/MTok。此費率僅適用於非同步、非互動式作業,不適用於即時編碼工作階段。由於該期限已過,請在依賴此費率前確認目前的批次費率。
- 中等程度的日常編碼工作流程,若使用 API 且無快取,標準 Sonnet 5 費率下每月成本約為 $18.48。若假設有 60% 的快取命中率,成本則降至約 $14.20/月。原始推廣費率快照約為 $9-12/月。
- 繁重的工作流程在標準費率下未快取時每月約 $153.45,若有 60% 快取命中率則約為 $110.68。原始來源快照顯示未快取時約 $102,視假設條件而定,每月約 $70-100+。
- Anthropic 在此證據集中並未公佈 Pro 方案費率限制視窗的固定 Token 或訊息數量。請查看 Claude.ai 或 Claude Code 中的即時使用量指標,以獲取您當前的實際配額。來源證據亦未包含 Pro/Max 的月費。在使用損益平衡表前,請先在您的 Anthropic 方案頁面確認價格。
Claude 訂閱與 API:費率比較
本分析的來源證據來自兩個地方:Anthropic 官方定價文件與 TokenLab 的即時目錄。兩者皆有觀察日期。
| 來源 | 涵蓋範圍 | 觀察日期 |
|---|---|---|
| Claude 平台定價文件 | 官方 Claude Sonnet 5、Opus 4.8、Fable 5 的 Token 與批次費率 | 2026-07-09 |
| TokenLab 即時模型/定價證據 | TokenLab 目錄中 Claude 模型與替代供應商的費率 | 2026-07-07 |
官方 Claude API 定價 (Anthropic)
| 模型 | 輸入 $/MTok | 輸出 $/MTok | 快取命中 $/MTok | Context | 來源 | 觀察日期 |
|---|---|---|---|---|---|---|
| Claude Sonnet 5 (推廣,至 2026-08-31) | $2.00 | $10.00 | $0.20 | 1M | Anthropic 定價文件 | 2026-07-09 |
| Claude Sonnet 5 (標準,自 2026-09-01) | $3.00 | $15.00 | $0.30 | 1M | Anthropic 定價文件 | 2026-07-09 |
| Claude Sonnet 5 (批次,至 2026-08-31,僅限非同步) | $1.00 | $5.00 | n/a | 1M | Anthropic 定價文件 | 2026-07-09 |
| Claude Opus 4.8 | $5.00 | $25.00 | $0.50 | 1M | Anthropic 定價文件 | 2026-07-09 |
| Claude Fable 5 | $10.00 | $50.00 | $1.00 | 1M | Anthropic 定價文件 | 2026-07-09 |
以上僅為 API 的 Token 費率。Anthropic 的 Pro/Max 訂閱月費不包含在此證據集中。在進行下方的損益平衡計算前,請先查看您帳戶的方案頁面。
TokenLab 透過單一 API 金鑰在 Claude Sonnet 5 與更低成本的替代方案之間路由請求。這讓您可以在投入直接的 Anthropic API 整合或 Max 訂閱席位之前,測試較便宜的模型是否符合您的品質標準。TokenLab 的即時目錄列出了目前的模型定價,詳見 TokenLab 模型頁面。
TokenLab 目錄定價:Claude 與低成本替代方案
此處僅列出 TokenLab 即時定價證據中存在的模型。
| 模型 | 供應商 | 輸入 $/MTok | 輸出 $/MTok | Context | 來源 | 觀察日期 |
|---|---|---|---|---|---|---|
| Claude Sonnet 5 | anthropic | $2.00 | $10.00 | 1,000,000 | TokenLab 即時定價證據 | 2026-07-07 |
| Claude Opus 4.8 | anthropic | $5.00 | $25.00 | 1,000,000 | TokenLab 即時定價證據 | 2026-07-07 |
| Claude Fable 5 | anthropic | $10.00 | $50.00 | 1,000,000 | TokenLab 即時定價證據 | 2026-07-07 |
| GPT-5.5 | openai | $5.00 | $30.00 | 1,050,000 | TokenLab 即時定價證據 | 2026-07-07 |
| GPT-5.5 Batch/Flex | openai | $2.50 | $15.00 | 1,050,000 | TokenLab 即時定價證據 | 2026-07-07 |
| Gemini 3.5 Flash | $1.50 | $9.00 | 1,048,576 | TokenLab 即時定價證據 | 2026-07-07 | |
| GLM-5.2 | z-ai | $0.93 | $3.00 | 1,048,576 | TokenLab 即時定價證據 | 2026-07-07 |
| Kimi K2.7 Code | moonshotai | $0.74 | $3.50 | 262,144 | TokenLab 即時定價證據 | 2026-07-07 |
| Qwen3.7 Plus | qwen | $0.32 | $1.28 | 1,000,000 | TokenLab 即時定價證據 | 2026-07-07 |
| MiniMax M3 | minimax | $0.30 | $1.20 | 1,048,576 | TokenLab 即時定價證據 | 2026-07-07 |
| DeepSeek V4 Pro | deepseek | $0.435 | $0.87 | 1,048,576 | TokenLab 即時定價證據 | 2026-07-07 |
| DeepSeek V4 Flash | deepseek | $0.09 | $0.18 | 1,048,576 | TokenLab 即時定價證據 | 2026-07-07 |
以目前的 TokenLab 目錄費率來看,Claude Sonnet 5 的單位 Token 成本比 DeepSeek V4 Pro、GLM-5.2 或 Qwen3.7 Plus 高出 2-6 倍。如果您的工作負載不需要 Claude 的特定功能,先針對您的品質標準測試較低成本的模型,可能會改變整個「訂閱 vs API」的決策。TokenLab 的低成本模型排名位於 TokenLab 排名頁面。
工作範例:API 日常編碼工作流程成本
以下情境使用假設的請求量與 Token 大小。這些僅為假設,而非實際測量值。我們將其與 Anthropic 的 Claude Sonnet 5 標準費率及推廣費率進行對比。請根據您的實際日誌調整輸入數值。
標準費率重新計算(自 2026 年 9 月 1 日起): 使用 Sonnet 5 標準費率 $3/$15/$0.30。
輕量工作流程假設: 每天 40 次請求,平均 3,000 個輸入 Token,平均 800 個輸出 Token,每月 22 個工作天。
| 指標 | 數值 |
|---|---|
| 每月輸入 Token | 2.64M |
| 每月輸出 Token | 0.704M |
| 成本(無快取) | $7.92 (輸入) + $10.56 (輸出) = $18.48 |
| 成本(假設 60% 輸入快取命中) | $0.48 (快取) + $3.17 (新鮮) + $10.56 (輸出) = $14.20 |
| 快取節省金額 | $4.28/月,此情境節省 23.1% |
繁重工作流程假設: 每天 150 次請求,平均 8,000 個輸入 Token,平均 1,500 個輸出 Token,每月 22 個工作天。
| 指標 | 數值 |
|---|---|
| 每月輸入 Token | 26.4M |
| 每月輸出 Token | 4.95M |
| 成本(無快取) | $79.20 (輸入) + $74.25 (輸出) = $153.45 |
| 成本(假設 60% 輸入快取命中) | $4.75 (快取) + $31.68 (新鮮) + $74.25 (輸出) = $110.68 |
| 快取節省金額 | $42.77/月,此情境節省 27.9% |
原始推廣費率快照: 這些是原始文章截至 2026 年 8 月 31 日的工作範例。
輕量工作流程假設: 每天 40 次請求,平均 3,000 個輸入 Token,平均 800 個輸出 Token,每月 22 個工作天。
| 指標 | 數值 |
|---|---|
| 每月輸入 Token | 2.64M |
| 每月輸出 Token | 0.704M |
| 成本(無快取) | $5.28 (輸入) + $7.04 (輸出) = $12.32 |
| 成本(假設 60% 輸入快取命中) | $0.32 (快取) + $2.11 (新鮮) + $7.04 (輸出) = $9.47 |
| 快取節省金額 | $2.85/月,此情境節省 23.1% |
繁重工作流程假設: 每天 150 次請求,平均 8,000 個輸入 Token,平均 1,500 個輸出 Token,每月 22 個工作天。
| 指標 | 數值 |
|---|---|
| 每月輸入 Token | 26.4M |
| 每月輸出 Token | 4.95M |
| 成本(無快取) | $52.80 (輸入) + $49.50 (輸出) = $102.30 |
| 成本(假設 60% 輸入快取命中) | $3.17 (快取) + $21.12 (新鮮) + $49.50 (輸出) = $73.79 |
| 快取節省金額 | $28.51/月,此情境節省 27.9% |
例如,輕量工作流程假設每天 40 次請求,平均 3,000 個輸入 Token,平均 800 個輸出 Token,以及每月 22 個工作天。我們看到輸出 Token 在此模型中永遠不會被快取,因此快取節省金額總是低於 90% 的純輸入折扣率。60% 的快取命中率假設僅供參考,而非測量值。您實際的快取命中率取決於每個請求中有多少比例是重複使用靜態系統提示詞、檔案內容或工具架構,而非新鮮內容。
損益平衡計算:API Token 與訂閱價格
要找出 API 成本等於訂閱價格的確切 Token 使用量,您需要兩個數字。首先,您的每月訂閱價格位於 Anthropic 帳戶的方案頁面上(此證據集未包含)。其次,您需要根據輸入/輸出比例計算出的混合 $/MTok 費率。
混合費率 = (輸入佔比 x $3) + (輸出佔比 x $15),使用 2026 年 9 月 1 日起的 Sonnet 5 標準定價。
來源證據未包含 Anthropic 的 Pro/Max 月費。例如,如果您的方案頁面顯示 $20/月,請將「每 $1 訂閱價格的損益平衡 Token 數」乘以 20。在使用前,請務必確認方案頁面上的當前價格。
標準費率損益平衡表(自 2026 年 9 月 1 日起):
| 輸入:輸出比例 | 混合 $/MTok | 每 $1 訂閱價格的損益平衡 Token 數 |
|---|---|---|
| 90:10 (Context 密集,簡短回答) | $4.20 | 238,095 |
| 70:30 (典型編碼助手) | $6.60 | 151,515 |
| 50:50 (平衡對話) | $9.00 | 111,111 |
| 30:70 (長篇生成) | $11.40 | 87,719 |
原始推廣費率損益平衡表:
| 輸入:輸出比例 | 混合 $/MTok | 每 $1 訂閱價格的損益平衡 Token 數 |
|---|---|---|
| 90:10 (Context 密集,簡短回答) | $2.80 | 357,143 |
| 70:30 (典型編碼助手) | $4.40 | 227,273 |
| 50:50 (平衡對話) | $6.00 | 166,667 |
| 30:70 (長篇生成) | $7.60 | 131,579 |
我們使用 Anthropic 公佈的 Sonnet 5 推廣費率進行了損益平衡計算。在 70:30 的比例下,每 $10 的訂閱價格約等於 2.27M 個混合 Token 的 Sonnet 5 API 使用量(推廣費率)。在標準費率下,同樣的 $10 約等於 1.52M 個混合 Token。如果您的實際每月 Token 使用量超過該數字,則 API 成本會高於訂閱費用。若低於該數字,則訂閱制通常較划算,前提是您保持在費率限制範圍內。
本證據集的限制
- 訂閱價格未驗證。 本文使用的定價證據中未包含 Anthropic 的 Pro/Max 每月訂閱價格。在執行上述損益平衡公式前,請先查看您的帳戶方案頁面。
- 費率限制配額未公佈為固定數字。 Anthropic 透過滾動視窗(通常描述為約五小時)來執行使用量限制。確切的 Token 或訊息數量會因模型、帳戶層級與對話長度而異。此證據集中沒有單一的驗證數字。請查看 Claude.ai 或 Claude Code 中的即時使用量指標以獲取當前配額。
- 工作範例中的快取命中率為假設值 (60%),而非實際生產環境的測量率。 實際比例完全取決於每個請求中有多少比例是靜態、重複使用的 Context。
- 批次定價範例僅供參考。 它不適用於互動式編碼工作階段,因為批次作業設計上是非同步的。
- 標準費率重新計算為我們基於 Anthropic 自 2026 年 9 月 1 日起公佈的標準費率所做。 原始來源快照仍維持在 2026-07-09 的推廣費率。
在我們的管線中,我們將 60% 的快取命中率假設視為規劃輸入,而非測量費率。
Claude 訂閱 vs API:何時選擇哪一方
何時選擇訂閱制
- 在 Claude.ai 或 Claude Code 內進行個人使用,無需從您自己的後端呼叫模型。
- 使用量穩定維持在方案的費率限制視窗內,不會頻繁超額。
- 無需程式化存取。如果您沒有編寫呼叫 API 的程式碼,訂閱制在預算編列上較為簡單。
- 團隊成員各自在 Claude 介面內獨立工作,且按席位定價比計算共享 API 金鑰的總 Token 消耗量更容易規劃。
何時選擇 API
- 自動化管線:批次摘要、文件處理或在沒有人工介入下執行的 Agent 工作流程。這些沒有對應的訂閱層級。
- 多使用者產品:任何終端使用者觸發模型呼叫的 SaaS 工具,都需要按 Token 計費,這只有 API 才能實現。
- 使用量超過您計算的損益平衡點,此時按 Token 計費的成本低於固定訂閱費。
- 重複的大型 Context 區塊,標準費率下 $0.30/MTok 的快取命中率可大幅削減輸入 Token 部分的帳單。原始推廣費率為 $0.20/MTok。
- 符合批次定價資格的非即時作業(至 2026 年 8 月 31 日為 $1/$5 每 MTok)。由於該期限已過,請務必確認目前的批次費率。
實用檢查清單與多模型考量
- 您需要從自己的後端呼叫模型,還是僅透過 Claude 介面使用?
- 您是否已記錄實際的每月輸入與輸出 Token 數量,還是仍在估算?
- 您是否已使用實際的訂閱價格執行上述損益平衡公式?
- 您的工作負載是否重複使用大型靜態 Context 區塊,從而受惠於 $0.30/MTok 的標準快取命中費率?
- 您是否有任何工作負載可以非同步執行並符合批次定價資格?
- 您是否已針對此特定任務比較過 Claude Sonnet 5 與低成本目錄模型?TokenLab 的定價比較位於 TokenLab 定價比較頁面。
- 您是否已檢查 DeepSeek V4 Pro、GLM-5.2 或 Qwen3.7 Plus 是否能在極低成本下達到您的品質標準?TokenLab 的低成本模型清單位於 TokenLab 低成本模型清單。
Claude 訂閱僅涵蓋 Claude.ai 和 Claude Code 內 Claude 本身的文字與編碼能力。如果您的工作流程跨足程式碼生成、影像生成或影片生成,這些都不包含在訂閱價格內。
- 針對編碼工作負載,請將 Claude Sonnet 5 與 DeepSeek V4 Pro、GLM-5.2、Kimi K2.7 Code 或 Gemini 3.5 Flash 進行基準測試,而非假設必須使用 Claude。TokenLab 的編碼比較位於 TokenLab 最佳 AI 編碼模型比較。
- 影像生成是完全獨立的 API 與定價,不包含在任何 Claude 方案中。TokenLab 的影像模型比較位於 最佳 AI 影像模型 API 存取。
- 影片生成有其獨立的成本結構,與 Claude 訂閱及 Claude API 定價皆不同。TokenLab 的影片模型比較位於 最佳 AI 影片模型 API 存取。
- 如果您為了優化每個任務的成本而在多個供應商之間進行路由,聚合器 (Aggregator) 方法可以簡化計費。TokenLab 的 OpenRouter 比較位於 TokenLab OpenRouter 比較。
TokenLab 的排名比較了各供應商的模型成本,詳見 TokenLab 排名頁面。
常見問題
Claude Pro 訂閱包含多少 Token?
Anthropic 在本文使用的證據中並未公佈 Pro 費率限制視窗的固定通用 Token 或訊息數量。配額會根據所選模型、帳戶層級與對話長度而異。請查看 Claude.ai 或 Claude Code 內的即時使用量指標,以獲取您當前的實際配額,而非依賴固定數字。
我可以使用 Claude Pro/Max 訂閱來存取 API 嗎?
不行。訂閱僅涵蓋 Claude.ai 和 Claude Code 內的使用。API 存取是按 Token 分開計費,且需要獨立的 API 金鑰與計費設定。
訂閱方案可以使用 Prompt Caching 嗎?
不行。快取是 API 特有的計費機制。在標準 Sonnet 5 定價下,快取命中成本為 $0.30/MTok,而新鮮輸入 Token 為 $3/MTok,這對快取的輸入部分有 90% 的折扣。原始推廣費率為 $0.20/MTok 對比 $2/MTok。由於訂閱制並非按 Token 計費,因此沒有對應的折扣。固定費用已涵蓋費率限制內的使用量。
API 成本等於訂閱成本的確切 Token 使用量是多少?
請使用上方的標準費率損益平衡表。將您輸入:輸出比例對應的「每 $1 損益平衡 Token 數」乘以您的實際每月訂閱價格。您的帳戶方案頁面有該價格(此證據集未包含)。這將得出您個人的損益平衡 Token 使用量。
批次定價對日常編碼助手有幫助嗎?
沒有。截至 2026 年 8 月 31 日的 $1/MTok 輸入與 $5/MTok 輸出批次定價僅適用於非同步、非互動式作業。即時編碼工作階段與對話使用標準或推廣的按 Token 費率。由於該期限已過,請務必確認目前的批次費率。
如果您的 Claude API 計算成本高於預期,請在承諾長期架構前比較不同層級與替代供應商。請從 TokenLab 排名開始。
來源
價格觀測於 2026-07-07
- Claude Platform pricing觀測於 2026-07-09
- Anthropic pricing觀測於 2026-07-07
- TokenLab cheap models page觀測於 2026-07-07



