Tabbit部落格

Claude Opus 5.5 定價:$4/$20 費率卡與真實帳單

Claude Opus 5.5 定價詳解:$4/$20 費率全表、快取讀降價 60%、$0.55–$5.98 的 effort 成本階梯、訂閱規則、實際算例與本機計算機。

本文目錄
  1. Key takeaways
  2. Claude Opus 5.5 費率速覽
  3. 變化最大的數字:快取讀降價 60%
  4. 「便宜 40%」到底指什麼
  5. effort 槓桿:每任務 $0.55 到 $5.98
  6. 頭條之外的計費線
  7. 家族階梯:Opus 5.5 vs Fable 5.1 vs Opus 5 vs Sonnet 5
  8. 不收錢的部分
  9. 方案可得性:API、雲與消費訂閱
  10. 兩個算例,所有假設攤開
  11. 一個實踐選項:在 Tabbit 裡跑比較
  12. Claude Opus 5.5 定價決策表
  13. 最終裁決
  14. Sources

Claude Opus 5.5 在 Anthropic API 上的價格是每百萬輸入 token $4、每百萬輸出 token $20,快取讀取每百萬 $0.20——所有費率均於 2026 年 9 月 23 日(發布次日)在 Anthropic 官方定價文件核對。這一次費率卡本身就是新聞:五個計費行相對 Opus 5 全部下調,這是第一代比前任便宜的 Opus。從 4.5 到 5 的五代 Opus 牌價全部是 $5/$25,而最新的一代突然成了最便宜的。Anthropic 的官方估算:「在預設設定下,典型工作負載的成本比 Opus 5 低 40%。」

這句話的兩半都成立,而兩半之間的落差正是本文存在的原因。牌價表上,貢獻最大的那一行是快取讀——降了 60%,降到與 Sonnet 5 持平的 $0.20。牌價表之外,r/ClaudeCode 有開發者在發布當天打開 Artificial Analysis,看到 Opus 5.5「按 AA 智能指數每任務成本顯示比 Opus 5 更貴」,隨後自問自答:「別用 max 檔推理。只要不用 max 它就更便宜」(r/ClaudeCode)。本頁是 Opus 5.5 故事裡管錢的那一半——能力背景見家族總覽Opus 4.8 的現狀;後文預算理清之後,Tabbit Browser 會作為執行比較的實踐選項出現。先看數字。

Key takeaways

  • 費率卡: 每百萬 token 輸入 $4、快取讀 $0.20(0.05x——僅此模型的費率)、快取寫 $5/$8(5 分鐘/1 小時)、輸出 $20。Batch 全線五折至 $2/$10;Fast 模式全線翻倍至 $8/$40;US-only 推理對每一行加 1.1x。

  • 降價主要來自一個數字。 快取讀從 $0.50 降到 $0.20(-60%)——Anthropic 自己說這一行「佔 agentic 與編碼工作成本的大頭」。Opus 5.5 的快取讀現在與 Sonnet 5 持平,而模型強了一檔。

  • effort 是最大的可控槓桿。 Artificial Analysis 測得 low 檔每任務 $0.55、max 檔 $5.98——16 個智能點換來 11 倍成本擺動。預設檔是 medium,且同一檔位下它比 Opus 5 每輪思考更多。

  • 沒有長上下文斷崖。 完整 100 萬 token 視窗按標準價計費,Batch beta header 還允許 30 萬輸出 token。但 4.7 之後的新 tokenizer 同樣文字產生的 token 比舊模型多約 30%。

  • 訂閱側同步更新。 Opus 5.5 在 Pro/Max 按標準額度計(Fable 走週限 50% 的 usage credits),付費檔 5 小時限額調高,限額重置可存起來隨時用。

Claude Opus 5.5 費率速覽

標準費率全表,來自 2026 年 9 月 23 日的 Anthropic 定價文件

模型輸入 / 百萬5m 快取寫 / 百萬1h 快取寫 / 百萬快取讀 / 百萬輸出 / 百萬
Claude Opus 5.5$4.00$5.00$8.00$0.20$20.00
Claude Fable 5.1$10.00$12.50$20.00$0.25$50.00
Claude Opus 5$5.00$6.25$10.00$0.50$25.00
Claude Sonnet 5$2.00$2.50$4.00$0.20$10.00
Claude Haiku 4.5$1.00$1.25$2.00$0.10$5.00
Anthropic 官方模型定價表,列出 Claude Fable 5.1、Claude Opus 5.5、Claude Opus 5 等模型的基準輸入、5 分鐘與 1 小時快取寫入、快取命中和輸出費率
2026 年 9 月 23 日顯示的 Anthropic 官方模型定價表。

這張表裡有三件事值得盯住,而且都不是頭條的 $4:

  1. 快取讀有了自己的乘數。 其他標準模型的讀取是基準輸入價的 0.1x;Fable 5.1 與 Mythos 5.1 是 0.025x;Opus 5.5 按官方註腳介於兩者之間,為 0.05x。結果是 $0.20——與 Sonnet 5 的快取讀完全一致。

  2. 輸出仍是輸入的 5 倍。 這個模型的自適應思考無法關閉,而思考 token 是計費輸出。一個短提示帶一條長推理鏈,本質是一張穿著輸入外衣的輸出帳單。

  3. tokenizer 早在兩代前就換了。 Claude 4.7 及之後的模型同樣文字產生約 30% 更多的 token,出自 Anthropic 自己的註腳。與 Opus 4.6 時代的單價直接對比,會把舊模型成本高估三分之一。

還有一點值得釘住:完整 100 萬 token 視窗按標準價計費——不存在長上下文档位。與 GPT-6 Astra 的 272K 斷崖(跨過門檻後整個請求重新定價)不同,Anthropic 的原話是 Opus 5.5 上「一個 90 萬 token 的請求與一個 9 千 token 的請求按同樣的單價計費」。

變化最大的數字:快取讀降價 60%

Opus 5 到 Opus 5.5 之間五個計費行都動了,但對 agentic 工作真正重要的是讀取那一行:每百萬 $0.50 → $0.20,降 60%,並啟用新的 0.05x 乘數。

機制:當請求重複使用此前處理過的提示前綴——系統提示、儲存庫上下文、對話歷史、工具定義——API 從快取讀取該前綴而不是重新處理。寫入按基準輸入的 1.25x 計費(5 分鐘條目,本模型 $5/百萬)、2x 計費(1 小時條目,$8/百萬)。讀取按 0.05x 計費——$0.20/百萬——僅此模型。快取在 1 次 5 分鐘重讀或 2 次 1 小時重讀後回本,乘數可與 Batch 和資料駐留定價疊加,最小可快取提示為 512 token。

為什麼它主導 agent 帳單:一個在 20 萬 token 上下文上做 40 次工具呼叫的 agent,會把該前綴重讀 40 次。按 Opus 5 的 $0.50/百萬,這些重讀花 $4.00;按 Opus 5.5 的 $0.20/百萬,花 $1.60——一個新 token 都還沒生成。Anthropic 自己的發布頁也指向這一行:快取讀「佔 agentic 與編碼工作成本的大頭」,60% 的降幅是官方 40% 說法裡最大的一塊。

同一故事的訂閱側現場:

r/ClaudeCode 帖子與留言:開發者討論 Opus 5.5 成本,有人回報在 xhigh 與 max 檔同時開多條執行緒用量也消耗得很慢
r/ClaudeCode,發布當天:發文者的 max 檔疑問與社群用量回報;個人訂閱體驗,方案未知。

「Usage drains so slowly with opus 5.5. Have multiple threads going on xhigh and max and the usage bar is hardly budging」,一則留言這樣寫;另一位使用者回報兩個大任務後週額度幾乎沒動。這些是自述的方案體驗,不是基準測試——但方向與 API 數學一致:agentic 預算就住在讀取那一行上。

和以往一樣的陷阱:快取省錢要求前綴穩定。如果你的上下文每輪都在變——動態工具輸出、輪換文件——你會反覆支付 1.25x–2x 的寫入懲罰,而不是搭 0.05x 讀取的順風車。另外 Opus 5.5 的 thinking blocks 與模型和對話綁定;前綴一改就失效,這正是下一節的縮影。

「便宜 40%」到底指什麼

Anthropic 的發布口徑有三個精確條件,拆開讀才不會把預算寫成願望。「我們的測試顯示,在預設設定下,典型工作負載的成本將比 Opus 5 低 40%。」

條件一:基線是 Opus 5,不是競品,也不是 Fable。這個說法由兩個效果合成——約 20% 的牌價下調加上每任務更少的 token(「它每 token 比 Opus 5 便宜,且每任務用的 token 更少,合計成本下降 40%」)。Anthropic 自己的算例落在同一區間甚至更高:HAProxy 的 C 到 Rust 重寫 9.5 小時完成,Fable 5.1 用了 12 小時,成本低 51%;20 萬行程式碼稽核 3 小時內完成,Opus 5 用了 20 多個小時且耗 2.5 倍 token。具名早期使用者回報 40–50% 的成本下降(Spotify)、一半的 token(Kiro)、三分之一的 token(Box),以及「第一個我們預設用 medium 檔的模型」(Factory)。HN 上有留言一句話畫出趨勢線:「三週前發布的上一代還號稱前沿,這次直接把效能/成本比提高了約 3–6 倍」(Hacker News)。

條件二:「預設設定」指 medium 檔。 拉到 max 檔時數學會反轉——按官方行為說明,「同一 effort 檔位下,該模型往往比 Claude Opus 5 每輪思考更多,在 xhigh 和 max 尤其明顯」,而計費的思考正是預算殺手。r/ClaudeAI 的對拍帖把形狀量化了:「max 檔下,AA 測得 Opus 5.5 每任務約 11.9 萬輸出 token,而 [GPT-6] Sol 只用了約 3.1 萬,跑完整個指數每任務 $1.06」:

r/ClaudeAI 帖子:比較 Opus 5.5 與 GPT-6 Sol 的基準,指出 max 檔下 Opus 5.5 每任務約用 11.9 萬輸出 token,Sol 為 3.1 萬
r/ClaudeAI:同日發布的對拍;社群對 AA 資料的解讀,不是受控基準。

條件三:「典型工作負載」意味著你的未必典型。 社群在這裡帶著傷疤,而且這傷疤是有價格的。發布新聞帖下的最高讚留言(226 讚):

r/ClaudeAI 留言:使用者回憶 Opus 5 發布時關於 token 效率的宣傳,以及溝通不暢導致時間與 token浪費的經歷
r/ClaudeAI 發布帖:對 Opus 5 發布口徑的回憶;主觀經歷,非測量資料。

「當 Opus 5 剛發布時,他們一直宣稱模型多麼前沿……用了一段時間後大家發現 Opus 5 連正常溝通都做不到……來回拉扯讓很多人自我懷疑,浪費了更多時間和 token。」同一網路上的懷疑者把 AA 圖表往另一個方向讀——「opus 5.5 擊敗了 astra……但完成相同任務用了 4.5 倍的 token」——而辯護者讀出的是「opus 5.5 medium 對 Astra max 同等效能,便宜 2.5 倍」。兩邊讀的是同一場發布。你的帳單更像哪一邊,取決於哪種 token 佔主導——這正是下一節要量的東西。這輪取捨的能力面見 Fable 5.1 評測與我們的 agentic 推理指南

effort 槓桿:每任務 $0.55 到 $5.98

費率卡上沒有任何一行告訴你:這個旋鈕對成本的拉動超過所有牌價。Artificial Analysis 把 Opus 5.5 作為五個條目追蹤;2026 年 9 月 23 日快照:

effort智能指數每任務成本輸出速度
low42$0.5583 t/s
medium(預設)51$1.3476 t/s
high54$1.8290 t/s
xhigh56$3.4676 t/s
max58$5.98

把兩端放在一起讀:max 檔每任務成本是 low 檔的 10.9 倍,換來 16 個測量智能點。 medium——預設檔——的智能指數與 Opus 5 的 max 檔持平($1.34 對 Opus 5 的 max 檔定價)。r/ClaudeCode 帖子裡最高讚的回覆正是這個意思:「max 的成本幾乎是 xhigh 的兩倍,而且它和其他檔位完全不成比例。用 medium 或 high 你會看到實打實的成本節省。」那裡有位開發者已經圍繞這個階梯重構了工作流:「Opus 5.5 High 非常棒。感覺像 fable 5.1 medium,但便宜得多……我把工作流改成大部分事情用 Opus 5.5 high。」

調低或調高檔位前有兩個注意事項。第一,遷移:預設檔從 high(Opus 5)變成了 medium,而同一檔位下新模型每輪思考更多——Anthropic 文件明確要求重跑 effort 掃描而不是照搬設定,並給思考 token 在 max_tokens 裡留出空間。第二,更高的 effort 不保證更高的品質。CodeRabbit 發布當天的評測發現「更高的推理 effort 並沒有穩定帶來更好的完成率」——而且更多需要人審讀的評論本身就是成本:

CodeRabbit 的 YouTube 影片介紹 Opus 5.5 評測:結果好壞參半,並指出更高的推理 effort 未穩定帶來更好的完成率
CodeRabbit 發布當天的評測影片:單一廠商基準,方法在其影片內。

發布頁的客戶引語方向一致——Rogo 用「最低 effort 檔」勝過 Opus 5 的 high 檔、「輸出 token 少約 60%」;Walleye Capital 在最低檔「基本解決」了他們的評測套件。當廠商自己的證據不斷指向便宜檔位時,把它當預設答案,把 max 留給確實需要它的任務。

頭條之外的計費線

五條線決定大多數真實帳單,而只有第一條出現在發布報導裡。

Fast 模式:全線 2 倍,換最高 2.5 倍速度。 Fast 模式(research preview,僅 Claude API)按 $8 輸入 / $40 輸出計費——標準卡的兩倍,快取線也一樣(讀取 $0.40)。它可與快取和資料駐留疊加,不能與 Batch 組合,輸出「快至 2.5 倍」;OpenRouter 的供應商表測得 Fast 143 tok/s,標準為 71–83。值得注意的是,Fast Opus 5.5 的 $40/百萬輸出仍低於 Fable 5.1 標準價的 $50。

Batch:五折槓桿。 非同步 Batch 請求按 $2/$10 計費——全卡最大折扣,與提示快取疊加覆蓋整個上下文視窗,beta header 允許最高 30 萬輸出 token。託管 agent 會話不符合條件;它們有狀態且互動式。

US-only 推理:全類目 1.1x。 設定 inference_geo: "us" 會把每一類——輸入、輸出、快取寫、快取讀——乘以 1.1x。同樣的 10% 也出現在合作雲的區域端點上:OpenRouter 列出的 Bedrock/Azure/Vertex 區域路由為 $4.40/$22.00/$0.22。合規驅動的區域為每一行安靜地多付一成;全球路由是預設也是更便宜的路徑。

工具開銷就是 token 帳單。 工具使用系統提示每請求加 286 token(低於 Opus 4.7 的 675);宣告瀏覽器工具集約加 6,600 輸入 token,computer use 約 4,500。伺服器端網頁搜尋在 token 之外每千次收 $10;程式碼執行與搜尋/fetch 搭配免費,每月 1,550 小時免費容器時數後按 $0.05/小時計。「agent」是一種定價結構,不是一次聊天——工具那一行要單獨編預算。預算端的對照見 Kimi K3 定價拆解

Managed Agents 執行時:每會話小時 $0.08,只在 running 狀態計費,所有 token 線按模型價。Batch 不適用於會話。

家族階梯:Opus 5.5 vs Fable 5.1 vs Opus 5 vs Sonnet 5

線項(每百萬 token)Opus 5.5Fable 5.1Opus 5Sonnet 5
輸入$4.00$10.00$5.00$2.00
快取讀$0.20(0.05x)$0.25(0.025x)$0.50(0.1x)$0.20(0.1x)
輸出$20.00$50.00$25.00$10.00
Batch 輸入 / 輸出$2.00 / $10.00$5.00 / $25.00$2.50 / $12.50$1.00 / $5.00
AA 智能指數(max 檔)58535138
AA 每任務成本(max 檔)$5.98$7.63¹

¹ Fable 5.1 為 AA 9 月 22 日快照,經我們的 Fable 定價拆解;兩個 AA 頁面每天都在變。

反直覺的一行是最後一行:在 Artificial Analysis 的指數上,更便宜的模型現在也是更強的模型。 Opus 5.5 max 檔得分 58 對 Fable 5.1 的 53,每任務成本 $5.98 對 $7.63——而 Anthropic 自己的定位仍把 Fable 留給「有雄心的、長時執行的非同步工作」,並承認 Opus 與 Fable 的差距「比這些分數顯示的更小」。這對組合的正確讀法是:分數誇大了差距,但價格差距是真實的且方向反了。快取上下文循環兩者更接近——Fable 保有最深的讀取折扣(0.025x),但它的讀取從 $10 基準起算:$0.25/百萬。Opus 5.5 的 $0.20 讀取在絕對值上更低。

同一張 AA 圖的兩種社群讀法,並排放著:

X 帖子:一位使用者稱 Opus 5.5 medium 檔與 GPT-6 Astra max 檔同 token 同效能且便宜 2.5 倍;被引帖則指出 Opus 5.5 完成同一任務用了 4.5 倍 token
X:同一份 AA 資料的兩種讀法——性價比之選 vs 吃 token 的旗艦;個人對圖表的解讀。

「same tokens … same performance opus 5.5 med vs Astra max — 2.5x cheaper」對「opus 5.5 擊敗了 astra……但用了 4.5 倍的 token」。兩者描述的是同一個形狀:Opus 5.5 贏在每完成任務成本,輸在每任務 token。如果你的工作負載對 token 形狀敏感——嚴格的按 token 預算、第三方路由、吞吐上限——遷移前先實測;如果是任務形狀敏感,階梯幾乎每一級都偏向 Opus 5.5。

旗艦之下,Sonnet 5 以 $2/$10 保持預算席位,$0.20 的讀取——現在與 Opus 5.5 同價——以及 Haiku 4.5 的 $1/$5。階梯的新邏輯是:快取讀這一列已經壓縮到聰明的模型和便宜的模型對 agent 打得最狠的那一行收一樣的錢

不收錢的部分

文件裡的幾條邊界寫得像退款政策,在 agentic 規模下很要緊:

  • 被丟棄的 thinking blocks 不計費。 請求攜帶模型無法讀取的 thinking block 時,API 會在推理前丟棄它:「請求成功,被丟棄的 blocks 不計費」。對一個思考塊與對話綁定的模型來說,這是優雅降級線。

  • 護欄轉寫由其他模型完成。 按發布頁基準註腳,網路安全類請求由 Opus 4.8 完成;轉寫透明(拒答返回帶政策域的 stop_reason: "refusal",伺服器端 fallback 會換推薦模型重試)。Anthropic 沒有像對 Fable 那樣明寫 Opus 5.5 的轉寫計費模型——在文件明確前,按完成模型自身的費率假設是穩妥的。

  • 失敗的網頁搜尋不計費。 成功的每千次 $10;出錯的不收。web fetch 除擷取內容變成的 token 外不另收費。

  • 程式碼執行與搜尋或 fetch 搭配免費,每個組織每月 1,550 小時免費容器時數,超出後 $0.05/小時。

方案可得性:API、雲與消費訂閱

API 費率卡只是三套經濟體系之一。2026 年 9 月 23 日在 claude.com/pricing 與平台文件核對:

渠道價格(頁面核驗值)Opus 5.5 可用性
Anthropic API上文 token 費率可用 — claude-opus-5-5
Free 層$0不可用(僅 Sonnet/Haiku)
Pro年付 $17/月(預付 $200)或月付 $20可用 — 標準額度
Max 5x / 20x$100 起/月可用 — 標準額度
TeamStandard 席位高於 Pro;Premium = 5x Standard可用
Enterprise年付 $20/席位/月 + 按 API 費率的用量可用,帶支出管控
雲平台AWS Bedrock、Google Cloud、Microsoft Foundry、Claude Platform on AWS可用;區域端點 +10%,Foundry 按 CCU 計量

值得劃線的訂閱行:方案比較頁上,Opus 在 Pro/Max 按標準用量額度計——帶「usage credits,週限 50%」星標的是 Fable。一個 Fable 小時對額度來說值兩個標準模型小時;Opus 5.5 不這樣。發布時 Anthropic 還疊加了兩項變化:Pro、Max、Team 和按席位計費 Enterprise 的 5 小時使用限額調高,以及「現在可以保存、隨時使用」的限額重置。

社群對實際意義的看法分裂,兩個方向都在發布週的同一批帖子裡:

r/singularity 留言:一位使用者稱按 Opus 5.5 的成本永遠碰不到週限額;另一位則認為 API 降價未必傳導到訂閱
r/singularity:發布當天對訂閱的分歧預期;個人用量報告與推測。

「I am using Fable 5.1 rn, and this is 5x cheaper for same intelligence? I am never going to hit my weekly limits at this rate」——對上——「這些降價不必然傳導到訂閱……他們拿 API 成本當行銷材料,同時把尺度向 API 使用者傾斜。」限額調高有文件;它到底多慷慨,只有你自己的 5 小時視窗能回答。機制上:用量按 5 小時滾動會話視窗重置,付費檔再疊加週限;網頁/桌面/行動/Claude Code 共用一個池;付費檔的 usage credits 可在超限後按標準 API 價繼續使用。

兩個算例,所有假設攤開

標準費率,不含重試、工具、稅費。是算術,不是預測。

一個帶長思考的短問題。 輸入 10,000 token,輸出 2,000:

(10,000 × $4 + 2,000 × $20) / 1,000,000 = $0.08

大型儲存庫上的冷啟動 agent 循環。 輸入 300,000 token(標準價——沒有長上下文档位),輸出 8,000:

(300,000 × $4 + 8,000 × $20) / 1,000,000 = $1.36

同一循環的暖啟動版。 同樣的 300,000 token 上下文,90% 快取命中,每會話一次 1 小時寫入,每輪輸出 8,000:

每輪: (270,000 × $0.20 + 30,000 × $4 + 8,000 × $20) / 1,000,000 = $0.334
一次性: 300,000 × $8 / 1,000,000 = 每會話寫入 $2.40

暖啟動每輪成本降到冷啟動的四分之一,$2.40 的寫入由每次重用攤薄——5 分鐘寫入($1.50)一次重讀回本,1 小時寫入兩次回本。前綴一翻新,同一個循環每輪都按 $1.36 冷啟動。模型資源頁 (简体中文)和它的提示詞合集 (简体中文)整理了可重用任務,方便你測自己的命中率。

本機計算

估算 Claude Opus 5.5 API token 成本

使用 2026-09-23 核對的官方美元費率。輸入值只在瀏覽器本機處理。

每次任務$0.08000
每月$0.08

快取命中按每百萬 token $0.20 計費——Opus 5.5 的 0.05x 費率。此估算不含重試、工具開銷、護欄轉寫及供應商加價。Fast 模式對全部線項翻倍,且不能與 Batch 疊加。 核對最新費率

計算機完全在本頁執行——不向任何地方傳送資料。它計算兩種快取寫入時長以及標準、Batch、US-only、Fast 四種模式,並在本機校驗輸入。它有意不建模的部分:重試、子 agent 扇出、工具開銷和護欄轉寫——這些放進你的餘量。提交預算前請重查官方費率卡;本文是 2026 年 9 月 23 日的數字。

一個實踐選項:在 Tabbit 裡跑比較

預算理清之後是枯燥的部分:真正執行 Opus 形態的工作,需要一個頁面、檔案和模型呼叫共處一處的環境,需要「用 medium 試 Opus 5.5、不行退回 Sonnet」是一次選擇而不是一個編排專案。這正是 Tabbit Browser 占據的位置——一款 agentic AI 瀏覽器,模型選擇器、即時分頁和本機檔案共享同一個介面。

Tabbit Browser 新分頁的模型選擇器,展示可用模型列表

邊界說明白:Tabbit 是用戶端,不是 Anthropic 的計費層。模型可用性取決於你的帳號和版本,瀏覽器裡的任何東西都不改變 Anthropic 收什麼費——上面的費率卡在 Opus 5.5 執行的任何地方都適用。本文沒有在 Tabbit 內執行 Opus 5.5 任務,因此不做任何可用性或效能聲明。瀏覽器改變的是搭建成本:在真實工作上測你自己的快取命中率和 effort 閾值——本文通篇說這兩個數字決定你的帳單——在為這件事而生的工作台裡做最便宜。方法見 Tabbit 使用習慣指南

Tabbit Browser

Claude Opus 5.5 定價決策表

你的工作負載成本驅動最佳起點注意
長 agent 循環、穩定的儲存庫/文件上下文快取讀標準層 + 前綴穩定 + 1 小時寫入前綴改動使綁定的 thinking blocks 失效;上下文翻新會把讀變成 1.25–2x 寫
短對話、快速修改輸出 token更低 effort——或 Sonnet 5思考不可關閉;預設 medium 通常夠用
隔夜評測、批次重構體量Batch API $2/$10、30 萬輸出 beta互動式和託管 agent 會話不符合條件
延遲敏感的互動工作輸出速度Fast 模式 2x($8/$40),配快取Fast 不能與 Batch 組合;它讓每一行翻倍
合規要求的美國內處理每一行US-only 1.1x,或區域雲端點(+10%)加價同樣作用於快取讀
對 token 形狀敏感的預算(路由、上限)每任務 token遷移前先實測Opus 5.5 贏每任務成本、輸每任務 token
基於訂閱的日常使用5 小時視窗Pro/Max——Opus 按標準額度計且限額調高同方案的 Fable 走週限 50% 的 usage credits

最終裁決

Claude Opus 5.5 是第一代比前任便宜的 Opus,而且每一行都是真的——輸入輸出降 20%,主導 agentic 帳單的快取讀降 60%,現在與 Sonnet 5 同價。為長時程 agentic 編碼和知識工作買它,用 medium 檔,前綴保持穩定,能等的工作全部交給 Batch;在 AA 指數上它已經以更低的每任務成本超過 Fable 5.1,家族階梯因此重排。它修不好的兩筆帳:max 檔思考(費率卡上永遠看不到的 11 倍槓桿)和對 token 形狀敏感的預算(每任務 token 仍多於更精瘦的對手)。訂閱上它是額度友善的旗艦——標準用量、限額調高——但給團隊切換前先核對自己 5 小時視窗的消耗。每月重查官方定價頁:Sonnet 5 轉正和這次發布都說明階梯變得很快。能力故事見 Fable 5.1 總覽評測;上文連結的社群記錄承載工作負載證據;跨家族價格比較展示同樣的牌價在別處值多少錢。

Sources

常見問題

Claude Opus 5.5 多少錢?

在 Anthropic API 上,Claude Opus 5.5 每百萬輸入 token 收 $4、每百萬輸出 token 收 $20,2026 年 9 月 23 日於 Anthropic 官方定價文件核對。提示快取寫入為每百萬 $5(5 分鐘)或 $8(1 小時),快取讀取為每百萬 $0.20——此 0.05x 費率僅此模型適用。Batch API 全線五折至 $2/$10,Fast 模式全線翻倍至 $8/$40。

Claude Opus 5.5 比 Opus 5 便宜嗎?

費率卡上每一行都降了:輸入輸出比 Opus 5 的 $5/$25 低 20%,快取寫入從 $6.25/$10 降到 $5/$8,快取讀從 $0.50 直降 60% 到 $0.20。Anthropic 估算典型工作負載在預設設定下總成本約低 40%。例外是 effort 檔位:max 檔每輪思考更多,獨立測得的每任務成本從 low 的 $0.55 到 max 的 $5.98,相差 11 倍——這在牌價表上看不到。

Claude Opus 5.5 在免費層可用嗎?

不可用。Anthropic 的方案比較頁標註 Opus 在 Free 層不可用,Free 層只有 Sonnet 與 Haiku。Opus 5.5 包含在 Pro、Max、Team、Enterprise 的標準額度內——值得注意的是按標準額度計,而不是 Fable 5.1 在 Pro/Max 上的 usage credits 機制。發布同時 Anthropic 還調高了 Pro、Max、Team 與按席位計費 Enterprise 的 5 小時使用限額,並新增可保存備用的限額重置。

執行 Claude Opus 5.5 最省錢的方式是什麼?

按順序用槓桿:保持提示前綴穩定,讓重讀按每百萬 $0.20 而不是 $4 計費;在能通過驗收的最低 effort 檔執行(預設 medium 通常夠用);不緊急的工作走 Batch API 的 $2/$10;沒有合規或延遲需求就不用 US-only 與 Fast 模式。遷移時還要重跑 effort 掃描:同一檔位下 Opus 5.5 比 Opus 5 每輪思考更多。

Claude Opus 5.5 長上下文額外收費嗎?

不收。完整的 100 萬 token 上下文視窗按標準單價計費,沒有長上下文档位,提示快取與 Batch 折扣覆蓋整個視窗。Batch API 上有 beta header 可把最大輸出提到 30 萬 token。注意 Claude 4.7 及之後的模型使用新 tokenizer,同樣文字產生的 token 比舊模型多約 30%。

護欄轉寫或失敗的工具呼叫會按 Opus 5.5 價格計費嗎?

被護欄轉寫的請求由其他模型完成——Anthropic 表示網路安全類工作由 Opus 4.8 處理——且轉寫透明上報,而不是默默按本模型計費。失敗的網頁搜尋完全不計費;web fetch 除內容本身 token 外不另收費;模型無法讀取的 thinking blocks 會在推理前被丟棄且不收費。程式碼執行與網頁搜尋或 fetch 搭配時免費,單獨使用每月有 1,550 小時免費容器時數。

下一步

讓 Tabbit 與你並肩工作。

跨分頁調研、自動化重複的瀏覽器工作,讓每一處上下文都觸手可及。