Tabbit部落格

Claude Opus 4.8 是什麼:變化、取得方式與 Legacy 狀態

以官方與獨立來源整理 Claude Opus 4.8 的 effort、上下文、價格、提供商、4.7 變化、安全邊界與目前生命週期。

本文目錄
  1. 關鍵結論
  2. 規格與取得
  3. 與 Opus 4.7 的變化
  4. 基準與安全:先看 harness
  5. 生命週期、價格與入口
  6. 身分與場景自我檢查
  7. 結論
  8. 來源與常見問題
  9. Opus 4.8 仍可用嗎?
  10. 每個用戶端都提供 1M 上下文嗎?
  11. 應該使用 high、extra 還是 max?
  12. Fast Mode 是另一個模型嗎?
  13. 4.8 比 4.7 更安全嗎?
  14. 能在 Tabbit 使用嗎?

Claude Opus 4.8 是 Anthropic 於 2026 年 5 月發布的模型,面向複雜編碼、瀏覽器代理、工具呼叫和長上下文知識工作。它仍適合受控試用,但截至 2026 年 9 月 20 日,Claude Platform 已把它標為 Legacy,並建議考慮 Opus 5。

這是今天的決策錨點。平台仍列出與 Opus 4.7 相同的標準價格——輸入每百萬 token 5 美元、輸出 25 美元——以及 1M 上下文、128K 輸出和 adaptive thinking。新整合需要同時問:4.8 能否解決任務,以及支援週期是否值得採用?先看 Claude Opus 4.8 模型資源 (简体中文),再確認實際入口。

關鍵結論

  • 4.8 是 4.7 的後繼版本,加入 effort 控制、Fast Mode 和 Claude Code 的 Dynamic Workflows。

  • 官方目錄列出 claude-opus-4-8、1M 上下文、128K 輸出、adaptive thinking、預設 high effort 和 2026 年 1 月知識截止。

  • 獨立早期評測在一個綜合指數中領先,但引用的 Terminal-Bench 2.1 中 GPT-5.5 更高;必須保留 harness。

  • 更高 effort、思考、長上下文和重試會改變單任務費用;$5/$25 不是任務預算。

  • 它仍可用,但新生產整合應先比較 Opus 5 並記錄遷移方案。

規格與取得

項目2026-09-20 目錄快照決策邊界
API IDclaude-opus-4-8在日誌固定完整 ID,提供商別名可能不同。
發布與狀態2026-05-28;Active (legacy)可用不等於目前家族終點。
上下文 / 最大輸出1M / 128K token目錄上限,用戶端或提供商可能更小。
輸入 / 輸出文字、圖片 / 文字工具和瀏覽器權限取決於入口。
thinking / effortadaptive;預設 high;支援 extra/xhigh、max應按任務比較 effort。
標準 API 價格輸入 $5 / 輸出 $25 / MTok快取、Batch、Fast Mode、提供商和方案另計。
知識截止2026 年 1 月目前事實需要檢索或來源核對。
退役不早於 2027-05-28新專案應問是否直接選 Opus 5。

提示資源 (简体中文)評測資源 (简体中文)適合查看原始條目,本文集中討論生命週期與工作負載選擇。

與 Opus 4.7 的變化

Anthropic 強調 4.8 在判斷、未完成工作自報、遵循指令和工具效率上的改進,並稱在其評估中,4.8 讓程式碼缺陷未經提示通過的機率約低四倍。這是官方評估,不代表你的儲存庫無需測試。

三個產品變化值得注意:預設 high,困難或非同步任務可用 extra/xhigh 和 max;Fast Mode 是同一模型約 2.5 倍速度的路線,價格為輸入 $10、輸出 $50 / 百萬 token;Dynamic Workflows 是 Claude Code Enterprise、Team 和 Max 的研究預覽,可規劃大型任務、並行數百個子代理並驗證結果。

獨立報告並非單向勝利。一位長期 Reddit 使用者稱 4.8 在 Playwright、Cloud CLI 和 Kubernetes CLI 上是明顯更新,但某些超大程式碼庫中 GPT-5.5 更自主;另一條早期討論則稱 4.8 在修復壞程式碼時給出快速而自信但有問題的答案(報告討論)。這些只證明具體場景經驗。

基準與安全:先看 harness

獨立早期彙總給出混合結果:Artificial Analysis 綜合 Intelligence Index 為 61.4,GPT-5.5 為 60.2;但引用的 Terminal-Bench 2.1 中,4.8 為 74.6,GPT-5.5 為 78.2。同一彙總的 SWE-Bench Pro 為 69.2,Opus 4.7 為 64.3;Finance Agent v2 為 53.9,低於 Gemini 3.5 Flash 的 57.9。

這些數據來自不同任務、日期和 harness。另一篇獨立評測說 Anthropic 的 SWE-bench 數字沒有被獨立重現,而它引用 Artificial Analysis 在 2026-08-03 的獨立運行是 84.6% Terminal-Bench 2.1,不能把 74.6 和 84.6 合併成一個分數。

獨立紅隊研究在 7,826 個有害意圖和四類自動越獄攻擊中,報告最強的 tree-of-attacks 對 Opus 4.8 的 11.5% 意圖實現突破。這是受控對抗實驗,不是日常失敗率,但說明模型分數不能取代應用層控制。本文不重現有害提示。

生命週期、價格與入口

目前平台頁仍列出 4.8,但標為 legacy,並連結遷移 Opus 5;退役不早於 2027-05-28。Anthropic 列出 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 和 Claude Platform on AWS。Claude.ai 與 Claude Code 方案有自己的選擇器、額度與功能門檻,不能由 API 目錄反推。

入口或功能已發布邊界不代表
Claude APIclaude-opus-4-8,$5/$25 / MTok訂閱或瀏覽器暴露相同限制。
AWS / Google Cloud / Microsoft Foundry提供商自己的 ID 和條款地區、額度和工具與 Anthropic 相同。
Claude.ai / Claude Codeeffort 和產品訪問訂閱包含 API 額度。
Fast Mode研究預覽,約 2.5 倍速度,$10/$50 / MTok所有方案或提供商都有。
Prompt caching快取寫入和讀取單獨計價長任務自動便宜。
Batch API目錄列出輸入和輸出 50% 折扣互動式工具任務遵循 Batch 語義。
Dynamic WorkflowsEnterprise、Team、Max 的 Claude Code 研究預覽所有使用者都能執行數百代理。

價格只是使用邊界,不是預測。高 effort 任務可能增加 thinking token、快取讀取、重試、工具和子代理呼叫。應測量每個已接受結果的成本,不要混淆 API、Claude.ai/Claude Code 方案、提供商加價、Fast Mode 與 Tabbit。

若要比較相鄰家族,請分別閱讀 Claude Sonnet 5 總覽Claude Fable 5.1 評測;它們的 effort、價格和生命週期證據不能直接套用到 Opus 4.8。

身分與場景自我檢查

記錄完整模型 ID、用戶端、提供商、地區、日期、effort 和工具。定義輸入檔案、期望輸出、驗收測試和停止條件。程式碼要執行現有測試並檢查 diff;瀏覽器或終端代理要記錄工具呼叫,並在不可逆操作前請求確認;研究任務要有引用和矛盾檢查。

社群也提示上下文風險:一位 Reddit 使用者稱啟用 4.8 thinking 時每輪最多可能產生 900,000 個快取 token,而 4.7 為 14,000–34,000;另一位大型程式碼庫使用者描述數十萬 token 的長期會話(來源)。這是使用者測量,不改寫官方 1M 目錄上限,只說明應在自己的 harness 測量 effort 和上下文。

本文沒有用已登入帳戶在 Tabbit Browser 實測 Opus 4.8,因此不宣稱選擇器、有效上下文、延遲、提供商路由、訂閱權限、工具或費用。代理瀏覽器指南瀏覽器自動化指南AI 瀏覽器指南解釋用戶端邊界;Tabbit Browser 總覽不是 API 或提供商測試。

Tabbit Browser

結論

Claude Opus 4.8 仍值得用於複雜編碼、工具分析和瀏覽器代理的受控試用。4.7 改進有意義,但獨立證據受 harness 影響,且目前目錄已標為 legacy。用固定驗收測試比較 Opus 5,在不可逆操作周圍保留人工確認。

來源與常見問題

主要來源是 Anthropic 的發布說明平台模型頁價格文件系統卡,以及 Digital AppliedThePlanetTools紅隊研究。社群連結與採集限制已記入內部研究稿。

Opus 4.8 仍可用嗎?

可以,但目錄已標為 active、legacy,並建議考慮 Opus 5;退役時間不早於 2027 年 5 月 28 日。

每個用戶端都提供 1M 上下文嗎?

不能。那是模型目錄上限,提供商、方案、介面或工具包裝層可能提供更小視窗。

應該使用 high、extra 還是 max?

從能通過驗收測試的最低檔開始。更高 effort 可能改善難題,也可能增加 token、等待時間和額度消耗。

Fast Mode 是另一個模型嗎?

不是。Anthropic 將它描述為同一模型的更快路線,價格為 $10/$50 / 百萬 token,是否可用取決於方案和提供商。

4.8 比 4.7 更安全嗎?

Anthropic 報告 misaligned behavior 低於 4.7,但獨立紅隊仍發現自適應攻擊面;應用層控制和人工確認不能省略。

能在 Tabbit 使用嗎?

本文沒有核驗已登入 Tabbit 會話。查看自己的選擇器,並把一次成功任務當作本地觀察,不要當作平台保證。

常見問題

Claude Opus 4.8 是什麼?

Claude Opus 4.8 是 Anthropic 於 2026 年 5 月發布的 Opus 模型,面向複雜編碼、工具呼叫、瀏覽器代理與長上下文知識工作。API ID 是 claude-opus-4-8,模型頁列出 1M 上下文與 128K 最大輸出。

Claude Opus 4.8 仍是目前模型嗎?

它仍可使用,但 2026 年 9 月 20 日檢查的 Claude Platform 頁面已標為 Legacy,並建議考慮 Claude Opus 5。頁面寫明退役時間不早於 2027 年 5 月 28 日。

Claude Opus 4.8 如何計費?

標準 API 輸入為每百萬 token 5 美元,輸出為 25 美元。Fast Mode 列為 10 和 50 美元;快取、Batch、提供商和消費者方案另計。

Opus 4.8 支援哪些 effort?

Anthropic 文件列出 adaptive thinking,預設 effort 為 high,並支援 extra 或 xhigh、max。較低 effort 更快且消耗速率限制較慢,較高 effort 可能使用更多 token。

Opus 4.8 與 4.7 有何變化?

Anthropic 強調判斷、遵循指令、工具效率與自我檢查改進,並增加 effort、Fast Mode 與 Dynamic Workflows。獨立早期評測依 harness 呈現混合結果,不是所有任務都勝出。

可以在 Tabbit 使用 Claude Opus 4.8 嗎?

本文沒有用已登入 Tabbit 帳戶實測 Opus 4.8,因此不宣稱選擇器、有效上下文、延遲、費用或工具權限。請查看即時選擇器並驗證一個可回滾的小任務。

下一步

讓 Tabbit 與你並肩工作。

跨分頁調研、自動化重複的瀏覽器工作,讓每一處上下文都觸手可及。