Tabbit部落格

Claude Opus 4.7:改了什麼、適合什麼,以及何時遷移

用來源核對 Claude Opus 4.7 的 4.6 升級、基準分化、API 取得方式、成本、生命週期與遷移檢查。

本文目錄
  1. 先看結論
  2. Claude Opus 4.7 規格
  3. 4.6 到 4.7 的變化
  4. 取得、價格與成本邊界
  5. 風險與社群分歧
  6. 生命週期與遷移
  7. Tabbit 的實際邊界
  8. Verdict
  9. 來源

Claude Opus 4.7 是一次有重點的 4.6 升級:編碼、工具呼叫、電腦操作和視覺能力更強,但公開 BrowseComp 結果下降。它不是每個任務都勝出的通用冠軍,也不再是新專案預設的 Opus 目標。

截至 2026 年 9 月 20 日,Anthropic 實時模型頁把 claude-opus-4-7 標為 Active(legacy),標準 API 價格仍是輸入 $5、輸出 $25 / MTok,並建議考慮 Opus 5。本文沒有登入後的 Tabbit 實測。

先看結論

  • 公開證據最支持困難編碼、工具編排、桌面操作和圖表/介面理解。

  • 目錄列出 1M 上下文、128K 最大輸出、自適應思考與預設 high effort。

  • SWE-bench Verified 從 80.8% 升到 87.6%,BrowseComp 則從 83.7% 降到 79.3%。

  • Anthropic 說 Claude 4.7 之後使用新版 tokenizer,同樣文字大約產生 30% 更多 token;單價不變,任務成本未必不變。

Claude Opus 4.7 規格

Claude Opus 4.7 模型資源 (简体中文)適合查看逐條提示與測評來源。

問題2026-09-20 目錄資訊選型邊界
API IDclaude-opus-4-7在日誌固定完整 ID。
發布/狀態2026-04-16 / Active(legacy)能用不等於目前家族端點。
上下文/最大輸出1M / 128K token客戶端和供應商可能更小。
思考/預設 effortAdaptive / high一起比較 effort、token 和完成品質。
標準 API 價格輸入 $5、輸出 $25 / MTok快取、Batch、雲端與訂閱另計。
目錄平台Claude API、Bedrock、Google Cloud、Microsoft Foundry、Claude Platform on AWS地區、額度和工具仍需確認。

4.6 到 4.7 的變化

Anthropic 將 4.7 定位為更能規劃、使用工具並檢查結果的工程模型,並把圖片長邊提高到 2,576 像素。公開資料與Vellum 解讀支持編碼、工具和視覺推理提升,但不支持「每方面都更好」。

基準Opus 4.6Opus 4.7含義
SWE-bench Verified80.8%87.6%issue 修復訊號上升。
SWE-bench Pro53.4%64.3%困難多語言版本提升。
MCP-Atlas75.8%77.3%多輪工具呼叫小幅提升。
OSWorld-Verified72.7%78.0%電腦操作結果提升。
BrowseComp83.7%79.3%網頁研究訊號回落。
CharXiv,無工具/有工具69.1% / 84.7%82.1% / 91.0%視覺推理增益最明顯。

這些是官方或二次整理數字,不是 Tabbit 測試,也不是你的生產成功率。提示資源 (简体中文)測評資源 (简体中文)保留來源細節。

取得、價格與成本邊界

Anthropic 定價文件列出輸入 $5、輸出 $25 / MTok,快取寫入、快取命中和 Batch 另有規則。新版 tokenizer 大約增加 30% token,長上下文和高 effort 可能讓完成任務成本上升。

路線已公開邊界仍需確認
Claude APIclaude-opus-4-7 與標準 token 價格組織限額、快取、資料駐留。
Bedrock / Google Cloud / Microsoft Foundry目錄列出模型 ID地區、端點溢價、額度、工具和雲端帳單。
Claude 產品 / Claude Code與 API 分開計畫、用量池、選擇器和 effort。
Tabbit Browser可能提供瀏覽器工作流入口選擇器、有效上下文、延遲、成本和工具權限,本文未核驗。

Claude Opus 4.8 總覽解釋下一版本;Claude Sonnet 5適合比較低成本路線。不要把 API 價格和訂閱席位或 Tabbit 可用性混在一起。

風險與社群分歧

高 effort 可能提高困難任務品質,也可能增加 token、等待和限額。Reddit 重度使用者一方面稱 4.7 更能遵循指令、程式碼更好,另一方面認為它比 4.6 不穩定、需要更詳細提示;另一個討論則認為計畫輸出太密,閱讀拖慢決策。這些是個人觀察,不能當作普遍回歸。

原始討論見重度使用對比可讀性討論程式碼審查對照。本文沒有合格社群截圖,保留草稿。

對於Agent 瀏覽器,模型工具能力與瀏覽器實際權限是兩件事;不可逆的終端或頁面操作仍應人工確認。瀏覽器自動化不等於 API 已獲得同樣權限。

生命週期與遷移

Opus 5 遷移指南說明從 4.7 迁移不能只換模型名稱。舊的 sampling、prefill、手動 thinking、新 tokenizer、回應區塊和工具迴圈都要檢查。固定模型 ID,記錄 effort、max_tokens、token、快取、工具呼叫、延遲和重試,分別跑編碼、工具、視覺和網頁研究任務。

工作負載先評估原因
困難倉庫修復和工具編排4.7 與 Opus 5 並跑4.7 的公開增益集中於此,但生命週期要求向前看。
密集截圖、圖表和 UI Agent視覺驗收集CharXiv、OSWorld 上升,但 UI 權限仍不同。
網頁研究 Agent帶引用的對照任務BrowseComp 回落,不能用編碼分數代替研究品質。
日常低成本編碼Sonnet 5參考其獨立價格與 effort 證據。

Tabbit 的實際邊界

Tabbit Browser 總覽AI 瀏覽器說明描述的是客戶端工作流。本文沒有完成登入後的 Opus 4.7 任務,因此不宣稱它一定出現在選擇器中,也不宣稱瀏覽器暴露 1M 上下文或相同價格。若帳戶能看到它,先做一個可回滾的研究任務,保存來源並按書面驗收條件判斷。

Tabbit Browser

Verdict

Claude Opus 4.7 在困難編碼、工具使用和視覺推理上是有意義的 4.6 升級,但 BrowseComp 回落、新 tokenizer 的成本邊界和社群分歧都不支持「全部升級」。它仍值得受控試點;新生產專案則應現在把 Opus 5 納入比較並保留回滾路徑。

來源

主要來源為 Anthropic 的發布公告Opus 4.7 模型頁定價文件生命週期文件Opus 5 遷移指南系統卡。獨立解讀為Vellum 基準說明

常見問題

Claude Opus 4.7 是什麼?

Claude Opus 4.7 是 Anthropic 在 2026 年 4 月發布的 Opus 版本,重點面向困難軟體工程、工具型 Agent 與高解析度視覺任務。模型頁列出 claude-opus-4-7、1M 上下文、128K 最大輸出與自適應思考。

Claude Opus 4.7 比 4.6 改了什麼?

Anthropic 回報編碼、工具呼叫、電腦操作與視覺推理提升,但公開表格的 BrowseComp 低於 4.6。新版 tokenizer 與 effort 也會改變任務成本,所以應用固定工作負載測試。

Claude Opus 4.7 多少錢?

目前 Claude Platform 列出的 API 價格是每百萬輸入 token 5 美元、輸出 token 25 美元,快取與 Batch 另計。API 價格不等於 Claude 訂閱、雲端供應商帳單或 Tabbit 可用性。

Claude Opus 4.7 還能使用嗎?

可以,實時模型頁標為 Active(legacy),並寫明最早不會早於 2027 年 4 月 16 日退休。Anthropic 同時建議考慮 Opus 5,因此新整合應先比較新路線。

應該從 Opus 4.7 遷移到 Opus 5 嗎?

先用固定驗收集測試,再檢查 thinking 預設值、max_tokens、回應區塊處理、工具迴圈、tokenizer 變化與安全 fallback。生產遷移不能只替換模型 ID。

可以在 Tabbit 測試 Claude Opus 4.7 嗎?

本文沒有執行登入後的 Tabbit Opus 4.7 任務,因此不確認選擇器、有效上下文、延遲、成本或工具權限。請在自己的即時帳戶檢查,並用一個可回滾任務驗證。

下一步

讓 Tabbit 與你並肩工作。

跨分頁調研、自動化重複的瀏覽器工作,讓每一處上下文都觸手可及。