Tabbit部落格

如何在 Tabbit 中使用 Claude Sonnet 5.5:實用工作流程

用明確的任務範圍、證據規則和複核步驟,在 Tabbit 中測試 Claude Sonnet 5.5,並附上可調整的提示詞。

本文目錄
  1. 在 Tabbit 中開始
  2. 用於來源整理的提示詞
  3. 什麼時候選擇 Sonnet 5.5
  4. 讓 effort 檔位與任務匹配
  5. 來源

Claude Sonnet 5.5 適合有明確完成條件的工作:修正錯誤、把來源整理成簡報,或按照模板產生文件。Anthropic 9 月 28 日的發布頁表示,它比 Sonnet 5 輸出更快、每項完成任務的成本更低,同時維持每百萬 token $2 的輸入價格和 $10 的輸出價格。10 月 7 日,Anthropic 將 Sonnet 5.5 的快取讀取價格降至每百萬 token $0.10。這些是 API 價格和供應商報告的任務結果,不代表 Tabbit 訂閱方案的承諾。

在 Tabbit 中開始

  1. 開啟 Tabbit,在你的帳號模型選擇器中查看是否有 Claude Sonnet 5.5。模型頁 (简体中文)介紹模型,但不代表每個帳號都能使用。

  2. 開啟要處理的頁面或檔案。交給模型一個具體任務、指定輸出格式,以及引用證據的規則。

  3. 對照來源頁面或檔案複核結果。程式碼修改要執行專案測試並檢查差異;文件則要核對每個數字、引文和缺漏章節。

  4. 只有在需要比較品質、延遲或成本時,才用不同模型重做相同任務。

用於來源整理的提示詞

開啟來源材料後,將方括號欄位替換成你的需求:

任務:[一項具體交付物]。
只使用我提供的頁面或檔案作為證據。如果其中沒有支持某項主張的內容,請標記為「未核實」,不要猜測。
輸出:[格式和長度]。
每個重要事實都附上來源標題,以及確切的章節或連結。
完成前,按照以下驗收條件檢查輸出:[三項檢查]。
只有缺少的輸入會阻止任務完成時才提問;否則寫明合理假設並繼續。

這是 Tabbit 編輯用的任務模板,不是 Anthropic 發布的提示詞。它的目的在於讓輸出便於檢查。如果任務會用到私有材料,加入任何 AI 工具前,先決定哪些內容適合分享。

什麼時候選擇 Sonnet 5.5

任務首輪做法複核條件
有可重現失敗的錯誤修正提供失敗行為、受影響檔案和測試命令執行測試並檢查無關修改
從開啟的頁面製作研究簡報說明讀者、篇幅和引用格式開啟每個引用來源
投影片或試算表初稿提供模板和必填欄位核對公式、數字和版面
開放式架構決策將 Sonnet 草稿與 Opus 5.5 或人工審查比較記錄取捨和未解決風險

供應商公布 Sonnet 5.5 在 Terminal-Bench 4.0 的成績為 70.6%,在 CursorBench 4.0 為 55.5%,但這些分數與其測評設定綁定,不能代表你在 Tabbit 中的工作流程。Anthropic 表示,Opus 5.5 在需要持續判斷的複雜開放式工作上仍然更強。發布頁還提到,兩項外部知識工作基準使用的預發布部署曾有結構化輸出錯誤,之後已修正。詳情和限制見逐來源測評 (简体中文)。

想做更接近的比較,可以查看 Sonnet 5.5 提示詞集合 (简体中文)、Opus 5.5 模型頁 (简体中文)和 Haiku 5.5 模型頁 (简体中文)。上一代 Sonnet 指南介紹舊版模型;Opus 5.5 測評涵蓋適合更大模型的工作;Haiku 5.5 Tabbit 指南則介紹短而可重複的任務。

讓 effort 檔位與任務匹配

Anthropic 表示,Claude 應用程式和 Claude Code 預設使用 Medium effort,Claude Platform 預設使用 High。日常工作可以先比較較低 effort 的結果和耗時。如果 Tabbit 模型介面提供 effort 控制項,請在相同任務上比較不同設定並檢查完成結果。不要假定 Anthropic API 中的設定在每個客戶端都可用。

Tabbit Browser

來源

常見問題

可以在 Tabbit 中使用 Claude Sonnet 5.5 嗎?

請查看你目前 Tabbit 帳號的模型選擇器。可用性可能因帳號和分批發布而異。如果看到 Sonnet 5.5,先選取它並用小型測試任務驗證,再用於較大的工作流程。

Claude Sonnet 5.5 最適合什麼?

Anthropic 將它定位為適合邊界清晰的日常任務、修正錯誤,以及製作文件、投影片和試算表。需要持續判斷的開放式工作,仍值得與 Opus 5.5 比較。

Sonnet 5.5 比 Sonnet 5 便宜嗎?

API 輸入和輸出 token 價格相同。Anthropic 表示 Sonnet 5.5 每項完成任務使用的 token 更少,而且 10 月 7 日將快取讀取價格降至每百萬 token $0.10。請以自己的完成任務成本衡量。

應該使用哪個 effort 檔位?

先使用客戶端提供的 effort 檔位,測試一個有代表性的任務。Anthropic 的 Claude 應用程式和 Claude Code 預設為 Medium,Platform 預設為 High;Tabbit 可能提供不同的控制項。

基準分數能保證我的結果嗎?

不能。公開分數使用特定任務、工具和 effort 設定。請先跑一個小任務,並對照來源材料或專案測試驗證輸出。

下一步

讓 Tabbit 與你並肩工作。

跨分頁調研、自動化重複的瀏覽器工作,讓每一處上下文都觸手可及。