Tabbit部落格

GPT-5.4 是什麼:變化、取得方式與使用邊界

以官方與獨立來源說明 GPT-5.4 的電腦操作、專業工作、工具搜尋、上下文與計費邊界、存取入口和實際風險。

本文目錄
  1. 關鍵結論
  2. 規格與變化
  3. 取得方式與場景驗證
  4. 社群訊號與 Tabbit 邊界
  5. 安全、未知與結論
  6. 來源與常見問題
  7. GPT-5.4 在 ChatGPT、Codex 和 API 中相同嗎?
  8. API 真的支援 1.05M 上下文嗎?
  9. 應選哪個 reasoning effort?
  10. 原生電腦操作是否代表安全?
  11. 工具搜尋一定會降低帳單嗎?
  12. 可以在 Tabbit 使用 GPT-5.4 嗎?

GPT-5.4 是 OpenAI 於 2026 年 3 月發布的前沿模型,面向專業工作、編碼、工具呼叫與電腦操作代理。它適合試驗跨檔案、應用程式與網站的工作流程,但存取入口與計費細節和模型名稱同樣重要。

截至 2026 年 9 月 20 日,API 頁面列出 1,050,000 token 上下文;輸入超過 272K 時,完整請求按輸入 2 倍、輸出 1.5 倍計價。這是 API 規則,不代表 ChatGPT、Codex、雲端提供商或 Tabbit 都提供相同的有效上下文。先看 GPT-5.4 模型資源 (简体中文),再確認實際產品和帳戶。

關鍵結論

  • GPT-5.4 將 GPT-5.3-Codex 編碼能力帶入通用模型,並加入專業工作和原生電腦操作。

  • API 列出 gpt-5.4、1,050,000 上下文、128,000 最大輸出,以及 none 到 xhigh 的 reasoning effort。

  • OpenAI 報告 OSWorld-Verified 75.0%、WebArena-Verified 67.3%、Online-Mind2Web 92.8%,工具搜尋在 250 個 MCP Atlas 任務中減少 47% token。

  • API 價格為輸入 $2.50、快取輸入 $0.25、輸出 $15 / 百萬 token;超過 272K 會改變完整請求倍率,訂閱額度另計。

  • 原生電腦操作擴大動作能力,不會自動解決權限、確認和安全責任。

規格與變化

項目API 快照邊界
API IDgpt-5.4日誌固定完整 ID;ChatGPT 和 Codex 是不同入口。
上下文 / 最大輸出1,050,000 / 128,000 tokenAPI 上限,客戶端可能更小。
推理強度none、low、medium、high、xhighUI 或方案可能只開放部分檔位。
API 價格$2.50 輸入、$0.25 快取、$15 輸出 / MTok工具、Batch/Flex 和 Priority 另計。
長輸入規則>272K:輸入 2 倍、輸出 1.5 倍這是計費規則,不是訂閱規則。
知識截止API 頁列 2025-08-31最新事實仍需檢索。

OpenAI 描述三個實務變化:API 和 Codex 可透過截圖、滑鼠鍵盤執行電腦任務;工具搜尋可按需載入 MCP 定義;ChatGPT Thinking 可先給計畫並在執行中接受指示。Fast mode 是同一模型的速度路線,不是新模型。

OpenAI 的 GDPval、SWE-Bench Pro、OSWorld-Verified 和 MCP Atlas 使用不同 effort、工具和研究環境,不能拼成一個總分。獨立的 Reddit、ORCFLO 和 LayerLens 測試也有各自的樣本和評審方法。可參考GPT-5.4 提示資源 (简体中文)評測資源 (简体中文)智能體推理指南

取得方式與場景驗證

API 的 $2.50 / $0.25 / $15 價格、超過 272K 的倍率、ChatGPT 方案額度和 Codex 配額是不同概念。雲端提供商可能使用別名、不同區域和工具政策;Tabbit 是否顯示模型則必須在登入後的即時選擇器確認。

先用可回復任務測試:瀏覽器流程要核對點擊、確認與日誌;多檔案編碼要核對測試與 diff;表格要核對公式與預期儲存格;MCP 任務要比較工具搜尋和短工具清單的結果。記錄模型 ID、入口、effort、上下文、工具、token、延遲、重試和人工修正。可用GPT-5.6 Terra 總覽GPT-5.6 Sol 總覽Sol 1M 指南作為較新的家族對照。

社群訊號與 Tabbit 邊界

Reddit 的早期回報稱 5.4 比 5.3-Codex 更快,也有人在大型重構中讓 5.4 high 執行計畫、再由 5.3-Codex 審查;另一個 16 個 worktree 的實驗則提醒程式碼評審由 Claude Opus 完成,摘要品質仍帶主觀性。也有使用者認為模型需要更嚴格的計畫。這些是特定客戶端、任務和樣本的觀察,不是普遍成功率。AI 瀏覽器指南有助於分開模型能力與客戶端權限。

本文沒有用已登入的 Tabbit Browser 實測 GPT-5.4,因此不宣稱選擇器可見性、有效上下文、延遲、提供商路由、訂閱額度、工具權限或費用。若即時選擇器出現模型,先做公開且可回復的小任務,再和固定驗收條件比較。

Tabbit Browser

安全、未知與結論

OpenAI 將 GPT-5.4 視為 Preparedness Framework 下的 High cyber capability,並在部分 Zero Data Retention 場景使用監控、可信控制和非同步封鎖。原生電腦操作可按鍵、輸入和導覽,但不可逆動作仍需確認、權限範圍、日誌、測試和人工核准。1M 上下文也不等於 1M 品質保證,工具搜尋還會引入工具發現和伺服器失敗路徑。

結論是:GPT-5.4 值得先用於專業文件、編碼代理和電腦操作工作流程。真正的分界在模型上限與產品現實之間,尤其是 >272K API 倍率、入口上下文、工具權限和訂閱額度。固定入口與 effort,先跑可回復 fixture,再分開量度接受結果、token 成本、重試、延遲和人工修正。另可查看Tabbit Browser 總覽,但它不會授予 API 額度。

來源與常見問題

主要來源是 OpenAI 的GPT-5.4 發布公告API 模型頁部署安全資料。獨立來源包括 LayerLensORCFLOTom's Guide

GPT-5.4 在 ChatGPT、Codex 和 API 中相同嗎?

不相同。API ID 是 gpt-5.4,ChatGPT 顯示 GPT-5.4 Thinking,Codex 還有自己的上下文、effort、額度與工具控制。請確認即時入口。

API 真的支援 1.05M 上下文嗎?

API 模型頁列出 1,050,000 token,但這是模型上限。客戶端可能更早壓縮,而輸入超過 272K 會套用完整請求倍率。

應選哪個 reasoning effort?

從能通過驗收的最低檔位開始。更高 effort 可能改善難題,但也可能增加 token、時間和配額使用。

原生電腦操作是否代表安全?

不是。它擴大可用動作,仍需確認策略、權限、日誌、測試和人工批准。

工具搜尋一定會降低帳單嗎?

OpenAI 在一個 250 任務 MCP Atlas 設定中報告 token 減少 47%;你的工具定義、伺服器延遲、失敗和入口可能不同。

可以在 Tabbit 使用 GPT-5.4 嗎?

本文沒有驗證已登入 Tabbit 工作階段。請查看即時選擇器,並把一次成功任務視為本地觀察,而非平台保證。

常見問題

GPT-5.4 是什麼?

GPT-5.4 是 OpenAI 於 2026 年 3 月發布的前沿模型,面向專業工作、編碼、工具呼叫與電腦操作代理。API ID 是 gpt-5.4,也以 GPT-5.4 Thinking 進入 ChatGPT 與 Codex。

GPT-5.4 的上下文與輸出上限是多少?

API 模型頁列出 1,050,000 token 上下文與 128,000 token 最大輸出。客戶端、方案或提供商可能提供更小的有效視窗,超過 272K 輸入也會套用不同價格倍率。

GPT-5.4 如何計費?

API 價格是每百萬 token 輸入 2.50 美元、快取輸入 0.25 美元、輸出 15 美元。超過 272K 輸入的完整請求按輸入 2 倍、輸出 1.5 倍計價。

GPT-5.4 改變了什麼?

OpenAI 把 GPT-5.3-Codex 編碼能力與專業知識工作、原生電腦操作、工具搜尋、改良網頁搜尋和可調整思考結合。

在哪裡可以使用 GPT-5.4?

OpenAI 列出 API、ChatGPT Thinking 與 Codex,但實際入口仍取決於模型 ID、地區、組織、方案、應用程式版本和工具權限。

可以在 Tabbit Browser 使用 GPT-5.4 嗎?

本文沒有使用已登入的 Tabbit 帳戶實測 GPT-5.4,因此不宣稱選擇器、有效上下文、延遲、費用或工具。請查看即時選擇器並驗證可回復的小任務。

下一步

讓 Tabbit 與你並肩工作。

跨分頁調研、自動化重複的瀏覽器工作,讓每一處上下文都觸手可及。