Tabbit部落格

GPT-6 Astra 定價:API 費率、檔位與真實任務成本

GPT-6 Astra 定價全解:官方 API 費率表、Batch/Flex/Fast 檔位、272K 長上下文斷崖、ChatGPT 方案、三組算例與本機成本計算器。

本文目錄
  1. 重點速覽
  2. GPT-6 Astra 定價速覽
  3. 那個關鍵數字:同一張卡,單任務 0.82 到 3.26 美元
  4. 把「比 Sol 貴 2.5 倍」翻譯成人話
  5. 標題之外的計費線項
  6. 家族階梯:哪一行才是你的
  7. 費率卡不覆蓋的東西
  8. 方案可得性:API 分層與 ChatGPT 方案
  9. 兩組算例,假設全部擺明
  10. 一個實踐入口:在 Tabbit 裡跑比較
  11. GPT-6 Astra 定價決策表
  12. 最終裁決
  13. 來源

GPT-6 Astra 標準 API 檔的價格是每百萬輸入 token 10 美元、每百萬輸出 token 50 美元,快取命中 1 美元、快取寫入 12.50 美元——以上數字全部於 2026 年 9 月 22 日在 OpenAI 官方頁面核對。但這是費率卡,不是帳單:同一張卡上,Artificial Analysis 測得同一個基準任務在 low 推理強度下花 0.82 美元、在 max 下花 3.26 美元——一個價格都沒動,成本先擺了約 4 倍。

這兩個數字之間的落差就是本文存在的理由。Astra 發布時有位 Reddit 開發者說得很直接:「GPT-5.6 Sol:輸入 $4/M、輸出 $20/M。GPT-6 Astra:輸入 $10/M、輸出 $50/M。輸入輸出雙雙 2.5 倍漲價。」(r/codex 原帖,456 讚)。算術沒錯,但「貴還是便宜」的結論不能靠算術得出——推理強度、服務檔位、上下文長度與快取命中率,每一項對帳單的影響都超過換模型本身。文章後段會介紹 Tabbit Browser 作為算完帳之後比較模型路由的一個實踐入口;先看數字。

重點速覽

  • 標準費率:每百萬 token 輸入 10 美元、快取命中 1 美元、快取寫入 12.50 美元、輸出 50 美元;輸入超過 272K 後整個請求改按 20/2/25/75 美元計。

  • 同一張卡能差 4 倍。Batch 與 Flex 全線五折,Fast 模式全線兩倍;Artificial Analysis 在相同 token 價格下測得單一任務從 0.82 美元(low)到 3.26 美元(max)。

  • 2.5 倍溢價的基準是促銷價。Sol 的 4/20 美元被官方標註為促銷價、「至少延續到 2026 年 11 月 21 日」;上一代 GPT-5.5 的輸入價是 5 美元。

  • 訂閱是另一套經濟系統。ChatGPT Plus 月費 20 美元含有限 Astra;Pro 顯示 100 美元起。社群測得 Astra 在訂閱下的有效成本約為 API 價的 1.9 倍,快取保留約 30 分鐘。

  • 按任務形狀做預算,別按 token 單價。短問答由輸出主導;快取命中的 agent 迴圈由快取讀取主導;超過 272K 的一切都為長上下文溢價買單。

GPT-6 Astra 定價速覽

完整標準費率卡,2026 年 9 月 22 日取自 OpenAI API 定價頁GPT-6 Astra 總覽講它是什麼,這張表只講錢。

模型輸入 / 百萬快取命中 / 百萬快取寫入 / 百萬輸出 / 百萬
gpt-6-astra$10.00$1.00$12.50$50.00
gpt-5.6-sol$4.00$0.40$5.00$20.00
gpt-5.6-terra$2.00$0.20$2.50$12.00
gpt-5.6-luna$0.20$0.02$0.25$1.20
OpenAI 旗艦模型定價表,顯示 gpt-6-astra、gpt-5.6-sol、gpt-5.6-terra、gpt-5.6-luna 的標準與長上下文費率
2026 年 9 月 22 日 OpenAI 官網顯示的旗艦費率卡,短上下文與長上下文兩列並列。

這張表裡真正決定帳單的是三件事,沒有一件是標題裡的 10 美元:

  1. 輸出是輸入的 5 倍價。Astra 是推理模型,思考過程就是可計費的輸出 token。一個不長的提示詞配上很長的思維鏈,就是一張穿著輸入外衣的輸出帳單。

  2. 快取寫入比輸入還貴。12.50 美元是非快取價的 1.25 倍——定價頁明文寫了 1.25x 規則。只有前綴真的被複用時,快取才划算。

  3. 272K 斷崖作用於整個請求。輸入一過 272,000 token,整單請求——不只是超出部分——按輸入 20 美元、快取 2 美元、寫入 25 美元、輸出 75 美元計。105 萬的上下文視窗不等於 105 萬的標準價預算。

那個關鍵數字:同一張卡,單任務 0.82 到 3.26 美元

如果只記一個數字,記擺幅,不記費率。Artificial Analysis 把 GPT-6 Astra 按推理強度拆成五個條目追蹤,其「每個智慧指數任務的成本」(2026 年 9 月 22 日快照)如下:

推理強度智慧指數每任務成本輸出速度
low46$0.8255 t/s
medium50$1.5452 t/s
high51$1.7359 t/s
xhigh52$2.3155 t/s
max53$3.2667 t/s

把最外兩列放在一起讀:max 檔的單任務成本是 low 檔的 3.98 倍,換來的智慧指數差距是 7 分。同一快照裡 low 檔的首 token 延遲也最低(2.46 秒)。貴的檔位不等於穩妥的檔位,它只是在可計費 token 裡想得更久的檔位。

這對 agent 型工作的影響是雙倍的。Astra 最亮的公開成績——OpenAI 模擬中 OSWorld 2.0 單任務約 40 分鐘、Sol 約 75 分鐘——描述的恰是 effort 和重試不斷複利的工作負載:每輪迴圈重讀上下文,每一步吐出推理 token,一個「能一直跑」的模型也是一個「一直在計費」的模型。Hacker News 有使用者報告 15 則訊息燒完 ChatGPT 五小時額度(HN 討論);同樣的形狀放到 API 計費上,就是深度研究工作流堅持先定驗收標準再跑長迴圈的原因。預算要按完成的任務算,把失敗嘗試算進去,而不是按第一次嘗試算。

把「比 Sol 貴 2.5 倍」翻譯成人話

r/codex 帖子比較 GPT-5.6 Sol 的 4 美元輸入 20 美元輸出與 GPT-6 Astra 的 10 美元輸入 50 美元輸出
r/codex,2026 年 9 月:使用者最早回報的 2.5 倍漲價;社群原帖,非官方聲明。

2.5 倍這個數算得沒錯,但做預算前有兩個注意事項要放在它旁邊。

注意一:比較基準是促銷價。OpenAI 的 Sol 頁面註明「GPT-5.6 Sol 的促銷價至少延續到 2026 年 11 月 21 日」,其快速比較列顯示上一代 GPT-5.5 的輸入價為 5.00 美元。Sol 的這輪降價發生在 2026 年 7 月 30 日——Sam Altman 當天宣布 Luna 降 80%(至 0.20/1.20 美元)、Terra 降 20%(至 2/12 美元)、Sol 獲得按 2 倍價格換最高 2.5 倍速度的 Fast 模式(@sama)。如果 Sol 促銷到期,「2.5 倍溢價」會自己縮小,而 Astra 一分沒降。GPT-5.6 Sol 長上下文分析單獨追蹤這個家族。

注意二:單任務成本可能收斂。上面的原帖是對費率卡的價格衝擊,而 Artificial Analysis 測得 low 檔單任務 0.82 美元,說明帳單可以落到標價下方很遠;當能力省下重試時方向完全反轉:Sol 失敗兩次、Astra 一次完成的任務,即使按 2.5 倍費率也是 Astra 更便宜。你的任務屬於哪種,是經驗問題——用下面的算例回答,費率卡回答不了。

標題之外的計費線項

真正決定多數帳單的是四條線,而發布報導只提了第一條。

Batch 與 Flex:五折槓桿。兩者都按標準價的一半計費——輸入 5 美元、快取 0.50 美元、寫入 6.25 美元、輸出 25 美元。Batch 面向可以等幾小時的工作(API 暴露 v1/batch,佇列限額從 Tier 1 的 150 萬 token 到 Tier 5 的 150 億);Flex 是另一種低價容量模式,可用性取捨不同。評估批次、離線富集與一切非使用者面對的工作,這一個開關省下的錢超過任何提示詞優化。折扣不疊加:一次只選一個模式。

Fast 模式:兩倍加速器。按適用價率的兩倍計費——標準檔 20/100 美元,注意「適用」二字:Batch 任務開 Fast 是在 Batch 價上翻倍,不是回到標準價再翻。Priority processing 已於 2026 年 7 月 30 日更名為 Fast mode,service_tier: "priority""fast" 都還能用,舊程式碼要留意。

區域處理:加 10%。資料駐留端點對 2026 年 3 月 5 日之後發布且支援資料駐留的模型加收 10%——Astra 按發布日期符合條件。合規驅動的區域要為每一行多付一成。

272K 斷崖與快取時鐘。輸入超過 272K 後,長上下文一行(20/2/25/75 美元)作用於整單請求——沒有「只算超出部分」的算法。而本該給重複讀取降本的快取,社群回報它的保留時間很短:Codex 使用者觀察到 Astra 約 30 分鐘,而 Sol 與更早模型是 24 小時。

Reddit 留言回報 Astra 快取 TTL 為 30 分鐘或更短,而 GPT-5.6 Sol 為 24 小時
r/codex 留言:一位 Pro 20x 使用者比較快取保留時間;社群觀察,非 OpenAI 官方規格。

OpenAI 沒有公布 TTL 對照表,所以把 30 分鐘當作有兩個獨立來源的行為回報(原帖留言),不是承諾。如果你的迴圈在兩步之間睡得比這更久,1 美元的快取命中會悄悄變回 10 美元的冷讀加 12.50 美元的寫入。

工具呼叫在這一切之外:OpenAI 說明 web search 等工具型能力按每次呼叫收費,一個搜尋 40 次的 agent 身上還掛著第二隻計費器。

家族階梯:哪一行才是你的

階梯裡反直覺的一行是 Luna:比 Astra 的輸入便宜 50 倍,而且它是真實存在的產品行。官方模型目錄把 Luna 描述為面向成本敏感、大批量工作負載,OpenAI 自己的選型建議也是「除非工作難到需要旗艦,否則預設 Terra 或 Luna」。便宜的那一行不是玩具,它是路由目標——每一路由到 Luna 而不是 Astra 的 token,輸入側省 50 倍。

第二個反直覺發現來自家族之外。Astra 與 Anthropic 的 Fable 5.1 掛著完全相同的 10/50 美元——而真實成本朝相反方向走:

r/LLMDevs 帖子解釋 GPT-6 Astra 與 Fable 5.1 標價相同但真實成本不同
r/LLMDevs,2026 年 9 月:同標價、不同真實成本;社群分析,附方法說明。

發文者的算法:Astra 完成單一任務更省 token(其長單任務上「token 成本不到 Fable 5.1 的一半」),而 Fable 的快取讀取每百萬 0.25 美元,比 Astra 的 1.00 美元便宜 4 倍——所以「大快取上下文上的高頻呼叫」偏 Fable,「長單任務」偏 Astra。一位留言者在兩個模型上各跑了一週文件檢索管線,85% 快取命中率下 Fable 成本約為 Astra 的一半,「這個任務上表現基本一樣」:

Reddit 留言描述一週檢索管線在 85% 快取命中率下 Fable 成本約為 Astra 一半
r/LLMDevs 留言:一週、85% 命中、一半成本;單一管線報告,不是排名。

可遷移的結論不需要你選哪家的實驗室:費率卡只是成本函數裡最小的輸入。任務長度、快取命中率、輸出體量這些流量形狀才是主導。社群評測合集 (简体中文)保留了更多這類帶條件的報告。

費率卡不覆蓋的東西

  • 訂閱不是 API 信用。ChatGPT 方案給的是用量,按額度與時間窗計價——下一節會說明這些額度自成一套經濟系統。永遠不要拿 20 美元的方案除以 token 單價。

  • 失敗的嘗試照樣計費。發布週的一份報告記錄了一次 33 分鐘的 Codex 執行:成功請求之前,兩次逾時的嘗試已經消耗了額度(r/ChatGPT)。重試是成本線,不是免費的。

  • API 免費檔關閉。速率限制表把 Astra 標為 Free 檔不可用;付費從 Tier 1 起步,每分鐘 500 次請求、50 萬 token。

  • 稅費、工具與供應商加價另算。OpenRouter 市場頁顯示 Azure 與 OpenAI 都按 10/50/1 美元掛 Astra,但延遲畫像不同(今日快照中首 token P50 分別為 6.92 秒與 4.80 秒)——同價不同路由。Amazon Bedrock 商業區域官方聲明與 OpenAI 直連同價。

方案可得性:API 分層與 ChatGPT 方案

API 檔位RPMTPMBatch 佇列限額
Free不支援
Tier 1500500,000150 萬 token
Tier 25,0001,000,000300 萬 token
Tier 35,0002,000,0001 億 token
Tier 410,0004,000,0002 億 token
Tier 515,00040,000,000150 億 token

來源:OpenAI gpt-6-astra 模型頁,2026 年 9 月 22 日核對。檔位隨消費提升,發布週的天花板不是永久的。

消費端,ChatGPT 定價頁目前展示四檔:Free 0 美元(無限 GPT-5.6 Luna 文字聊天——無 Astra)、Go 每月 8 美元、Plus 每月 20 美元(含「GPT-6 Astra 與 GPT-5.6 的高級推理模型」,比較矩陣中 Astra 標為有限)、Pro 顯示「100 美元/月起」、5 倍用量、「由 GPT-6 Astra 提供支援的專業推理」。社群討論仍提到 200 美元的 Pro 檔,YouTube 影片簡介也同時列出「100 與 200 美元」兩檔——以即時頁面為準,目前顯示的是「起價」口徑。

訂閱經濟學值得單獨貼一張警示標籤,因為三項獨立的社群測量指向同一方向:

Reddit 帖子回報週度 API 等價額度從 Sol 的 2500 多美元降到 Astra 的約 1200 美元
r/codex:兩個 Pro 20x 帳號實測切換 Astra 後可比用量約為原來的四分之一;自述方法。

第一,額度數學:兩個 Pro 帳號上,週度 API 等價額度從 Sol 的 2500+ 美元降到 Astra 的約 1200 美元——且這個數字已經按 Astra 更高的單價折算——「同樣的訂閱費只換來大約四分之一的可比用量」。第二,有效價率:一位 Plus 訂閱者反推出在同一額度下 Astra 相對 Luna 的有效成本約為 API 價的 1.90 倍(實測用量 134.42 對 70.59 美元)。第三,燃燒體驗:

Reddit 帖子估算 Plus 訂閱下 Astra 的成本約為 API 定價的 1.90 倍
r/codex:訂閱對 API 的 1.90 倍估算及方法說明;作者歡迎指正。
Reddit 帖子:一位遊戲開發者稱 200 美元月訂閱的 token 不夠 Astra 的有意義使用
r/ChatGPT:一位 200 美元/月訂閱者談 Astra 的消耗速度;單一重度使用者,因負載而異。

「Astra 確實好用,但要做點有意義的事,200 美元一個月的訂閱給的 token 根本不夠」——這是一位遊戲開發者的總結,能力與抱怨在同一句話裡。如果你只是偶爾、有監督地用 Astra,Plus 可能夠;如果它是每日管線的引擎,帶 Batch 的 API 才是可預測的路線,訂閱是溢價互動路線。

兩組算例,假設全部擺明

使用標準短上下文費率,不含重試、工具與稅費。是算術演示,不是預測。

一個短問題,一段長思考。10,000 輸入 token、2,000 輸出 token:

(10,000 × $10 + 2,000 × $50) / 1,000,000 = $0.20

一次跨過斷崖的冷啟動 agent 迴圈。300,000 輸入 token——注意已經過了 272K,長上下文費率作用於全部——8,000 輸出 token:

(300,000 × $20 + 8,000 × $75) / 1,000,000 = $6.60

同樣的迴圈控制在 272K 以內(比如 260,000 token)是 4.00 美元。跨過那條線,這個形狀多付 65%。再看暖版本:同樣 300,000 token 上下文、90% 命中、每小時寫一次快取、8,000 輸出:

(270,000 × $2 + 30,000 × $20 + 8,000 × $75) / 1,000,000 = $1.68 + 寫入

本機計算

估算 GPT-6 Astra API token 成本

使用 2026-09-22 核對的官方美元費率。輸入值只在瀏覽器本機處理。

每次任務$0.20000
每月$0.20

快取寫入按輸入價的 1.25 倍計費。此估算不含重試、工具、稅費、10% 區域加價及供應商加價。輸入超過 272K 時自動將所有線項切換為長上下檔費率。 核對最新費率

計算器完全在本頁執行——不向任何地方傳送資料。它會自動套用 272K 長上下文切換、按所選服務檔計價、把快取寫入與命中分開。它刻意不建模的東西:重試、工具呼叫費、區域 10% 與快取時鐘——這些留在你的利潤率裡。承諾預算前請重新核對官方費率卡;本文數字截至 2026 年 9 月 22 日。

一個實踐入口:在 Tabbit 裡跑比較

預算之後是無聊的部分:真正跑 Astra 型工作,需要一個頁面、檔案與模型呼叫待在同一個地方的環境。這正是 Tabbit Browser 的位置——一個模型選擇器、即時頁面與本地檔案同處一個介面的 AI 瀏覽器,「先用 Astra 的 medium 檔試,不行退回 Luna」是一次選擇,而不是一個編排專案。

Tabbit Browser 新分頁的模型選擇器,顯示可用模型清單

邊界要說清楚:Tabbit 是用戶端,不是 OpenAI 的計費層。模型可得性取決於你的帳號與版本,瀏覽器裡的任何操作都不改變 OpenAI 收什麼錢——上面的費率卡在哪兒跑 Astra 都適用。瀏覽器改變的是搭建成本:GPT-6 Astra 資源頁 (简体中文)與它的提示詞合集 (简体中文)描述了可以對著選擇器直接跑的可重現任務,這是弄清你的負載到底需要哪個強度檔的最便宜方式——不用寫一行編排程式碼。

Tabbit Browser

如果工作重點是瀏覽器級自動化而不是對話,agentic 瀏覽器總覽什麼是 agentic 瀏覽器瀏覽器自動化指南覆蓋那條工作流;AI 瀏覽器指南是一般性起點。

GPT-6 Astra 定價決策表

你的工作負載成本驅動最佳起步路徑當心什麼
互動式聊天、短回答輸出 tokenAPI 低/中強度,或 Plus$50/M 輸出主導,是輸入價的 5 倍
過夜評估或富集體量Batch 五折分檔佇列限額,結果按小時計
272K 以內的長 agent 迴圈快取讀取與寫入標準檔 + 穩定前綴快取社群回報約 30 分鐘快取保留
超過 272K 的上下文斷崖重構壓到線下,或按 20/75 預算整單重新計價,不是只算超出部分
延遲敏感的生產流量Fast 模式最低夠用強度上開 Fast(2x)強度選擇對成本的影響大於檔位
每日重度消費端使用訂閱額度Pro(100 美元起)或 API+Batch社群回報額度消耗比 Sol 快約 4 倍

最終裁決

GPT-6 Astra 按「難活兒的原料」定價,也按這個方式出帳單。當任務長程、重工具、人工盯守成本高時買它——然後小心地買:能等的工作全走 Batch,強度從 low 起步直到驗收測試說不行,上下文工程化壓到 272K 以下,快取友好的前綴對著 30 分鐘的時鐘測算。不需要旗艦能力的體量留給 Luna 或 Terra——家族階梯存在的意義,就是讓旗艦成為一個路由決策而不是預設值。

如果 Astra 是你 API 上的日常引擎,按「完成的任務」做預算(含重試與工具費),並每月複查官方定價頁——Sol 的促銷基準掛著 11 月 21 日的日期,整條階梯都可能移動。專門的替代品比較還在準備中;在它上線前,模型資源頁 (简体中文)總覽與上文引用的社群記錄就是溯源路徑。

來源

常見問題

GPT-6 Astra 多少錢?

2026 年 9 月 22 日在 OpenAI 官方頁面核對的標準 API 費率為:每百萬輸入 token 10 美元、快取命中 1 美元、快取寫入 12.50 美元、輸出 50 美元。輸入超過 272K 的請求整單改按長上下文費率計費(輸入 20 美元、快取 2 美元、寫入 25 美元、輸出 75 美元)。Batch 與 Flex 按標準價五折計費,Fast 模式按兩倍計費,資料駐留區域端點另加 10%。

GPT-6 Astra 有免費額度嗎?

API 免費檔不支援。OpenAI 對 gpt-6-astra 的速率限制表把 Free 檔標為不可用,付費存取從 Tier 1 開始。消費端方面,ChatGPT 免費版提供無限的 GPT-5.6 Luna 文字聊天但沒有 Astra;Plus 含有限的 Astra 存取,Pro 檔官方描述為由 GPT-6 Astra 提供支援。

為什麼 GPT-6 Astra 比 GPT-5.6 Sol 貴 2.5 倍?

OpenAI 把 Astra 定位為處理推理、編碼、computer use 與研究等最難端到端工作的模型,因此按 10/50 美元對 Sol 的 4/20 美元定價。需要注意 Sol 目前費率是促銷價,官方標註至少延續到 2026 年 11 月 21 日,比較基準本身可能變化。當 Astra 能以更少的重試完成任務時,每個任務的實際成本會向 Sol 靠攏。

為了用 GPT-6 Astra,ChatGPT Pro 值得買嗎?

取決於工作負載。Pro 頁面顯示月費 100 美元起、5 倍用量、Astra 驅動的專業推理;但社群實測報告週度 API 等價額度從 Sol 的約 2500 美元降到 Astra 的約 1200 美元、快取保留約 30 分鐘,重度使用者很快燒完額度。如果你的任務是長程 agent 型,建議仔細核算預算,或在延遲允許時走 API 的 Batch 檔。

跑 GPT-6 Astra 最省錢的方式是什麼?

組合使用幾個槓桿:非緊急工作走 Batch 或 Flex(標準價五折);先用 low 或 medium 推理強度,驗收測試不通過再升級;把輸入控制在 272K 以下避免長上下文費率;快取穩定前綴,讓重複讀取按每百萬 1 美元而不是 10 美元計費。

GPT-6 Astra 的 API 價格包含工具呼叫嗎?

不包含。公布的 token 費率只涵蓋文字輸入與輸出。OpenAI 說明 web search、computer use 等工具型能力按每次呼叫另行收費,與 token 定價分開計費,所以重工具的 agent 需要在預算裡單獨列一條。

下一步

讓 Tabbit 與你並肩工作。

跨分頁調研、自動化重複的瀏覽器工作,讓每一處上下文都觸手可及。