Tabbit
活动资源博客模型
Tabbit LogoTabbit

Tabbit — 为你工作的 AI 浏览器

主题资源

  • AI Browser Resources
  • Agentic Browser Resources
  • Browser Downloads and Install Guides
  • Browser Comparisons
  • AI Browser Alternatives
  • Browser Productivity Resources

热门指南

  • AI Browser
  • Agentic Browser Download
  • Best AI Browser 2026: Top 9 Tested & Ranked
  • AI Browser Download
  • Free AI Browser
  • Best AI Browser 2026
  • AI Browser Comparison 2026
  • AI Browser for Windows
  • AI Browser for Mac
  • Chrome Alternative 2026

活动

  • 别装了,你在《牛来》里早有原型
  • Tabbit 妙招大赛
  • KPOP SBTI 饭圈人格测试
  • Tabbit 校园共创者计划
  • fifi 的论文文献妙招精选
  • 用户问卷

关于

  • Tabbit 博客
  • 媒体报道
简体中文
简体中文English
测评与证据

GPT-5.6 Luna · 社区来源 · 个人体验

GPT-5.6 Luna Reddit Codex 额度与缓存成本实测

这条证据围绕“GPT-5.6 Luna Reddit Codex 额度与缓存成本实测”记录特定条件下的观察;版本、样本与运行环境不能外推为统一排名或当前生产保证。

待验证:本次未能重新核实原文。下方历史数字不代表已核实的当前结果。

社区来源个人体验编辑日期 2026-09-20

测试条件速查

模型与版本
GPT-5.6 Luna;不与其他版本、推理档位或不同 harness 的结果混并。
提供商/环境
Reddit r/codex;原始测试条件未形成统一受控复测。
采集边界
来源笔记采集于 2026-08-17/18;本轮未重新打开原始页面,动态事实保持 unverified。

关键数据与适用场景

一句话结论

一条 Luna-only Codex Plus 会话用 3.52M 未缓存输入、73.79M 缓存输入和 205K 输出计算出约 $2.43 的 API 等价成本,却消耗约 16–17% 周额度,说明订阅额度权重与公开 API 价格不能直接画等号。

测试环境

  • 客户端:Codex,ChatGPT Plus。

  • 模型:该评论者称只使用 GPT-5.6 Luna;具体 reasoning effort 未公开。

  • 日期:2026-08-01。

  • 任务:一个 Codex 会话;原帖正文已删除,任务类型和完整工具轨迹不可见。

  • 数据来源:评论者从账户/会话统计中抄录 input、cached input、output 和总处理 token,并按当时 API 价格计算。

输入/配置

公开账本没有 prompt、代码库、任务成功判定、工具版本、缓存 TTL、模型快照或完整日志。它能复核算术,不能复核任务质量或缓存是否由同一前缀命中。

结果数据

评论账本原样给出的数量:

项目数值
Input3.52M tokens
Cached input73.79M tokens
Output205K tokens
Total processed77.51M tokens
未缓存输入成本3.517111M × $0.20 = $0.70
缓存输入成本73.789952M × $0.02 = $1.48
输出成本0.205448M × $1.20 = $0.25
API-equivalent session cost约 $2.43
Plus 周额度消耗约 16–17%
按此比例估算的周 API 等价值约 $14.27–$15.16

同一讨论还包含相反的个人体验:有人称 Luna high 两小时只消耗约 1%,也有人称 Luna xhigh 一个普通任务消耗 15%;有用户指出明确的 implementation plan、窄任务和 blocking conditions 能减少反复,有用户遇到 Luna 子代理实际被路由成 Sol high。

结论

  • 公开 API 的 $0.20/$0.02/$1.20 价格只能解释 API 等价账本,不能解释 ChatGPT Plus/Codex 的周额度扣减逻辑。

  • Luna 的总成本取决于缓存命中、上下文重读、推理档位、自动 compact、子代理和来回修复;每 prompt 的价格不是最终结果成本。

  • 对 Codex 使用者,先给出详细 goal、implementation plan、明确 stop/blocking 条件,并把大任务拆成一个可验证的 bug/feature,有助于控制 Luna 反复循环。

局限

  • 原帖已删除,任务上下文、成功标准和完整截图不可见;关键数字只有单个评论者的自报。

  • 周额度的换算规则、缓存计费和模型权重可能已变更;API 等价成本不是账单。

  • 多位评论者的体验冲突明显,说明项目大小、推理档位、是否使用子代理和 Codex 账户计划都是混杂因素。

  • 这不是控制变量 benchmark,也没有 Sol/Terra 的同任务对照;不能据此断言 Luna 的普遍成本或质量。

复现步骤

  1. 固定 ChatGPT/Codex 计划、Luna 模型与 reasoning effort,记录模型快照和客户端版本。

  2. 选一个可回滚、可测试的任务,保存 prompt、代码库规模、工具调用、自动 compact 次数和子代理实际模型。

  3. 会话结束时抄录未缓存 input、cached input、output、total processed 与账户周额度变化。

  4. 按当日官方 API 价格分别计算未缓存、缓存和输出成本,再与实际额度扣减并列,不把两者相加。

  5. 至少重复 5 个窄任务和 5 个开放任务,报告每个可接受结果的成本、耗时、返工和升级到 Sol/Terra 的次数。

来源摘录或观察(仅做合规短引)

评论者提醒 “You shouldn’t measure it per prompt or per task, but by the final result.” 这正是本账本的适用边界。

能支持的判断

  • 账本帖记录 Luna-only Plus 约 3.52M 未缓存输入、73.79M 缓存输入、205K 输出、约 $2.43 API 等值和 16–17% 周额度。

不能支持的判断

  • 原帖已删除,努力档位、提示、缓存 TTL、版本和成功率未知,不能反推质量、效率或普遍配额。

方法、局限和复现

本文中的数字、任务集、推理档位和客户端条件只在所列来源及采集时点内成立。不同版本、不同 harness 或不同提供商的数据不能直接并排比较;未公开的参数保持未知。

需要复测时,请固定模型版本、提供商或客户端、推理档位、工具、任务集版本、样本数和采集日期,并记录失败、重试与人工修正。完整方法和复现步骤见下方来源笔记。

原始来源

Reddit r/codex · 原帖已删除;关键账本由评论用户 IcyNeedleworker507 发布,其他评论提供对照体验 · 原文发布日期 2026-08-01 · 本站编辑日期 2026-09-20

打开原始来源

GPT-5.6 Luna

在 Tabbit 中比较 GPT-5.6 Luna

下载 Tabbit 客户端后检查模型可用性

相关评测

Agents on Rails:8 个模型、21 项原子任务这条证据围绕“Agents on Rails:8 个模型、21 项原子任务”记录特定条件下的观察;版本、样本与运行环境不能外推为统一排名或当前生产保证。GPT-5.6 Luna:Codex 用户认为它被低估了这条证据围绕“GPT-5.6 Luna is really underrated:Codex 用户体验”记录特定条件下的观察;版本、样本与运行环境不能外推为统一排名或当前生产保证。GPT-5.6 Luna:使用 48 小时后的体验这条证据围绕“GPT-5.6 Luna:Thoughts after using GPT-5.6 Luna for 48 hours”记录特定条件下的观察;版本、样本与运行环境不能外推为统一排名或当前生产保证。GPT-5.6 Luna:Extra High 是我需要的主力模型这条证据围绕“GPT-5.6 Luna:5.6 Luna Extra High is the work horse I needed”记录特定条件下的观察;版本、样本与运行环境不能外推为统一排名或当前生产保证。Apply Occam’s Razor:减少 Luna/Codex 过度设计的提示词把“Apply Occam’s Razor:减少 Luna/Codex 过度设计的提示词”整理为可执行的任务入口,明确输入、运行环境、交付格式和验收边界;使用前确认模型版本与来源限制。Reddit Codex:解决 Luna 子代理兼容性的诊断与验证提示词把“Reddit Codex:解决 Luna 子代理兼容性的诊断与验证提示词”整理为可执行的任务入口,明确输入、运行环境、交付格式和验收边界;使用前确认模型版本与来源限制。Reddit Codex:Luna 子代理与 Sol 审查的多模型路由配置这不是官方配置,而是 Codex 用户分享的个人路由方案:把 Luna 用于普通实现、头脑风暴和子代理,把 Sol high 用于计划审查和最终判断,把快速模型用于测试执行。它把“便宜模型做高频工作、强模型做质量闸门”落成可执行配置。Use cheap Luna to orchestrate threads:用线程而非同模型子代理作者建议使用 Luna 作为线程编排器,让不同线程按任务选择 Sol、Terra 或 Luna,而不是让 Sol Ultra 自动生成一批同样昂贵的子代理。原文提示很短,核心是:use the right model for the task,让模型根据规划、实现和文档研究分别路由。