Tabbit
活动资源博客模型
Tabbit LogoTabbit

Tabbit — 为你工作的 AI 浏览器

主题资源

  • AI Browser Resources
  • Agentic Browser Resources
  • Browser Downloads and Install Guides
  • Browser Comparisons
  • AI Browser Alternatives
  • Browser Productivity Resources

热门指南

  • AI Browser
  • Agentic Browser Download
  • Best AI Browser 2026: Top 9 Tested & Ranked
  • AI Browser Download
  • Free AI Browser
  • Best AI Browser 2026
  • AI Browser Comparison 2026
  • AI Browser for Windows
  • AI Browser for Mac
  • Chrome Alternative 2026

活动

  • 别装了,你在《牛来》里早有原型
  • Tabbit 妙招大赛
  • KPOP SBTI 饭圈人格测试
  • Tabbit 校园共创者计划
  • fifi 的论文文献妙招精选
  • 用户问卷

关于

  • Tabbit 博客
  • 媒体报道
简体中文
简体中文English
测评与证据

Grok 4.7 · 社区来源 · 编辑分析

Cursor Ultra 同一任务下 Grok 4.7 与 4.6 的用量消耗

在 Cursor Ultra、extra high、关闭 fast mode 的条件下,作者用同一任务的套餐用量下降速度,估计 Grok 4.7 大约是 Grok 4.6 的 2.5 倍消耗;这是单账号的短时计时,不能当成质量基准。

社区来源编辑分析编辑日期 2026-09-22

测试条件速查

来源具体观察
在 Cursor Ultra、extra high、关闭 fast mode 的条件下,作者用同一任务的套餐用量下降速度,估计 Grok 4.7 大约是 Grok 4.6 的 2.5 倍消耗;这是单账号的短时计时,不能当成质量基准。
已公布条件
代码是否做对、回答质量、官方 API 美元账单、fast mode、其他推理档位、其他客户端,以及作者没有写出的那项任务以外的工作。

关键数据与适用场景

一句话结论

在 Cursor Ultra、extra high、关闭 fast mode 的条件下,作者用同一任务的套餐用量下降速度,估计 Grok 4.7 大约是 Grok 4.6 的 2.5 倍消耗;这是单账号的短时计时,不能当成质量基准。

适用场景

  • 适合判断的任务:同一 Cursor Ultra 账号里,extra high 且未开 fast mode 时,Grok 4.7 相对 Grok 4.6 打掉套餐百分比的速度。

  • 不适合外推的任务:代码是否做对、回答质量、官方 API 美元账单、fast mode、其他推理档位、其他客户端,以及作者没有写出的那项任务以外的工作。

  • 适用的模型版本:正文中的 Grok 4.7 与 Grok 4.6。附图里的点写的是 Grok Build 的 Grok 4.6 (xhigh) 与 Grok 4.7 (xhigh),和 Cursor 用量是两条不同的测量。

  • 测试环境或客户端:Cursor Ultra。仓库、任务正文和客户端版本未注明。

  • 推理档位和参数:extra high effort,两版都未开 fast mode。温度及其他采样参数未注明。

测评方法

作者写自己用同一项任务连续跑了两天,并在发帖约 3 小时前、中欧时间 22:00 从 Grok 4.6 换成 Grok 4.7。比较的是 Cursor 用量每下降 1 个百分点所经过的时间。帖子另附一张 Artificial Analysis 散点图,作者用图上的平均单任务美元成本,给自己的 2.5 倍判断作对照。帖子没有给出任务输入、输出或评分规则。

关键结果

作者写下的间隔是:

  • Grok 4.7:82%→81% 为 34 分钟;81%→80% 为 55 分钟,若计入中间 15 分钟休息则为 71 分钟;80%→79% 为 38 分钟。

  • Grok 4.6:作者称是当天更早的同一任务,85%→84% 为 133 分钟,84%→83% 为 101 分钟。

按作者这两组数字,去掉休息后 4.6 的平均间隔约 117 分钟,4.7 约 42 分钟,比值约 2.8;若 4.7 中间那段按 71 分钟墙钟计算,比值约 2.5。作者把结果概括为大约 2.5 倍,并认为相对大约 10% 的基准提升来说差得过大,多数任务会改回 4.6。

用量图上的时钟和 4.7 的 34 分钟、71 分钟、38 分钟,以及 4.6 的 101 分钟能够对上。85%(17:52)到 84%(19:35)的可见间隔约 103 分钟,与正文里的 133 分钟不一致;更接近 133 分钟的是 86%(15:41)到 85%(17:52),约 131 分钟。

作者还写道,图中 Grok 4.7 平均单任务成本为 $8.82,Grok 4.6 为 $3.53,二者之比也是 2.5 倍。这组美元数字来自作者对附图的转述。

原始数据

正文短引:“Both 4.7 and 4.6 were used on extra high effort and both not on fast mode.” 以及 “Grok 4.7 is about 2.5 times as expensive as 4.6”。

第一张图是深色用量记录。浮层从 88%(01:09)列到 79%(00:50),末行写着 gem. 63 min / 1%。相邻时钟差约为:88%→87% 6 分钟,87%→86% 14 小时 26 分钟,86%→85% 131 分钟,85%→84% 103 分钟,84%→83% 101 分钟,83%→82% 71 分钟,82%→81% 34 分钟,81%→80% 71 分钟,80%→79% 38 分钟。87% 到 86% 的长间隔说明这张表含有空档,63 min / 1% 是混合平均。浮层挡住了后面表格的一部分。背景能看到 Grok、Codex、Claude 和 Cursor 等行,以及荷兰语日期 Woensdag 23-09、Donderdag 24-09、Zaterdag 26-09,底部 Cursor 行还有 Zaterdag 17-10 00:18。这些日期与发帖时间 2026-09-21 对不齐,图上也没有标出哪一段属于 4.7。采集时页面上的 Cursor 条显示剩余 79%。

第二张图标题为 “Artificial Analysis Coding Agent Index vs. Cost per Task”,副标题写明横轴是平均按 token 计费的单任务 API 成本(美元),纵轴是 Coding Agent Index。图上可辨认的两个 Grok 标签是 Grok Build - Grok 4.6 (xhigh) (SpaceXAI) 和 Grok Build - Grok 4.7 (xhigh) (SpaceXAI)。4.7 的点比 4.6 更高,也更靠右。$8.82 与 $3.53 没有直接印在坐标刻度上。同图还有其他实验室的点,这里不把它们改写成名次。

采集时帖子约 29 分,4 条评论,标签为 Question / Discussion。评论大意:

  • KeenAsGreen 称它仍是 “meme llm”,没有任务或数据。

  • truecakesnake 认为这次发布很差,基准已经说明不了问题,价格则明显过高。

  • Vegetable-Piano-5313 觉得标准档 Grok 4.7 的成本大致相当于 Grok 4.6 的 fast mode。

  • Dynamix86 回复短引:“25% more expensive than 4.6 fast mode even.” 这条没有附上 fast mode 的计时。

结论与边界

可用的结论限于该作者的 Cursor Ultra 账号:extra high、未开 fast mode 时,换到 Grok 4.7 之后的几个百分点,比作者认定的当天更早 Grok 4.6 段落掉得更快。作者因此准备在多数任务上回到 4.6。

Cursor 百分比时间和 Artificial Analysis 的美元单任务成本使用的是不同客户端、计费单位和任务集。附图对应的是 Grok Build 的 xhigh API 成本,正文测量的是 Cursor 套餐百分比。作者所说的大约 10% 基准提升,是对这张图的印象;帖子没有样本数、任务清单或评分脚本。

任务内容未注明。133 分钟与图中 85%→84% 的时钟差不一致。fast mode 贵 25% 只出现在一条回复里。前两条评论是态度,不能记成基准结果。

复现说明

打开上面的永久链接可以看到正文、两张图和采集时的 4 条评论。要重做作者自己的用量比较,需要 Cursor Ultra、同一项未公开的任务、Grok 4.6 与 Grok 4.7、extra high,并且关闭 fast mode,再记录百分比和时间。帖子没有提示词和输出,质量部分无法复现。$8.82 与 $3.53 是作者对截图的读数;采集时没有另开 Artificial Analysis 原页核对。

能支持的判断

  • 同一 Cursor Ultra 账号里,extra high 且未开 fast mode 时,Grok 4.7 相对 Grok 4.6 打掉套餐百分比的速度。

不能支持的判断

  • 代码是否做对、回答质量、官方 API 美元账单、fast mode、其他推理档位、其他客户端,以及作者没有写出的那项任务以外的工作。

方法、局限和复现

本文中的数字、任务集、推理档位和客户端条件只在所列来源及采集时点内成立。不同版本、不同 harness 或不同提供商的数据不能直接并排比较;未公开的参数保持未知。

需要复测时,请固定模型版本、提供商或客户端、推理档位、工具、任务集版本、样本数和采集日期,并记录失败、重试与人工修正。完整方法和复现步骤见下方来源笔记。

原始来源

Reddit(r/cursor) · Dynamix86 · 原文发布日期 2026-09-21 · 本站编辑日期 2026-09-22

打开原始来源

Grok 4.7

在 Tabbit 中比较 Grok 4.7

下载 Tabbit 客户端后检查模型可用性

模型深度阅读

完整测评 · 简体中文

Grok 4.7 测评:标价没变,输出 token 大约翻了一倍

Grok 4.7 仍是每百万 token 输入 2 美元、输出 6 美元。xhigh 每道智能指数题约 8.1 万输出 token。这篇说明哪些任务值得多花这些 token。

定价 · 简体中文

Grok 4.7 价格:标价仍是 $2/$6,账单不是

Grok 4.7 的 API 短上下文仍是每百万 token $2、$0.50 和 $6。推理档位、20 万门槛、Fast,以及 Cursor 的 25.6 万线,会改写实际账单。

模型对比 · 简体中文

Grok 4.7 对比 Grok 4.6:单价没变,账单会变长

Grok 4.7 与 Grok 4.6 的 API 标价同为每百万 token 输入 $2、输出 $6,上下文都是 50 万。xhigh 下智能指数题输出约 8.1 万 token,4.6 约 3.6 万。

相关评测

X:Artificial Analysis 的 AA-Briefcase 图——Grok 4.7(xhigh)综合 Elo 1657在这条帖附带的 AA-Briefcase Elo 图上,Grok 4.7(xhigh)为 1657,位于 Claude Fable 5.1(max with fallback,1678)和 Claude Opus 5(max,1673)之后。帖文正文另称它在该基准上仅落后于 Anthropic 模型、紧跟 Opus 5,且每任务成本约为后者的一半;AA-Briefcase-Lite 上,分析质量 Elo 从 Grok 4.6 的 1698 升到 1994,演示 Elo 从 1531 降到 1499。xAI 官方发布:Grok 4.7 基准分数与能力定位xAI 在发布页把 Grok 4.7 定位为编码与知识工作模型,并自报 CursorBench 4.0、DeepSWE v1.1、EEBench 等分数;这些数字是 2026-09-22 打开原文时可见的厂商口径,本篇没有做独立复测。xAI 官方模型卡:Grok 4.7 的安全评测与使用边界官方模型卡把 Grok 4.7 写成 Grok 4.6 之后、面向编码、工程与办公室任务的已部署检查点,并给出可用渠道、训练截止日期,以及在 xhigh 或 high 档上的能力与安全分数;卡片没有出现快速变体,也没有 API model ID。Artificial Analysis:Grok 4.7 的智能指数与编码代理Artificial Analysis 用 xhigh 档测得 Grok 4.7 的 Intelligence Index v4.3 为 46,Coding Agent Index v1.5 在 Grok Build 上为 56;知识工作 Elo 高于 Grok 4.6 (high),同时每道智能指数题的输出 token 大约 81k。Box 在 AI Studio 里用 Grok 4.7 审查 Merewick 索赔的提示与结果Box 的这条帖是一段 41 秒的 Box Agent 预览:在 Box AI Studio 中选定 Grok 4.7,对文件夹「Active Commercial Property Claims」输入一段索赔审查提示,生成文件 Claim Reconciliation Review Merewick Coastal Foods ASC-26-0184.md。备忘录写明具名风暴免赔额少计 USD 143,000、发票 RCS-26118 的 USD 82,000 在建筑险与营业用动产中重复、供应商贷项通知单 CM-66204 的 USD 64,000 未从食品库存中扣除,并写明营业中断的 72 小时等待期不适用于额外费用。备忘录把最终承保和付款决定留给理赔员与承保律师。OpenRouter 上的 Grok 4.7 API 接入配置OpenRouter 模型页把 x-ai/grok-4.7 标成 SpaceXAI 的 Grok 4.7,列出的输入 / 输出价格是每百万 token $1.60 / $4.80,并给出了 OpenRouter SDK 与 cURL 的调用示例;请求体里的推理档位字段和 Low、Medium、High 各档标价在本次采集中未读到。xAI 官方文档:Grok 4.7 API 参数与推理档位公开 xAI API 的模型名是 grok-4.7;文档列出的推理档位为 Low、medium、high(默认)或 xhigh,输入价 $2.00 / 1M tokens,输出价 $6.00 / 1M tokens。Grok 4.7 Fast 被写成同一模型的更快部署,按标准 token 价格的两倍计费,并且只出现在 Cursor 与 Grok Build。