Tabbit
活动资源博客模型
Tabbit LogoTabbit

Tabbit — 为你工作的 AI 浏览器

主题资源

  • AI Browser Resources
  • Agentic Browser Resources
  • Browser Downloads and Install Guides
  • Browser Comparisons
  • AI Browser Alternatives
  • Browser Productivity Resources

热门指南

  • AI Browser
  • Agentic Browser Download
  • Best AI Browser 2026: Top 9 Tested & Ranked
  • AI Browser Download
  • Free AI Browser
  • Best AI Browser 2026
  • AI Browser Comparison 2026
  • AI Browser for Windows
  • AI Browser for Mac
  • Chrome Alternative 2026

活动

  • 别装了,你在《牛来》里早有原型
  • Tabbit 妙招大赛
  • KPOP SBTI 饭圈人格测试
  • Tabbit 校园共创者计划
  • fifi 的论文文献妙招精选
  • 用户问卷

关于

  • Tabbit 博客
  • 媒体报道
简体中文
简体中文English
测评与证据

Grok 4.7 · 社区来源 · 个人体验

r/cursor 用户对 Grok 4.7 的首批使用印象

发帖后数小时内的 7 条评论里,四条给出了 Grok 4.7 的主观印象:没有 4.6 那么慢、感觉像不那么过度思考的 opus5、写作似乎更好但仍在测试,以及 Devin 的 SWE 2.0 加 fusion api 被说成更好。没有人写出任务、计时或评分。

社区来源个人体验编辑日期 2026-09-22

测试条件速查

来源具体观察
发帖后数小时内的 7 条评论里,四条给出了 Grok 4.7 的主观印象:没有 4.6 那么慢、感觉像不那么过度思考的 opus5、写作似乎更好但仍在测试,以及 Devin 的 SWE 2.0 加 fusion api 被说成更好。没有人写出任务、计时或评分。
已公布条件
代码是否做对、基准名次、价格、套餐用量、官方 API 账单,以及任何需要固定任务和评分规则的比较。

关键数据与适用场景

一句话结论

发帖后数小时内的 7 条评论里,四条给出了 Grok 4.7 的主观印象:没有 4.6 那么慢、感觉像不那么过度思考的 opus5、写作似乎更好但仍在测试,以及 Devin 的 SWE 2.0 加 fusion api 被说成更好。没有人写出任务、计时或评分。

适用场景

  • 适合判断的任务:r/cursor 里几位用户在发帖后数小时内,对 Grok 4.7 速度、是否过度思考、写作手感,以及相对 Devin 的口头偏好。

  • 不适合外推的任务:代码是否做对、基准名次、价格、套餐用量、官方 API 账单,以及任何需要固定任务和评分规则的比较。

  • 适用的模型版本:帖子标题和正文中的 Grok 4.7。vandersky_ 只写了 “4.6”。kodka 写的是 “opus5”。ImmediateAttention88 写的是 Devin 的 SWE 2.0、fusion api 和 grok 4.7。

  • 测试环境或客户端:帖子发在 r/cursor。评论没有写 Cursor 套餐、客户端版本或仓库。ImmediateAttention88 写自己换到了 Devin,并同时使用两个 agentic IDE。

  • 推理档位和参数:未注明。

测评方法

帖子正文只有一个问句,没有测试方案、提示词、输出或计时。采集时页面渲染出 7 条评论,与帖子的 comment-count 一致;同一页的评论 JSON 也是这 7 条,没有未加载的 more 节点。页面附带 Reddit 的中文界面译文,下文引用英文原文。排序控件的选中项未注明,下面按当时的可见顺序记录。

关键结果

四条评论直接谈到使用感觉:

  • vandersky_(2026-09-21 18:58 UTC,元素 score 4)写:“Not as fucking slow as 4.6”。没有任务、时长或输出长度。

  • kodka(2026-09-21 20:59 UTC,score 3)写:“i love it so far, it really feels like opus5 that does not overthink stuff”。没有任务样本。

  • explorioapp(2026-09-21 21:54 UTC,score 1)写:“So far, it seems like a better writer. I'm still testing”。比较基线未注明,并写明仍在测试。

  • ImmediateAttention88(2026-09-21 18:24 UTC,score -4)写自己换到了 Devin,认为 “SWE 2.0 with fusion api is better than grok 4.7”,编辑补了一句目前两个 agentic IDE 都在用。“更好”的维度未注明。

另外三条不构成模型体验。FinalAliens 说没有 reset,所以无法长时间测试。GalaxyGuide 附和应该给一次 reset。muecksimon 回复 FinalAliens:“OpenAI ist auch nicht spacex”。

原始数据

标题原文:“So whats youre initial experience on Grok 4.7?”

正文原文:“So whats your initial experience on Grok 4.7?”

标签为 Question / Discussion。帖子元素的 score 属性是 2。评论操作行没有把分数画成可见数字;分数来自页面上 shreddit-post 与 shreddit-comment 的 score 属性。同一页面随后取到的 JSON 里,帖子分数是 1,GalaxyGuide 是 4,其余评论分数与元素属性一致。

可见评论:

  1. FinalAliens,2026-09-21 18:36:27 UTC,score 12。评论:“No reset, so I cannot test it for long time. OpenAI at least usually gives reset, when there is new model.”

  2. muecksimon,回复上一条,2026-09-21 20:08:50 UTC,score 2。评论:“OpenAI ist auch nicht spacex”

  3. GalaxyGuide,2026-09-21 18:57:12 UTC,元素 score 5(JSON 为 4)。评论:“They should def give a reset”

  4. vandersky_,2026-09-21 18:58:29 UTC,score 4。评论:“Not as fucking slow as 4.6”

  5. kodka,2026-09-21 20:59:59 UTC,score 3。评论:“i love it so far, it really feels like opus5 that does not overthink stuff”

  6. explorioapp,2026-09-21 21:54:43 UTC,score 1。评论:“So far, it seems like a better writer. I'm still testing”

  7. ImmediateAttention88,2026-09-21 18:24:59 UTC,score -4。评论:“I am so glad that i switched to devin. SWE 2.0 with fusion api is better than grok 4.7.” 下一句是 “The only difficult choice was letting grok bot go...” 编辑为 “Edit: for now i am using both of this agentic ide”。

结论与边界

能留下的是发帖后数小时内的口头印象:有人觉得它没有 4.6 那么慢,有人觉得它像不那么过度思考的 opus5,有人觉得写作似乎更好但还在测,也有人更倾向 Devin 的 SWE 2.0 加 fusion api,同时仍在用两个 agentic IDE。这些句子都没有共同任务、样本量、计时和评分规则。内容品类因此记为 community-opinion。

FinalAliens 与 GalaxyGuide 谈的是新模型后有没有用量重置。muecksimon 的回复与 Grok 4.7 的能力无关。推理档位、fast mode、Cursor 套餐和具体仓库均未注明。vandersky_ 的 “4.6” 与 kodka 的 “opus5” 都没有写全称。帖子分数和 GalaxyGuide 的分数在元素属性与 JSON 之间差 1,采集时不能收成一个精确热度。

复现说明

打开上面的永久链接可以看到正文和采集时的 7 条评论。页面对英文原文附有中文译文,核对时以英文为准。分数会变。帖子没有提示词和输出,速度、写作和 Devin 比较都无法按原条件重做。

能支持的判断

  • r/cursor 里几位用户在发帖后数小时内,对 Grok 4.7 速度、是否过度思考、写作手感,以及相对 Devin 的口头偏好。

不能支持的判断

  • 代码是否做对、基准名次、价格、套餐用量、官方 API 账单,以及任何需要固定任务和评分规则的比较。

方法、局限和复现

本文中的数字、任务集、推理档位和客户端条件只在所列来源及采集时点内成立。不同版本、不同 harness 或不同提供商的数据不能直接并排比较;未公开的参数保持未知。

需要复测时,请固定模型版本、提供商或客户端、推理档位、工具、任务集版本、样本数和采集日期,并记录失败、重试与人工修正。完整方法和复现步骤见下方来源笔记。

原始来源

Reddit(r/cursor) · Dramatic-Secret-3734(发帖);评论作者见原始数据 · 原文发布日期 2026-09-21 · 本站编辑日期 2026-09-22

打开原始来源

Grok 4.7

在 Tabbit 中比较 Grok 4.7

下载 Tabbit 客户端后检查模型可用性

模型深度阅读

完整测评 · 简体中文

Grok 4.7 测评:标价没变,输出 token 大约翻了一倍

Grok 4.7 仍是每百万 token 输入 2 美元、输出 6 美元。xhigh 每道智能指数题约 8.1 万输出 token。这篇说明哪些任务值得多花这些 token。

定价 · 简体中文

Grok 4.7 价格:标价仍是 $2/$6,账单不是

Grok 4.7 的 API 短上下文仍是每百万 token $2、$0.50 和 $6。推理档位、20 万门槛、Fast,以及 Cursor 的 25.6 万线,会改写实际账单。

模型对比 · 简体中文

Grok 4.7 对比 Grok 4.6:单价没变,账单会变长

Grok 4.7 与 Grok 4.6 的 API 标价同为每百万 token 输入 $2、输出 $6,上下文都是 50 万。xhigh 下智能指数题输出约 8.1 万 token,4.6 约 3.6 万。

相关评测

X:Artificial Analysis 的 AA-Briefcase 图——Grok 4.7(xhigh)综合 Elo 1657在这条帖附带的 AA-Briefcase Elo 图上,Grok 4.7(xhigh)为 1657,位于 Claude Fable 5.1(max with fallback,1678)和 Claude Opus 5(max,1673)之后。帖文正文另称它在该基准上仅落后于 Anthropic 模型、紧跟 Opus 5,且每任务成本约为后者的一半;AA-Briefcase-Lite 上,分析质量 Elo 从 Grok 4.6 的 1698 升到 1994,演示 Elo 从 1531 降到 1499。xAI 官方发布:Grok 4.7 基准分数与能力定位xAI 在发布页把 Grok 4.7 定位为编码与知识工作模型,并自报 CursorBench 4.0、DeepSWE v1.1、EEBench 等分数;这些数字是 2026-09-22 打开原文时可见的厂商口径,本篇没有做独立复测。xAI 官方模型卡:Grok 4.7 的安全评测与使用边界官方模型卡把 Grok 4.7 写成 Grok 4.6 之后、面向编码、工程与办公室任务的已部署检查点,并给出可用渠道、训练截止日期,以及在 xhigh 或 high 档上的能力与安全分数;卡片没有出现快速变体,也没有 API model ID。Artificial Analysis:Grok 4.7 的智能指数与编码代理Artificial Analysis 用 xhigh 档测得 Grok 4.7 的 Intelligence Index v4.3 为 46,Coding Agent Index v1.5 在 Grok Build 上为 56;知识工作 Elo 高于 Grok 4.6 (high),同时每道智能指数题的输出 token 大约 81k。Box 在 AI Studio 里用 Grok 4.7 审查 Merewick 索赔的提示与结果Box 的这条帖是一段 41 秒的 Box Agent 预览:在 Box AI Studio 中选定 Grok 4.7,对文件夹「Active Commercial Property Claims」输入一段索赔审查提示,生成文件 Claim Reconciliation Review Merewick Coastal Foods ASC-26-0184.md。备忘录写明具名风暴免赔额少计 USD 143,000、发票 RCS-26118 的 USD 82,000 在建筑险与营业用动产中重复、供应商贷项通知单 CM-66204 的 USD 64,000 未从食品库存中扣除,并写明营业中断的 72 小时等待期不适用于额外费用。备忘录把最终承保和付款决定留给理赔员与承保律师。OpenRouter 上的 Grok 4.7 API 接入配置OpenRouter 模型页把 x-ai/grok-4.7 标成 SpaceXAI 的 Grok 4.7,列出的输入 / 输出价格是每百万 token $1.60 / $4.80,并给出了 OpenRouter SDK 与 cURL 的调用示例;请求体里的推理档位字段和 Low、Medium、High 各档标价在本次采集中未读到。xAI 官方文档:Grok 4.7 API 参数与推理档位公开 xAI API 的模型名是 grok-4.7;文档列出的推理档位为 Low、medium、high(默认)或 xhigh,输入价 $2.00 / 1M tokens,输出价 $6.00 / 1M tokens。Grok 4.7 Fast 被写成同一模型的更快部署,按标准 token 价格的两倍计费,并且只出现在 Cursor 与 Grok Build。