Grok 4.6 · 社区来源 · 个人体验
TypingMind 表示,它把同一个“传统中国剪纸风格动画”提示词分别交给 Grok 4.6、GPT-5.6 Sol、Claude Opus 5 和 Qwen 3.8 Max,用于比较生成结果。推文附带视频,并在后续回复中提供了完整提示词和模型对比链接:https://cloud.typingmind.com/share/0bc76cfe-c0a3-4144-a042-eee5d845ac63。
待验证:本次未能重新核实原文。下方历史数字不代表已核实的当前结果。
TypingMind 表示,它把同一个“传统中国剪纸风格动画”提示词分别交给 Grok 4.6、GPT-5.6 Sol、Claude Opus 5 和 Qwen 3.8 Max,用于比较生成结果。推文附带视频,并在后续回复中提供了完整提示词和模型对比链接:https://cloud.typingmind.com/share/0bc76cfe-c0a3-4144-a042-eee5d845ac63
评论区出现了以下判断:
有用户将 Grok 4.6 排在四个模型的第三位,认为 Sol 的色彩和 Opus 的画面表现更好。
也有用户认为结果整体很酷,尤其关注 500K context 对 Agent 的意义。
该帖子本身没有给出结构化评分,因此只能作为同提示、同场景的视觉样例,不能当作通用视觉能力排名。
这条 X 测试说明 Grok 4.6 可以参与交互式视觉/前端项目的横向比较,但结果高度依赖提示词、生成链路和评审标准。使用时应保存完整提示词、模型配置和产物,而不是只依据视频截图下结论。
本文中的数字、任务集、推理档位和客户端条件只在所列来源及采集时点内成立。不同版本、不同 harness 或不同提供商的数据不能直接并排比较;未公开的参数保持未知。
需要复测时,请固定模型版本、提供商或客户端、推理档位、工具、任务集版本、样本数和采集日期,并记录失败、重试与人工修正。完整方法和复现步骤见下方来源笔记。
X · 作者未公开 · 原文发布日期 2026-08-13 · 本站编辑日期 2026-09-20
打开原始来源Grok 4.6
下载 Tabbit 客户端后检查模型可用性