TypingMind 表示,它把同一个“传统中国剪纸风格动画”提示词分别交给 Grok 4.6、GPT-5.6 Sol、Claude Opus 5 和 Qwen 3.8 Max,用于比较生成结果。推文附带视频,并在后续回复中提供了完整提示词和模型对比链接:https://cloud.typingmind.com/share/0bc76cfe-c0a3-4144-a042-eee5d845ac63
评论区出现了以下判断:
有用户将 Grok 4.6 排在四个模型的第三位,认为 Sol 的色彩和 Opus 的画面表现更好。
也有用户认为结果整体很酷,尤其关注 500K context 对 Agent 的意义。
该帖子本身没有给出结构化评分,因此只能作为同提示、同场景的视觉样例,不能当作通用视觉能力排名。
这条 X 测试说明 Grok 4.6 可以参与交互式视觉/前端项目的横向比较,但结果高度依赖提示词、生成链路和评审标准。使用时应保存完整提示词、模型配置和产物,而不是只依据视频截图下结论。
Grok 4.6