作者用相同的(水波纹)提示词在 Hermes Agent 上对比 GLM-5.3、DeepSeek V4 Flash 0731、Qwen3.8 27b 三个模型,判定 GLM-5.3 最佳,并公开了实时结果页面。
"我用 GLM 5.3、DeepSeek v4 Flash 0731 和 Qwen3.8 27b 尝试过这个。 在我看来,GLM-5.3 是最好的 - 附上视频 在所有 3 个模型上都用 Hermes Agent 运行了。 你可以在这里查看… 以上为必要节选,完整内容请查看原文。
同提示词多模型对比:水波纹(Water Ripple)生成任务,三个模型均跑在 Hermes Agent(本地 Agent 框架)上。
结论:GLM-5.3 最佳;作者附视频与实时对比页面(GitHub Pages,可查看三模型输出差异)。
对提示词工程的参考:Agent 框架(Hermes Agent)自带 system prompt 与工具编排,模型差异仍显著——选择与 Agent 框架配合好的模型比只调提示词更有效(呼应 @bygregorr 的观点:"GLM-5.3 的获胜也许更多说明它如何处理 Hermes Agent 的 system prompt,而不仅是模型本身;换脚手架排名会翻转")。
这是一个"同一提示词、不同模型/框架"的对比样本,可作为 GLM-5.3 与竞品在 Agent 场景下的体感参考。
平台:X(推特)
时间:2026-08-17
类型:同提示词多模型对比(含实时结果页)
参考结果页:https://miaai-lab.github.io/Water-Ripple-Prompt-GLM-5.3-DS4F-Qwen3.8-27b/
GLM-5.3