Qwen3.8 Max · 社区来源 · 个人体验
这是一个问“Qwen3.8-Max 是否真的适合编程”的社区讨论。反馈两极:有人认为它接近 Claude/GPT,也有人认为它慢、贵、会过度思考;另有用户用它生成多个网页游戏和 Rust 神经网络编辑器,认为模型非常强,但需要把要求讲得足够具体。讨论的共同点是:模型能力、价格、任务规模和提示词质量必须一起评估。
待验证:本次未能重新核实原文。下方历史数字不代表已核实的当前结果。
这是一个问“Qwen3.8-Max 是否真的适合编程”的社区讨论。反馈两极:有人认为它接近 Claude/GPT,也有人认为它慢、贵、会过度思考;另有用户用它生成多个网页游戏和 Rust 神经网络编辑器,认为模型非常强,但需要把要求讲得足够具体。讨论的共同点是:模型能力、价格、任务规模和提示词质量必须一起评估。
有用户称其与 Claude/GPT “very much on par”,但 Alibaba coding plan 的额度不够宽松。
有用户称标准计划两三个提示就消耗约 60% 周额度。
有用户引用 Artificial Analysis 的 Software Engineering 指标,认为它“不错,但不如 Anthropic/OpenAI,也不如 Qwen3.7-Max”。
有用户觉得单步思考可持续 2 分钟,甚至 5–8 分钟。
复杂网页游戏和 Rust 原生编辑器的案例显示:模型可以交付可运行项目,但“不会主动补充你没说的需求”,需要具体、完整地描述目标。
另有用户认为日常 create-web-app 任务中,Qwen Max 相对更大的差距未必明显;合理 harness 和 skills 仍然重要。
适合把 Qwen3.8-Max 放入复杂编码和 agent 任务的候选池,但应按“每个任务的成功成本”而不是单次价格比较。上线前建议记录首轮通过率、耗时、输出 token、人工修订时间和额度消耗。
本站仅展示 Tabbit 编辑摘要和必要节选;完整内容、上下文与最新版本请查看原始来源。
Reddit 页面同时显示了英文原文和自动翻译;本文原文区保留英文代表性内容,并删去广告、版务、无关评论和重复导航。
本文中的数字、任务集、推理档位和客户端条件只在所列来源及采集时点内成立。不同版本、不同 harness 或不同提供商的数据不能直接并排比较;未公开的参数保持未知。
需要复测时,请固定模型版本、提供商或客户端、推理档位、工具、任务集版本、样本数和采集日期,并记录失败、重试与人工修正。完整方法和复现步骤见下方来源笔记。
Reddit,r/QwenAI · 作者未公开 · 原文发布日期 Unknown · 本站编辑日期 2026-09-20
打开原始来源Qwen3.8 Max
下载 Tabbit 客户端后检查模型可用性