这是一个问“Qwen3.8-Max 是否真的适合编程”的社区讨论。反馈两极:有人认为它接近 Claude/GPT,也有人认为它慢、贵、会过度思考;另有用户用它生成多个网页游戏和 Rust 神经网络编辑器,认为模型非常强,但需要把要求讲得足够具体。讨论的共同点是:模型能力、价格、任务规模和提示词质量必须一起评估。
有用户称其与 Claude/GPT “very much on par”,但 Alibaba coding plan 的额度不够宽松。
有用户称标准计划两三个提示就消耗约 60% 周额度。
有用户引用 Artificial Analysis 的 Software Engineering 指标,认为它“不错,但不如 Anthropic/OpenAI,也不如 Qwen3.7-Max”。
有用户觉得单步思考可持续 2 分钟,甚至 5–8 分钟。
复杂网页游戏和 Rust 原生编辑器的案例显示:模型可以交付可运行项目,但“不会主动补充你没说的需求”,需要具体、完整地描述目标。
另有用户认为日常 create-web-app 任务中,Qwen Max 相对更大的差距未必明显;合理 harness 和 skills 仍然重要。
适合把 Qwen3.8-Max 放入复杂编码和 agent 任务的候选池,但应按“每个任务的成功成本”而不是单次价格比较。上线前建议记录首轮通过率、耗时、输出 token、人工修订时间和额度消耗。
本站仅展示 Tabbit 编辑摘要和必要节选;完整内容、上下文与最新版本请查看原始来源。
Reddit 页面同时显示了英文原文和自动翻译;本文原文区保留英文代表性内容,并删去广告、版务、无关评论和重复导航。
Qwen3.8 Max