在 Kilo Code CLI 中让 LongCat 2.0(开源权重、本地/免费运行)与 GPT-5.5(云端付费)执行同一个任务——3 次 Agent 迭代把 game.html 里的复古 Duck Hunt 游戏做到含鸭子波次、弹药与物理——两者产物质量"运行流畅、无剪切问题、图形/物理/游戏逻辑同步",唯一区别是账单:LongCat 0 美元 vs GPT-5.5 $0.65。
方法:两个模型都在 Kilo Code CLI 的 agent 模式跑,相同任务(game.html 单文件构建 Duck Hunt,3 次代理迭代,含鸭子波次、弹药、物理)。
消耗与成本:
LongCat 2.0:70.3K tokens,$0.00(开源权重、本地运行)
GPT-5.5:64.9K tokens,$0.65
质量结论(作者原话):"LongCat 在图形、物理和游戏逻辑上保持同步。鸭子被击中时会飞翔并坠落,狗会去捡它们,弹药倒计时,波次不断来袭。两者运行流畅,没有任何剪切问题。唯一的区别是账单——GPT 花 $0.65,而 LongCat 本地运行仅需 $0"。
作者是本地 AI 应用厂商(atomic.chat),该对比服务于"本地/免费优于云端付费"的商业叙事,存在利益相关;但方法(同任务、同框架、同迭代次数、给出 token 与成本)透明可复核,演示产物链接在推文附文中。
单任务(单文件游戏开发)样本小;结论限定于"轻量前端游戏生成"类任务,不代表仓库级工程或 Agent 长程任务。
与官方 5 个单提示词项目(提示词目录 07)、r/opencodeCLI Ubuntu 案例(提示词目录 08)共同构成"创意/前端编程任务"证据群:LongCat 2.0 在此类任务上与前沿闭源模型质量接近、成本优势显著。
注意:此处 "GPT-5.5" 为 2026 年版本的云端模型,成本 $0.65 为其平台账单口径;不同时期、不同渠道价格不可直接外推。
LongCat 2.0