Tabbit
活动资源博客模型
Tabbit LogoTabbit

Tabbit — 为你工作的 AI 浏览器

主题资源

  • AI Browser Resources
  • Agentic Browser Resources
  • Browser Downloads and Install Guides
  • Browser Comparisons
  • AI Browser Alternatives
  • Browser Productivity Resources

热门指南

  • AI Browser
  • Agentic Browser Download
  • Best AI Browser 2026: Top 9 Tested & Ranked
  • AI Browser Download
  • Free AI Browser
  • Best AI Browser 2026
  • AI Browser Comparison 2026
  • AI Browser for Windows
  • AI Browser for Mac
  • Chrome Alternative 2026

活动

  • 别装了,你在《牛来》里早有原型
  • Tabbit 妙招大赛
  • KPOP SBTI 饭圈人格测试
  • Tabbit 校园共创者计划
  • fifi 的论文文献妙招精选
  • 用户问卷

关于

  • Tabbit 博客
  • 媒体报道
提示词
社区Kimi K2.5

Kimi K2.5 的视觉编码与 Agent Swarm 任务提示

原始来源

Kimi 官方技术博客与 GitHub 模型仓库

作者Moonshot AI / Kimi

原文日期2026-01-27

Tabbit 整理2026-08-19

查看原文

一句话结论

给 Kimi K2.5 明确的目标、可并行子任务、证据格式和完成检查,适合让其处理视觉到代码、网页重建、研究聚合和多 Agent 工作;复杂任务可在 Agent Swarm 中让模型自行分解,但仍需限制并发和验证结果。

适用场景

  • 适合的任务:图像/视频到代码、视觉调试、网页重建、跨来源研究、批量分类和办公交付。

  • 不适合的任务:没有可验证标准的无限并发;高风险写操作或敏感数据不应交给自动生成的子 Agent。

  • 适用的模型版本:Kimi K2.5 Thinking/Instant/Agent;Agent Swarm 为 beta/研究预览,以当前产品状态为准。

  • 适用的客户端、Agent 或 API:Kimi.com、Kimi App、Kimi API、Kimi Code、第三方 OpenAI/Anthropic-compatible endpoint。

  • 推荐的推理档位和参数:Thinking 使用官方建议 temperature=1.0、top_p=0.95;Instant 使用 temperature=0.6、top_p=0.95。复杂视觉/搜索任务优先 Thinking。

可直接使用的内容

你是一个视觉与工程 Agent。

目标:根据提供的图片/视频/需求,交付一个可运行、可验证的结果。

请按以下顺序工作:
1. 先观察输入,列出可确认的视觉事实、缺失信息和验收标准。
2. 把任务拆成可并行的独立子任务:
   - 视觉结构/布局分析
   - 资源与文字提取
   - 代码实现
   - 运行与截图验证
   - 交互/可访问性检查
3. 子任务只返回结构化结果:{task, evidence, result, risks}。
4. 汇总时解决冲突;没有证据的内容标记为 unknown,不要猜测。
5. 运行代码、截图或测试验证;不满足验收标准时继续修复,直到达到预算上限。

最终输出:
- 完成的文件/链接
- 关键视觉与工程决策
- 验证命令与结果
- 未解决项和下一步

若使用 Agent Swarm,可把“100 个细分领域研究”这类独立任务交给自动编排;不要在提示里强制盲目生成固定数量子 Agent,先让模型判断可并行性。

测试/工作流步骤

  1. 准备一份图片/视频和目标页面,记录输入尺寸、文本、交互和响应式验收项。

  2. 分别测试单 Agent 与 Agent Swarm,固定工具集、上下文和最大步骤。

  3. 保存每个子任务的 prompt、结果、来源、代码 diff、截图和测试日志。

  4. 检查子任务是否重复、是否遗漏关键事实、是否在冲突时错误投票;最后由主 Agent/规则检查器验收。

原始证据与数据

  • Kimi 官方称 K2.5 可将视觉输入用于代码、视觉调试和网页重建;模型仓库称其为原生多模态 Agent 模型。

  • 官方 Agent Swarm 设计可动态创建最多 100 个子 Agent,协调最多 1,500 次 tool calls;官方称相对单 Agent 最高可减少 4.5× 执行时间。

  • 官方博客给出视觉迷宫案例:模型调用代码执行/BFS,报告路径长度 113,557 steps 和可视化验证;这是公开示例而非独立测试。

  • K2.5 支持图像/视频输入、Thinking/Instant 模式和 Kimi Code;Agent Swarm 在官方博客中标为 beta/研究预览。

适用边界

  • Agent Swarm 的 100/1,500/4.5× 是官方能力/内部评估描述,实际受工具限额、并发、失败重试和任务可并行性影响。

  • 模型自我分解不等于每个子任务都正确;必须有证据、schema、幂等写入和最终回归测试。

  • 视觉输出的坐标、文字和布局需通过图像/DOM/代码工具复核,不能只信文本描述。

  • 模板是基于官方任务方法改编的可复用提示,不是官方完整 system prompt。

来源摘录或观察(仅做合规短引)

官方对 Agent Swarm 的概括是“scaling out, not just up”(合规短引)。

Tabbit 小编提醒

提示词内容来自公开资料与 Tabbit 编辑整理。引用前请查看原文授权与适用范围。

Kimi K2.5

在 Tabbit 中使用

Kimi K2.5

相关提示词

社区GitHub / MoonshotAI/Kimi-K2.5

Kimi K2.5 Thinking/Instant 与视觉工具配置

Kimi K2.5

相关测评

媒体Kimi Tech Blog / Visual Agentic Intelligence2026-01-27

Kimi K2.5 官方发布:多模态、Agent Swarm 与编码基准

媒体Fireworks AI

Fireworks 对 Kimi K2.5 官方 API 与部署栈的质量对照

媒体BenchLM2026-08-17

BenchLM 对 Kimi K2.5 的公开基准账本与任务分层

社区Reddit / r/LocalLLaMA2026-01

Reddit LocalLLaMA 对 Kimi K2.5 编码与部署的体验