Tabbit
活动资源博客模型
Tabbit LogoTabbit

Tabbit — 为你工作的 AI 浏览器

主题资源

  • AI Browser Resources
  • Agentic Browser Resources
  • Browser Downloads and Install Guides
  • Browser Comparisons
  • AI Browser Alternatives
  • Browser Productivity Resources

热门指南

  • AI Browser
  • Agentic Browser Download
  • Best AI Browser 2026: Top 9 Tested & Ranked
  • AI Browser Download
  • Free AI Browser
  • Best AI Browser 2026
  • AI Browser Comparison 2026
  • AI Browser for Windows
  • AI Browser for Mac
  • Chrome Alternative 2026

活动

  • 别装了,你在《牛来》里早有原型
  • Tabbit 妙招大赛
  • KPOP SBTI 饭圈人格测试
  • Tabbit 校园共创者计划
  • fifi 的论文文献妙招精选
  • 用户问卷

关于

  • Tabbit 博客
  • 媒体报道
简体中文
简体中文English
提示词与工作流

Kimi K2.6 · configuration

Kimi K2.6:API 思考模式与视觉工具配置

The official quickstart covers thinking mode, multimodal input, and tool configuration; detail is limited to a reproducible API call.

来源待核验Kimi API; image/video input, tool schema, and a logged response.

前置条件与输入

  • 任务目标与来源材料
  • 运行客户端或 API
  • 输出格式与验收规则

前置条件

Kimi API; image/video input, tool schema, and a logged response.

任务步骤

固定模型版本、输入和工具权限;逐轮保存返回、错误和验收证据。

任务结果

交付与“Kimi K2.6:API 思考模式与视觉工具配置”对应的产物,并列出未由来源或输入确认的假设。

输出与验收

运行实际检查,记录格式、关键路径、工具状态与未通过项。

失败修正

复现最小失败样例,缩小输入或修正配置;不要把模型自述当完成证据。

来源与边界

The official quickstart covers thinking mode, multimodal input, and tool configuration; detail is limited to a reproducible API call.

查看来源研究笔记

一句话结论

K2.6 API 默认开启 thinking、固定一组采样参数,并要求工具多轮保留 reasoning_content;如果要使用官方 $web_search,当前文档建议先关闭 thinking。

适用场景

  • 适合的任务:文本/图像/视频理解、代码 Agent、函数工具调用和 256K 长上下文对话。

  • 不适合的任务:在 thinking 模式下直接调用官方 $web_search;文档明确称该组合暂时不兼容。

  • 适用的模型版本:kimi-k2.6。

  • 适用的客户端、Agent 或 API:Kimi OpenAI-compatible API、Python OpenAI SDK、Kimi Code。

  • 推荐的推理档位和参数:默认使用 thinking: {"type":"enabled"};默认 max_tokens=32768。不要手动传与固定值不同的 temperature/top-p/n/penalty。

可直接使用的内容

关闭 thinking 的最小请求(官方文档示例)

curl https://api.moonshot.ai/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $MOONSHOT_API_KEY" \
  -d '{
    "model": "kimi-k2.6",
    "messages": [{"role": "user", "content": "hello"}],
    "thinking": {"type": "disabled"}
  }'

Python 配置骨架

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.getenv("MOONSHOT_API_KEY"),
    base_url="https://api.moonshot.ai/v1",
)

response = client.chat.completions.create(
    model="kimi-k2.6",
    messages=[
        {"role": "user", "content": "先分析约束,再完成任务并给出可验证的结果。"}
    ],
    extra_body={"thinking": {"type": "enabled"}},
    max_tokens=32768,
)
print(response.choices[0].message.content)

对于工具循环,保留 assistant 消息中的 reasoning_content;tool_choice 只能是 auto 或 none。图像/视频输入按官方示例使用 base64;文档建议图片不超过 4K、视频不超过 FHD,URL 图片目前不支持。

测试/工作流步骤

  1. 先用无工具的 thinking 请求确认 SDK、base URL、模型名和 API key 正常。

  2. 增加函数工具,固定 tool_choice="auto",把每轮完整 assistant 消息(含 reasoning_content 和 tool calls)回填上下文。

  3. 若需要 $web_search,切换到 thinking: {"type":"disabled"},并单独记录该模式的质量/成本差异。

  4. 对图像/视频任务先估算 token,超过请求体限制或需要重复引用时使用文件上传而非 base64。

  5. 在 256K 长上下文附近测试上下文裁剪、工具回传和失败恢复,不把默认 32K 输出上限误认为上下文窗口。

原始证据与数据

  • 文档列出模型上下文为 256K;输入支持 text/image/video,支持 thinking 与 non-thinking、对话和 Agent 任务。

  • max_tokens 默认 32768;thinking 默认启用;thinking 时 temperature 固定 1.0,non-thinking 固定 0.6;top-p 固定 0.95;n 固定 1;presence/frequency penalty 固定 0.0,传入其他值会报错。

  • 工具调用约束:tool_choice 只能 auto/none;多步调用必须保留 reasoning_content;官方 $web_search 暂不兼容 K2.6/K2.5 thinking。

  • 视觉建议:图片不超过 4096×2160,视频不超过 1920×1080;URL 格式图片不支持,图片数量无硬限制但请求体不得超过 100M。

适用边界

  • 文档中“视觉模型”能力依赖输入格式和客户端;第三方 provider 可能不暴露图像输入,不能把 Kimi API 的能力直接外推到所有聚合平台。

  • 固定采样参数意味着不能通过 temperature/top-p 做常规随机性调节;需要比较时必须记录 thinking 开关和 provider。

  • 把 reasoning_content 回传给 API 是状态连续性要求,不等于应把内部推理全文展示给用户。

  • 文档的代码示例包含视觉与工具用法,但未提供每种输入的完整成本样本;上线前应自行测 token 和延迟。

来源摘录或观察(仅做合规短引)

官方提示在 thinking 工具调用中 “must keep the reasoning_content”,并说明 $web_search “temporarily incompatible”;这两条是 K2.6 接入最容易踩的配置边界。

来源与日期

Kimi API Platform · 原文日期: 未公开 · 编辑日期: 2026-09-20

阅读原始来源
变量检查

无必填变量

相关提示词

Kimi K2.6:长程编码与多 Agent 工作流

相关测评

Kimi K2.6:官方长程编码与 Agent 基准复现条件Kimi K2.6:DeepInfra 架构、基准与 Provider 能力边界Kimi K2.6:Reddit 多模型编码与多模态体验

模型深度阅读

总览 · 简体中文

Kimi K2.6 是什么:如何获取、适合什么任务,以及与 K2.7 Code 和 K3 的区别

基于来源说明 Kimi K2.6 的通用多模态定位、256K 上下文、Agent Swarm、API 价格、获取渠道与实际边界。

Kimi K2.6

在 Tabbit 中使用 Kimi K2.6

请在上方所列环境中运行本指南。下载不会自动传入模板,也不代表账户已开放该模型。