LongCat Flash Thinking

LongCat Flash Thinking · 提示词与工作流

把任务交给 LongCat Flash Thinking

按任务、内容类型和运行环境查找可执行的提示词与工作流。每张卡片说明输入、验证状态和原始出处。

运行环境因资源而异,可能是 API、命令行、Agent 框架或浏览器代码环境;以每张卡片为准。

全部资源

全部资源

2 / 2
未核验Hugging Face

LongCat-Flash-Thinking-2601:官方聊天模板、工具调用与思维历史配置

在 LongCat-Flash-Thinking-2601 chat template 中保留思维历史字段,执行一次检索研究问题,并把工具轨迹与结论分开验收。

内容类型配置指南
输入研究问题、思维历史或空历史、工具 JSON schema、检索结果、轨迹验收规则
状态兼容模型 tokenizer 的推理服务;工具 schema、检索结果和 trace 日志均可保存。
reasoningAgentAPI 配置
未核验GitHub

LongCat-Flash-Thinking-2601:官方 SGLang/vLLM 部署与 MTP 配置

用官方部署说明在 SGLang 或 vLLM 启动 MTP,固定并发与上下文,测量首 token、生成速度和工具解析。

内容类型配置指南
输入部署后端与版本、GPU 数量与精度、并发与上下文设置、固定测试问题、延迟与解析日志
状态GPU 节点、固定 SGLang/vLLM 版本、模型权重和 MTP 配置;需要基准脚本。
speed-latencycapabilityAPI 配置

LongCat Flash Thinking

在 Tabbit 中使用 LongCat Flash Thinking

下载后先确认当前账户中的模型与功能。API 和本地代码步骤仍需在对应环境中执行。