查看所有模型

在 Tabbit 中使用 LongCat Flash Thinking

在 Tabbit 中使用

在 Tabbit 中使用 LongCat Flash Thinking

LongCat Flash Thinking · 模型速览

先看资源与证据,再决定怎么用

这里集中放置已审核的任务指南、公开测评和证据边界。客户端是否开放模型,仍以当前账户为准。

任务指南2
测评来源3
来源已核对0
编辑精选5

Tabbit 模型与权限需以当前账户核实。

按任务找指南

把资料整理成结构化结果,制作视觉原型,或开始一个编码任务。

全部提示词与工作流
reasoning · Agent 工作流未核验

LongCat-Flash-Thinking-2601:官方聊天模板、工具调用与思维历史配置

在 LongCat-Flash-Thinking-2601 chat template 中保留思维历史字段,执行一次检索研究问题,并把工具轨迹与结论分开验收。

准备输入
研究问题、思维历史或空历史、工具 JSON schema、检索结果、轨迹验收规则
运行环境
兼容模型 tokenizer 的推理服务;工具 schema、检索结果和 trace 日志均可保存。
查看步骤
speed-latency · capability未核验

LongCat-Flash-Thinking-2601:官方 SGLang/vLLM 部署与 MTP 配置

用官方部署说明在 SGLang 或 vLLM 启动 MTP,固定并发与上下文,测量首 token、生成速度和工具解析。

准备输入
部署后端与版本、GPU 数量与精度、并发与上下文设置、固定测试问题、延迟与解析日志
运行环境
GPU 节点、固定 SGLang/vLLM 版本、模型权重和 MTP 配置;需要基准脚本。
查看步骤

阅读证据与选型边界

公开结果来自不同版本、档位和测试方法;未知值保持未知。

全部测评与来源
arXiv厂商自报

LongCat-Flash-Thinking-2601:Heavy Thinking、环境噪声与 Agent 基准

技术报告在自定义任务中描述 Heavy Thinking、搜索/工具使用和 TIR Agent 实验;支持理解报告方向,不能替代独立复现。

证据类型
厂商自报
边界
不支持外推生产完成率或跨模型排名;提示、工具延迟和失败轨迹未完全公开。
LongCat API Platform编辑分析

LongCat-Flash-Thinking:API 别名升级、自动路由与服务退役边界

官方 Change Log 记录 Flash-Chat API 上线、升级和退役迁移节点;它适合核对 endpoint 支持范围,不用于判断回答质量。

证据类型
编辑分析
边界
不支持质量、延迟或配额比较;没有固定请求集、区域和重复样本。
Reddit / r/LocalLLaMA个人体验

LongCat-Flash-Thinking-2601:LocalLLaMA 社区的初步阅读与部署观察

LocalLLaMA 讨论 Agent 能力与部署期待,适合挑选待实测假设;不是可复现基准。

证据类型
个人体验
边界
不支持可泛化成功率或模型排名;缺少对照、固定客户端和完整日志。

LongCat

在 Tabbit 中使用 LongCat Flash Thinking

汇总 LongCat Flash Thinking 的提示词指南、测评与社区反馈,帮助你判断适合的任务并直接开始使用。