Tabbit
活动资源博客模型
Tabbit LogoTabbit

Tabbit — 为你工作的 AI 浏览器

主题资源

  • AI Browser Resources
  • Agentic Browser Resources
  • Browser Downloads and Install Guides
  • Browser Comparisons
  • AI Browser Alternatives
  • Browser Productivity Resources

热门指南

  • AI Browser
  • Agentic Browser Download
  • Best AI Browser 2026: Top 9 Tested & Ranked
  • AI Browser Download
  • Free AI Browser
  • Best AI Browser 2026
  • AI Browser Comparison 2026
  • AI Browser for Windows
  • AI Browser for Mac
  • Chrome Alternative 2026

活动

  • 别装了,你在《牛来》里早有原型
  • Tabbit 妙招大赛
  • KPOP SBTI 饭圈人格测试
  • Tabbit 校园共创者计划
  • fifi 的论文文献妙招精选
  • 用户问卷

关于

  • Tabbit 博客
  • 媒体报道
简体中文
简体中文English
测评与证据

Qwen3.5 Plus · 媒体来源 · 厂商自报

Qwen3.5-Plus:Qwen 官方原生多模态 Agent 发布基线

Qwen 官方把 Qwen3.5-Plus 定位为 Qwen3.5-397B-A17B 的托管 API 版本,覆盖视觉、多模态 Agent、工具调用和百万上下文;官方表格仍受自有 harness 限制。

媒体来源厂商自报编辑日期 2026-09-20

测试条件速查

来源具体观察
2026-02-15 Qwen 官方发布;Qwen3.5-Plus 与 Qwen3.5-397B-A17B 同系列,涵盖自然语言、代码、Agent 和多模态任务。
已公布条件
官方未公开每项 prompt、采样、工具 schema、重复次数和完整 harness;阿里云模型页列出文本/图像/视频、函数调用和结构化输出。

关键数据与适用场景

一句话结论

官方将 Qwen3.5-Plus 定位为 Qwen3.5-397B-A17B 的托管 API 版本,优势方向是原生视觉、多模态 Agent、工具调用和百万上下文,但官方 benchmark 不能替代同 harness 复测。

适用场景

  • 适合的任务:图像/视频理解、长文档与代码库处理、编码智能体、工具增强的生产流程。

  • 不适合的任务:需要在本地完整复现托管 API 的内部工具策略,或需要把官方自报分数当成跨模型公平比较。

  • 适用的模型版本:Qwen3.5-Plus;官方博客同时介绍开放权重 Qwen3.5-397B-A17B。

  • 适用的客户端、Agent 或 API:Qwen Chat、阿里云百炼 API,以及自行编排的工具调用 Agent。

  • 推荐的推理档位和参数:官方博客未公开 Plus 的完整请求参数、system prompt 和 harness;应固定 API 快照与工具集合后再测。

测试环境

  • 评测主体:Qwen 官方发布说明中的 Qwen3.5 系列,包含托管的 Qwen3.5-Plus 与开放权重 Qwen3.5-397B-A17B。

  • 输入/任务:官方按自然语言、推理、编程、Agent、多模态理解等类别进行对照;页面可见对照模型包括 GPT-5.2、Claude 4.5 Opus、Gemini-3 Pro、Qwen3-Max-Thinking、K2.5-1T-A32B。

  • 配置:官方正文未完整公开每项 prompt、采样参数、工具 schema、重复次数和评测 harness。

原始证据与数据

  • Qwen3.5-397B-A17B 总参数约 397B,每次前向仅激活约 17B;架构将 Gated Delta Networks 线性注意力与稀疏 MoE 结合。

  • Qwen 官方称语言与方言覆盖从 119 扩展至 201 种;博客将其描述为原生视觉-语言模型,并把 Qwen3.5-Plus 说明为 API 版本。

  • 官方博客把 Qwen3.5-Plus 的上下文窗口列为 1M tokens,并提到官方工具及自适应调用;阿里云模型页进一步列出文本/图像/视频输入、函数调用和结构化输出支持。

  • 页面可见 benchmark 表格的模型列和任务类别,但当前正文抽取只完整保留到部分自然语言表行;未把未完整核验的分数写入本文。

结论

若任务同时需要视觉输入、长上下文和 Agent 工具,Qwen3.5-Plus 值得优先做成本/延迟基线;若任务是纯文本或编码,需用相同 prompt、工具和输出预算与其他模型重跑,不能仅凭官方“前沿模型相当”的叙述选型。

局限

  • 官方发布属于厂商自报,缺少统一公开的完整 prompt、代码、随机种子和逐题产物。

  • 开放权重基线与托管 Plus API 不是同一个服务形态,工具、上下文和推理实现可能不同。

  • 博客页面含动态示例内容,表格正文并非所有行都能从当前页面抽取;缺失分数明确记为未核实。

复现步骤

  1. 使用阿里云百炼固定 qwen3.5-plus-2026-02-15 快照,记录地域、工具白名单、上下文长度、温度和输出上限。

  2. 选择一组公开任务,分别覆盖纯文本、图像理解、函数调用和长上下文检索;公开每个输入和期望输出。

  3. 每题重复至少 3 次,记录成功率、工具参数合法率、延迟、输入/输出 token 和错误类型。

  4. 在相同 API 协议、同等输出预算和相同工具集合下,与目标对照模型复跑;将官方发布表与实测表分开保存。

来源摘录或观察(仅做合规短引)

官方标题把 Qwen3.5 定义为“Towards Native Multimodal Agents”;本文只使用页面直接可核对的架构、模型版本和能力定位,未补写抽取不完整的 benchmark 数字。

能支持的判断

  • 支持在所引 Qwen 快照范围内理解能力定位和接入方向。

不能支持的判断

  • 不能据此得到公平的跨模型胜率,也不能在缺少 harness 时复现托管工具策略。

方法、局限和复现

本文中的数字、任务集、推理档位和客户端条件只在所列来源及采集时点内成立。不同版本、不同 harness 或不同提供商的数据不能直接并排比较;未公开的参数保持未知。

需要复测时,请固定模型版本、提供商或客户端、推理档位、工具、任务集版本、样本数和采集日期,并记录失败、重试与人工修正。完整方法和复现步骤见下方来源笔记。

原始来源

Qwen 官方博客 · Qwen Team · 原文发布日期 2026-02-15 · 本站编辑日期 2026-09-20

打开原始来源

Qwen3.5 Plus

在 Tabbit 中比较 Qwen3.5 Plus

下载 Tabbit 客户端后检查模型可用性

模型深度阅读

总览 · 简体中文

Qwen3.5 Plus 是什么:价格、获取方式与适用边界

用一手与独立来源说明 Qwen3.5 Plus 的托管/开源关系、多模态与工具边界、1M 上下文分段计费、获取方式和安全试用方法。

相关评测

Qwen3.5-Plus:Qubrid 同图同提示的延迟与 token 对照Qubrid 在同图同提示的一次运行中记录 Qwen3.5-Plus 的延迟、token 分配和输出差异;后端快照未公开,因此结论只适用于该 Playground。Qwen3.5-Plus:Digital Applied 跨模型基准与托管/开放权重选型Digital Applied 汇总 Qwen3.5 系列的基准、API 迁移和托管/开放权重取舍;文章没有统一逐题 harness,应视为独立整理。Qwen3.5-Plus:工具调用前置思考提示(跨 Qwen3.5 变体的待验证方案)LocalLLaMA 社区案例把工具调用前的任务拆解、参数核验和结果复查写成 Qwen3.5 Plus 的可复用工作流;它是社区经验,不是默认系统指令。Qwen3.5-Plus:阿里云百炼多模态长上下文与工具调用配置阿里云模型页把 Qwen3.5 Plus 的文本、图像、视频输入、函数调用、结构化输出和百万上下文列为接入边界。