Qwen3.5 Plus 是阿里云托管的 Qwen3.5-397B-A17B 生产路线。它适合试验同时需要多模态输入、工具调用和大工作集的任务,但关键不在 397B 这个数字。托管路线和开源权重有不同默认值、部署成本和证据边界。
真正的决策锚点是计费与部署边界:阿里云当前 Model Studio 表在 128K 和 256K 输入处调整 Qwen3.5 Plus 价格,而一手模型卡列出权重原生 262,144 token、可扩展到 1,010,000。所谓“1M 上下文”是带价格曲线的容量,不代表所有客户端都能低成本接受一百万 token。先看 Qwen3.5 Plus 模型资源,再固定实际调用的路线、地区和日期模型 ID。
关键结论
阿里巴巴于 2026 年 2 月 16 日发布 Qwen3.5,发布稿称 Qwen3.5-397B-A17B 也叫 Qwen3.5-Plus。
Hugging Face 模型卡列出总参数 397B、激活 17B、原生多模态输入、Apache-2.0、262K 原生上下文和最高约 1.01M 扩展上下文。
托管 Qwen3.5 Plus 对应该权重,但增加默认 1M 上下文、官方内置工具和自适应工具使用。
Model Studio 是分段计费;Global 的 2026-02-15 路线在 128K 和 256K 处上调,International 另有费率表。
证据仍有限:BenchLM 表示 435 个跟踪槽位只有 4 个显示可用证据;社区报告从工具调用有效到本地运行缓慢或循环不等。
API、自己部署、Qwen 聊天/编码套餐、第三方提供商与 Tabbit Browser 是不同产品。
Qwen3.5 Plus 规格速览
Qwen3.5 Plus 提示词与评测资源保存模型专属材料,但不能证明你的提供商、工作区或 Tabbit 选择器提供所有路线。
| 项目 | 一手资料当前说法 | 需要保留的边界 |
|---|---|---|
| 模型关系 | 托管 Plus 对应 Qwen3.5-397B-A17B | 托管默认值和本地部署不是同一产品。 |
| 发布锚点 | 2026-02-16 | 发布日期不等于账户有权限。 |
| 模型规模 | 总 397B / 激活 17B,稀疏 MoE 与视觉编码器 | 参数量不能直接预测延迟或成本。 |
| 模态 | 模型卡为原生文本与图片,并提供视频示例 | 提供商格式、采样和多模态 harness 仍需核对。 |
| 上下文 | 权重原生 262,144,可扩展到 1,010,000;托管 Plus 默认 1M | 客户端、地区和提供商可能缩小有效窗口。 |
| 托管功能 | Plus 列出官方内置工具和自适应工具使用 | 工具 schema 和权限属于调用路线。 |
| 开源许可 | 模型卡为 Apache-2.0 | 硬件、量化和服务软件仍由部署者负责。 |
权重与托管路线的变化
更准确的说法是“生产托管兄弟”,不是“另一个 397B 模型”。开源权重可以下载,并用 Transformers、vLLM 或 SGLang 等服务;模型卡则说明托管 Plus 默认增加 1M 上下文、官方内置工具和自适应工具使用。
这会改变选型。本地测试可能是 262K 上下文、量化权重、自定义工具解析器和特定硬件速度;Model Studio 调用则可能是另一种上下文默认值、计费层级、地区政策和工具表面。可参考智能体推理指南设计验收,但仍要固定服务路线。
Qwen3.5 是原生多模态模型,而不是纯文本模型外挂独立视觉产品。发布材料将其定位为推理、编码、Agent 和多模态理解模型,模型卡包含图片与视频请求示例。这支持用固定截图、文档或短视频做试验,但不证明每个提供商接受相同格式、分辨率、视频采样或工具组合。
评测证据不要混分母
BenchLM 的 2026 年 9 月页面跟踪托管 API 的 DeepPlanning 证据,但 435 个评测槽位只有 4 个可显示证据。Design for Online 记录 1M 上下文、视觉、视频和工具调用,并建议控制性试点,因为模型专属独立数据有限。AI Tool Briefing 称作者在结构化抽取任务中运行了 API 托管 397B 变体,这可作为场景线索,不是通用分数。
Qwen AgentWorld 仓库也报告了 Qwen3.5-397B-A17B 在其命名 Agent 基准上的结果,需保留任务、工具、验证器和版本边界。Qwen3.7 Max 总览与Qwen3.8 Max 总览是不同日期和路线,不能拼成 Qwen 家族总排名。
获取与计费不要混在一起
Model Studio 是一手托管入口。当前 Global 表中 qwen3.5-plus-2026-02-15 与 qwen3.5-plus 等价,并按百万 token 显示:
| Global 输入范围 | 输入 | 思考输出 | 非思考输出 | 变化 |
|---|---|---|---|---|
| 0–128K | CNY 0.8 | CNY 4.8 | CNY 4.8 | 最低层级,免费额度另有条件。 |
| 128K–256K | CNY 2 | CNY 12 | CNY 12 | 输入和输出都上调。 |
| 256K–1M | CNY 4 | CNY 24 | CNY 24 | 长上下文任务账单明显不同。 |
同一价格页的 International 表另列 CNY 2.936 输入、17.614 输出(至 256K),超过 256K 为 3.67 和 22.018。预算前要确认组织所属地区和页面展示币种,不能把独立页面换算的美元价格当作阿里云统一价格。
其他路线也要分开:自己部署要承担权重、量化、显存、电力和工程;Qwen Studio 或 Coding Plan 有独立额度和凭据;第三方提供商有别名、回退、数据政策与价格;Tabbit 是浏览器产品,不提供 Model Studio 额度。
场景自检与社区信号
| 场景 | 首次试验 | 验收条件 |
|---|---|---|
| 多模态文档抽取 | 固定图片/短视频包与字段 schema | 字段、引用和不确定性符合人工核对 fixture。 |
| 工具调用 Agent | 单一窄工具、dry-run、临时工作区 | 参数正确、调用有上限、未经确认不产生外部副作用。 |
| 长上下文研究 | 跨过 128K/256K 边界的来源包 | 结论可追溯,并比较接受结果和总 token。 |
| 本地部署 | 固定量化权重和硬件 | 质量、内存、速度和失败恢复达到阈值。 |
| 编码流程 | 小型仓库、干净分支和测试 | 测试通过、diff 不越界、工具循环遵守停止条件。 |
Reddit 反馈存在明显条件:有人在本地测试中认为图片理解和工具调用有效,约 17 tok/s;同一讨论也有人觉得“so-so, kind of ‘meh’”。另一位开发者因价格与免费入口比较 Qwen3.5 Plus、Step3.5 Flash 和 ChatGPT 5.4,目标是 Agent 编码而非排行榜。还有本地用户报告思考循环 30 分钟后停止,回复将问题归因于量化和工具模板。一个赞助视频演示库存 Agent、图片支持与部署,但不能作为独立可靠性证据。
Tabbit Browser 的边界
如果工作从网页、标签组、截图或本地文件开始,Tabbit Browser可以作为独立产品层。它不会提供 Model Studio 额度、改变 Qwen 价格,也不会把本地权重变成托管模型。本文没有用已登录账户实测,因此不声称选择器、有效上下文、延迟、工具或配额。若实时选择器出现模型,先用公开且可回滚的小任务和固定 fixture 比较。
更广泛的流程可看 AI 浏览器指南、浏览器自动化指南和智能体推理指南。产品层和模型路线应在测试记录与账单中保持分离。
未知风险与结论
别名漂移:公开别名可能指向新的日期版本,比较时固定
qwen3.5-plus-2026-02-15或组织返回的完整 ID。托管/本地漂移:托管 1M 不代表量化本地权重有相同上下文或工具行为。
长上下文成本:128K、256K 价格阶梯会让长工作集成本明显上升。
工具安全:工具提供动作入口,不代表授权;使用最小权限、dry-run 和硬停止。
独立证据稀疏:少量目录数据和个人报告无法证明跨任务生产可靠性。
Qwen3.5 Plus 值得用于多模态抽取、结构化工具和长上下文任务的控制性试点。它的价值在于托管/开源关系和生产工具默认值,代价则是原生 262K、托管 1M 与分段计费之间的边界。保持 Model Studio、自托管、Qwen 订阅、第三方提供商和 Tabbit 分开,先用可回滚 fixture 验证,再判断结果是否值得成本和复核负担。
来源与问题
主要来源是阿里巴巴 Qwen3.5 发布、Qwen3.5-397B-A17B 模型卡和Model Studio 价格页。独立来源包括 BenchLM、Design for Online和 AI Tool Briefing。
Qwen3.5 Plus 与 Qwen3.5-397B-A17B 相同吗?
它是对应权重的托管路线,并增加 1M 上下文、内置工具和自适应工具使用等生产默认值。自托管的上下文、硬件、量化和工具行为不同。
它是开源模型吗?
Qwen3.5-397B-A17B 模型卡发布 Apache-2.0 权重,但这不代表 Model Studio、Qwen 套餐或第三方端点免费或相同。
Qwen3.5 Plus 真的有 1M 上下文吗?
模型卡列出权重原生 262,144,可扩展到 1,010,000;托管 Plus 默认写为 1M。仍需确认地区和客户端的有效上限。
为什么 128K 和 256K 会涨价?
Model Studio 按输入长度分层计费。Global 2026-02-15 路线在 0–128K、128K–256K、256K–1M 使用不同费率,International 另有表。
它适合编码 Agent 吗?
可以做工具和编码控制性试验,但本地反馈受量化、硬件、思考模式和工具模板影响。使用临时分支、窄工具和测试。
能在 Tabbit 使用吗?
本文没有验证已登录 Tabbit 会话。请查看实时选择器,把一次成功任务当作账户观察,而非平台保证。
常见问题
Qwen3.5 Plus 是什么?
Qwen3.5 Plus 是阿里云托管的生产路线,对应 Qwen3.5-397B-A17B 开源权重。托管路线增加默认 1M 上下文、官方内置工具和自适应工具使用;本地权重的上下文、硬件和部署要求不同。
Qwen3.5 Plus 是开源模型吗?
Qwen3.5-397B-A17B 在 Hugging Face 以 Apache-2.0 发布。Qwen3.5 Plus 是带生产特性的 Model Studio 托管路线,因此开源权重和托管服务有关联但不能互换。
Qwen3.5 Plus 的上下文上限是多少?
模型卡列出权重原生 262,144 token,并可扩展到 1,010,000 token;托管 Plus 默认宣传 1M。地区、提供商或客户端可能暴露更小的有效上限。
Qwen3.5 Plus 如何收费?
阿里云当前 Model Studio 表按 128K 和 256K 输入分段。Global 表中 2026-02-15 路线低于 128K 为输入/思考输出/非思考输出 CNY 0.8/4.8/4.8,128K–256K 为 2/12/12,256K–1M 为 4/24/24。
它适合编码和 Agent 吗?
它值得用固定代码仓库、窄工具、预算和可回滚验收条件做多模态、工具调用和 Agent 编码试验,但独立评测与社区材料都受任务和模型变体影响。
能在 Tabbit Browser 使用 Qwen3.5 Plus 吗?
本文没有用已登录 Tabbit 账户实测 Qwen3.5 Plus,因此不声称选择器或可用性。请查看实时选择器,并先验证一个可回滚的小任务。