Qwen3.5 Plus es la ruta gestionada de producción de Alibaba Cloud para Qwen3.5-397B-A17B. Conviene probarlo cuando una tarea necesita entrada multimodal, llamadas a herramientas y un contexto amplio, pero pesos locales y servicio alojado tienen límites y costes diferentes.
La cifra decisiva no es 397B: es la curva de precio. La tabla actual de Model Studio cambia en 128K y 256K, mientras la ficha de primera parte indica 262.144 tokens nativos y extensión hasta 1.010.000. “1M de contexto” es capacidad con coste, no una promesa de que cada cliente acepte un millón barato. Empieza por el recurso de Qwen3.5 Plus (English) y fija ruta, región e ID fechado.
Puntos clave
Alibaba publicó Qwen3.5 el 16 de febrero de 2026 y también llamó Qwen3.5-Plus al 397B-A17B.
La ficha lista 397B totales, 17B activos, entrada multimodal, licencia Apache-2.0, 262K nativos y extensión aproximada a 1,01M.
Plus añade por defecto contexto de 1M, herramientas integradas y uso adaptativo de herramientas.
La tarifa de Model Studio es escalonada; la tabla International es distinta de Global.
La evidencia independiente es escasa: BenchLM solo muestra 4 de 435 espacios de evaluación, y los usuarios describen resultados desde buen tool calling hasta bucles locales lentos.
API, pesos propios, planes de Qwen, proveedores y Tabbit son productos separados.
Especificaciones y relación con el checkpoint
Las prompts de Qwen3.5 Plus (English) y las reviews (English) conservan material por modelo; no demuestran que tu proveedor o selector de Tabbit exponga todas las rutas.
| Elemento | Respuesta de primera parte | Límite |
|---|---|---|
| Relación | Plus es la ruta alojada de Qwen3.5-397B-A17B | El servicio y el despliegue local no son iguales. |
| Fecha | 16 de febrero de 2026 | Publicación no equivale a autorización de cuenta. |
| Forma | 397B totales / 17B activos, MoE con visión | El tamaño no predice coste ni latencia. |
| Contexto | 262.144 nativos, extensión a 1.010.000; Plus anuncia 1M | Cliente y región pueden reducirlo. |
| Herramientas | Integradas y adaptativas en la ruta Plus | Los esquemas y permisos son del proveedor. |
| Licencia | Apache-2.0 para el checkpoint | Hardware, cuantización y software corren por tu cuenta. |
El modelo es multimodal de forma nativa. La tarjeta incluye ejemplos de imagen y vídeo, y el anuncio lo posiciona para razonamiento, código, agentes y comprensión multimodal. Eso permite un piloto con documentos, capturas o clips fijos; no demuestra que todos los proveedores acepten el mismo formato, resolución o muestreo.
Evidencia, acceso y precios
BenchLM registra evidencia de DeepPlanning pero advierte que solo 4 de 435 celdas son visibles. Design for Online recomienda pilotos controlados por la falta de datos independientes específicos; AI Tool Briefing describe extracción estructurada con la variante API 397B. Qwen AgentWorld aporta otra medición con su propio agente y verificador. No mezcles estos denominadores con Qwen3.7 Max o Qwen3.8 Max, que son snapshots distintos.
La tabla Global para qwen3.5-plus-2026-02-15 muestra por millón de tokens:
| Entrada | Input | Output thinking | Output no thinking |
|---|---|---|---|
| 0–128K | CNY 0,8 | CNY 4,8 | CNY 4,8 |
| 128K–256K | CNY 2 | CNY 12 | CNY 12 |
| 256K–1M | CNY 4 | CNY 24 | CNY 24 |
La tabla International muestra CNY 2,936/17,614 hasta 256K y 3,67/22,018 por encima. Confirma región y moneda antes de presupuestar. El autoalojamiento añade hardware y operación; Qwen Studio/Coding Plan tiene cuota propia; un proveedor externo puede cambiar alias, fallback y política; Tabbit no concede créditos de Model Studio.
Autocomprobación y comunidad
| Caso | Primer piloto | Aceptación |
|---|---|---|
| Extracción multimodal | Paquete fijo de imágenes y esquema de campos | Campos, citas e incertidumbre coinciden con revisión manual. |
| Agente con herramientas | Una herramienta estrecha, dry-run y carpeta desechable | Argumentos correctos, llamadas limitadas, sin efecto externo sin confirmación. |
| Investigación larga | Paquete que cruce 128K y 256K | Citas trazables y coste total comparado. |
| Código | Rama limpia, tarea pequeña y tests | Diff en alcance, tests y parada sin bucles. |
Reddit mezcla experiencias: un usuario local reporta visión y tool calling a unos 17 tok/s, mientras otro dice “so-so, kind of ‘meh’”. Otro desarrollador compara Qwen3.5 Plus, Step3.5 Flash y ChatGPT 5.4 por precio y código agéntico. Un reporte local describe un bucle de razonamiento de 30 minutos. Un vídeo patrocinado muestra un agente de inventario y despliegue, pero no es prueba independiente.
Tabbit como capa de navegador
Tabbit Browser puede ser una capa separada para páginas, pestañas, capturas y archivos. No cambia el precio de Qwen ni aporta créditos. Este borrador no probó una cuenta autenticada; si el modelo aparece, empieza con una tarea pública y reversible. Consulta también la guía de navegador IA, la automatización del navegador y la guía de razonamiento agéntico.
Riesgos y veredicto
El alias puede cambiar de snapshot; 1M alojado no equivale a 1M local; los saltos de precio encarecen el contexto largo; las herramientas no son autorización; la evidencia independiente es limitada. Qwen3.5 Plus merece un piloto en extracción multimodal, herramientas estructuradas y contexto largo si puedes definir un criterio de aceptación. Mantén separadas API, pesos, planes, proveedores y Tabbit, y conserva el modelo solo cuando el resultado aceptado justifique el coste y la revisión.
Fuentes y preguntas
Fuentes primarias: anuncio de Alibaba, ficha del modelo y precios de Model Studio. Contexto independiente: BenchLM, Design for Online y AI Tool Briefing.
¿Es lo mismo que Qwen3.5-397B-A17B?
Es la ruta alojada correspondiente, con contexto 1M, herramientas integradas y uso adaptativo. El despliegue local tiene otros límites.
¿Es de código abierto?
Los pesos 397B-A17B tienen Apache-2.0; el servicio, plan o proveedor no es automáticamente gratuito ni idéntico.
¿Tiene realmente contexto 1M?
La ficha indica 262.144 nativos y extensión a 1.010.000; Plus anuncia 1M. Comprueba el límite efectivo.
¿Por qué sube el precio en 128K y 256K?
Model Studio factura por tramos de entrada y la tabla International es distinta de Global.
¿Sirve para agentes de código?
Merece un piloto, pero cuantización, hardware, modo de pensamiento y plantillas de herramientas cambian el resultado.
¿Puedo usarlo en Tabbit?
No se verificó una sesión autenticada; comprueba el selector y trata una ejecución como observación local.
Preguntas frecuentes
¿Qué es Qwen3.5 Plus?
Qwen3.5 Plus es la ruta gestionada de producción de Alibaba Cloud correspondiente al checkpoint abierto Qwen3.5-397B-A17B. La ruta alojada añade 1M de contexto por defecto, herramientas oficiales y uso adaptativo de herramientas; el checkpoint local tiene requisitos distintos.
¿Es de código abierto?
El checkpoint Qwen3.5-397B-A17B está publicado bajo Apache-2.0. Qwen3.5 Plus es la ruta gestionada de Model Studio, de modo que pesos abiertos y servicio alojado están relacionados pero no son intercambiables.
¿Cuáles son los límites de contexto?
La ficha indica 262.144 tokens nativos y extensión hasta 1.010.000 para el checkpoint. La ruta Plus alojada anuncia 1M por defecto, pero el cliente, región o proveedor puede ofrecer menos.
¿Cuánto cuesta?
La tabla actual de Model Studio cambia los precios en 128K y 256K de entrada. Para Global, la ruta 2026-02-15 muestra 0,8/4,8/4,8 CNY por millón por debajo de 128K, 2/12/12 entre 128K y 256K, y 4/24/24 entre 256K y 1M.
¿Sirve para código y agentes?
Merece un piloto controlado para extracción multimodal, herramientas y código agéntico, pero las pruebas independientes y comunitarias dependen de la tarea y la variante. Usa un fixture fijo, herramientas acotadas, presupuesto y aceptación reversible.
¿Puedo usarlo en Tabbit Browser?
Este borrador no ejecutó una tarea autenticada de Qwen3.5 Plus en Tabbit. Comprueba el selector en vivo y verifica una tarea pequeña y reversible antes de depender de esa ruta.