LongCat 2.0 merece un piloto si necesitas contexto largo, pesos abiertos o una ruta de agentes barata. No es una decisión de “modelo de frontera barato”: la ruta, el formato de herramientas, los datos y la revisión humana importan tanto como el precio por token.
El ancla es el anuncio oficial del 30-06-2026 y la tarjeta comprobada el 20-09-2026: 1,6T de parámetros, unos 48B activos, contexto de 1M y licencia MIT. Ese día OpenRouter mostraba 0,30/1,20 dólares por millón de tokens de entrada/salida. No confundas esas cifras con una sesión de Tabbit, una máquina propia o una cuenta de primera parte. Empieza por la página del modelo LongCat 2.0 (English).
Resumen rápido
Pesos abiertos, contexto de 1M y ejemplos de Transformers, vLLM y SGLang.
Los benchmarks oficiales describen un alcance; no son un ranking independiente.
El precio de OpenRouter es una instantánea fechada y no sustituye la política de datos.
Hay informes de buen trabajo agéntico, pero también de código defectuoso, repetición y fricción de integración.
Usa un repositorio pequeño, una parada explícita y revisión humana antes de ampliar el bucle.
Especificaciones y rutas
| Campo | Dato comprobado | Límite |
|---|---|---|
| Modelo | MoE disperso; 1,6T total y 48B activos | No predice por sí solo latencia ni coste total. |
| Contexto | 1M en tarjeta y proveedor | Cliente y memoria pueden reducirlo. |
| Licencia | MIT y pesos publicados | El equipo sigue asumiendo infraestructura y seguridad. |
| Señal de código | Terminal-Bench 70,8; SWE-Bench Pro 59,5 | No predice tu repositorio. |
| Ruta OpenRouter | 0,30/1,20 dólares por millón, AtlasCloud listado | Precio y telemetría son dinámicos. |
La explicación del navegador agéntico separa un navegador asistido de una API. Para comparar rutas, consulta comparación de navegadores IA y prácticas de Tabbit Browser.
Qué cambia y qué dicen las pruebas
El anuncio describe LongCat Sparse Attention con indexación consciente del streaming, entre capas y jerárquica, además de un componente N-gram Embedding de 135B. La tarjeta menciona entrenamiento con cientos de miles de millones de tokens de contexto 1M. También nombra Claude Code, OpenClaw y Hermes. Es una señal de orientación a repositorios y herramientas, no una garantía de que cada harness acepte el mismo wrapper. Para tareas públicas, revisa los prompts de LongCat (English), sin copiar instrucciones del sistema.
La tabla oficial reporta Terminal-Bench 2.1 70,8; SWE-Bench Pro 59,5; SWE-Bench Multilingual 77,3; FORTE 73,2; BrowseComp 79,9; RWSearch 78,8 e IFEval 90,0. La tarjeta dice que los valores sin asterisco son internos; el anuncio especifica Claude Code, 8c16g y seis horas para Terminal-Bench, 4c8g y tareas corregidas para SWE-Bench, y 15 ocupaciones con 45 minutos para FORTE. Es metodología útil, pero no replicación independiente. Consulta las condiciones en las reseñas de LongCat (English).
Precio, acceso y riesgos
Autohospedar ofrece control sobre código y documentos, pero deja hardware, cuantización, observabilidad y actualizaciones de tu lado. Eesel describió el 04-08-2026 una ruta promocional y restricciones regionales; úsalo como lista de preguntas, no como factura actual. OpenRouter mostraba entrada/salida 0,30/1,20, lectura de caché 0,006, 1M y AtlasCloud el 20-09-2026; eso es una ruta, no un SLA del modelo.
Tabbit es otra sesión de producto. No se ejecutó una tarea autenticada ni se capturaron cuatro-ocho capturas válidas, así que no afirmamos disponibilidad, latencia, calidad ni precio de LongCat en Tabbit. El primer paso debe ser una tarea pública y reversible. La automatización de navegador ayuda a separar el flujo de la facturación de API.
Reddit registró un gasto personal de unos 2 dólares por 50M tokens, sin factura ni muestra repetida. Otro usuario elogió la obediencia en role-play no pensante, pero observó repetición. Un post de X describió un buen resultado de física visual en una prueba compartida sin publicar su rúbrica. Eesel también recoge opiniones positivas y negativas sobre programación; son señales para un piloto, no un ranking. Usa investigación agéntica para diseñar tu propia rúbrica.
Comprueba antes de desplegar: retención, entrenamiento, residencia y SLA; reconocimiento de <longcat_tool_call>; idioma de respuestas de búsqueda; y costes de hardware, energía y reintentos. Un máximo de 1M no hace automáticamente barata o estable una entrada de 1M.
Autoevaluación y siguiente paso
| Caso | Prueba inicial |
|---|---|
| Equipo con GPU | Entorno aislado, versión cuantizada, memoria y throughput medidos. |
| Agente de código | Repositorio pequeño, diff fijo, tests y revisión de cada herramienta. |
| Investigación/RAG | Corpus fechado, enlaces y rúbrica de citas. |
| Privacidad empresarial | Términos vigentes por escrito antes de subir documentos. |
Si aparece LongCat 2.0 en tu cuenta, abre una documentación pública, pide cinco puntos con enlaces y compruébalos manualmente. Registra modelo, fecha, ruta, contexto, latencia, reintentos y correcciones; no concedas escritura en la primera sesión.
Veredicto
LongCat 2.0 es un candidato razonable para un piloto de código, investigación y agentes con contexto largo. Los pesos abiertos y la instantánea de precios facilitan probarlo, pero las herramientas, la calidad aceptada y los términos de datos deben validarse en la ruta real. No conviertas 0,30 dólares de entrada en el contrato operativo completo. Revisa también la colección de reseñas de LongCat (English).
Fuentes
Preguntas frecuentes
¿Qué es LongCat 2.0?
Es un modelo sparse mixture-of-experts de Meituan con licencia MIT. La tarjeta oficial indica 1,6 billones de parámetros totales, unos 48.000 millones activos por token y una ventana de un millón de tokens.
¿LongCat 2.0 es de código abierto?
La tarjeta de Hugging Face publica los pesos con licencia MIT y ejemplos para Transformers, vLLM y SGLang. Los pesos abiertos no eliminan el coste de hardware, servicio y seguridad.
¿Cuánto cuesta LongCat 2.0?
OpenRouter mostraba el 20 de septiembre de 2026 0,30 dólares por millón de tokens de entrada y 1,20 de salida. Es una instantánea de proveedor, no una tarifa universal ni un precio de Tabbit.
¿Sirve para agentes de código?
La tabla oficial indica 70,8 en Terminal-Bench 2.1 y 59,5 en SWE-Bench Pro bajo sus propios harnesses. Prueba primero un repositorio reversible con criterios de aceptación.
¿Protege los datos de la API?
Las fuentes públicas revisadas no establecen una política completa de retención, entrenamiento, residencia o SLA. Confirma los términos del proveedor antes de enviar material confidencial.
¿Puedo usarlo en Tabbit?
No se ejecutó una tarea autenticada de LongCat 2.0 en Tabbit para este artículo. Comprueba el selector y las condiciones de la cuenta en vivo.