TabbitBlog

Precio de Kimi K3: coste de API, suscripciones y presupuesto

Explicamos el precio de Kimi K3 con tarifas oficiales, caché, planes actuales y ejemplos de coste por tarea.

En este artículo
  1. Resumen rápido
  2. Tarifas oficiales de Kimi K3
  3. Tarjeta oficial de tarifas API
  4. Planes de consumo visibles hoy
  5. La cifra que manda: 15 $ por millón de salida
  6. Qué dice la facturación oficial
  7. Tres presupuestos de ejemplo
  8. Prompt corto y respuesta corta
  9. Primera lectura de un contexto largo
  10. Contexto largo repetido
  11. Escalera de modelos
  12. Suscripción, API o navegador
  13. Lo que observa la comunidad
  14. La cuota se puede sentir como el precio
  15. El mismo plan puede bastar para otra carga
  16. Una opción práctica: comparar en Tabbit
  17. Tabla de decisión
  18. Veredicto

Kimi K3 no es simplemente un modelo de 3 dólares. La tabla oficial muestra 3 $ por millón de entrada sin caché, 0,30 $ por millón de entrada en caché y 15 $ por millón de salida. La escritura de caché cuesta 3 $ por millón con TTL de cinco minutos y 6 $ con TTL de una hora. La cifra que cambia el presupuesto es : la salida cuesta cinco veces la entrada sin caché.

Esta guía cubre precios, no vuelve a evaluar capacidades. Consulta la página del modelo Kimi K3 (English) y la colección de reseñas (English) para las condiciones de las pruebas. Tabbit puede servir para comparar modelos disponibles en la cuenta actual, pero no convierte una suscripción en crédito de API.

Resumen rápido

  • API oficial en USD: 3 $/M de entrada, 0,30 $/M en caché y 15 $/M de salida.

  • Una lectura en caché es barata, pero la primera escritura no es gratis.

  • La membresía es una cuota de producto, no una cartera de tokens.

  • K3 tiene 1.048.576 tokens de contexto; K2.6 aparece con 262.144 y tarifas menores.

  • En prompts cortos suelen pesar la salida y los reintentos; en contexto repetido pesa la caché.

Tarifas oficiales de Kimi K3

Tarjeta oficial de tarifas API

Esta tabla corresponde a la factura por tokens de la API, no a la cuota mensual de Kimi. Separa entrada sin caché, aciertos, escritura y salida; la ventana de contexto es un límite máximo, no el consumo obligatorio de cada solicitud. Las filas K2.7 Code y K2.6 sirven como referencia dentro de la misma tabla oficial.

ModeloEntrada en caché / 1MEscritura 5 min / 1MEscritura 1 h / 1MEntrada / 1MSalida / 1MContexto
K3$0.30$3.00$6.00$3.00$15.001,048,576
K2.7 Code$0.19$0.95$4.00262,144
K2.6$0.16$0.95$4.00262,144

Fuente: documentación oficial de precios, comprobada el 20 de septiembre de 2026. La página de membresía muestra Andante, Moderato, Allegretto y Allegro en CNY; la anualidad se describe como más favorable, con un ahorro de hasta ¥1.680, y no debe convertirse directamente a tarifas de API.página oficial de membresía

Planes de consumo visibles hoy

PlanMensualEnfoque de la página
Andante¥49Acceso de consumo y cuota de producto
Moderato¥99Más funciones y cuota de producto
Allegretto¥199Cuota mayor para uso intensivo
Allegro¥699Nivel personal más alto visible

La cifra que manda: 15 $ por millón de salida

El precio de entrada aparece en titulares, pero una respuesta larga, un bucle de Agent o un reintento aumenta la salida. Usa esta fórmula y guarda los campos de uso del SDK cuando existan:

“La salida domina” describe la diferencia de tarifas, no todos los totales. En el ejemplo de 10.000 tokens de entrada y 2.000 de salida, cada lado aporta 0,03 $. El error más común es convertir los 3 $/M de entrada en un precio por tarea y olvidar las respuestas, los retries, las herramientas y las vueltas fallidas.

coste = (entrada sin caché × 3
       + entrada en caché × 0,30
       + escritura × tarifa correspondiente
       + salida × 15) / 1.000.000
       + herramientas e impuestos

No sustituyas tokens por caracteres visibles. Si solo tienes una aproximación, etiquétala como tal.

Para un presupuesto reproducible guarda entrada sin caché, entrada con acierto, tokens escritos, salida, número de reintentos y herramientas. Con esos campos puedes separar una solicitud fría, una solicitud cálida y un bucle fallido en vez de esconderlos en un promedio único.

Qué dice la facturación oficial

La documentación de precios distingue niveles de facturación de escritura de cinco minutos y de una hora; si no se especifica TTL, el precio documentado toma cinco minutos como valor predeterminado. La guía oficial de troubleshooting dice que la API intenta usar la caché automáticamente: no hace falta enviar un cache ID, TTL ni parámetro adicional. La primera escritura paga la tarifa de escritura; un acierto posterior paga 0,30 $/M y renueva la vida sin otra escritura para ese acierto. Para 500.000 tokens, la lectura fría cuesta 1,50 $, el acierto 0,15 $ y una escritura de una hora añade 3 $.reglas de facturación

Por tanto, no hace falta crear un cache ID ni activar manualmente la función. Mantén estable el prefijo inicial —prompt del sistema, herramientas y documentos— y comprueba el uso real. Los TTL de la tabla son niveles de facturación y retención de la escritura, no parámetros que cada llamada deba enviar.

Tres presupuestos de ejemplo

Estos ejemplos convierten la tarjeta oficial en números que puedes recalcular; excluyen retries, herramientas, impuestos y recargos del proveedor.

Cálculo local

Estima el coste de tokens de la API Kimi K3

Usa las tarifas oficiales en USD verificadas el 20-09-2026. Los valores permanecen en este navegador.

Por tarea$0.06000
Por mes$0.06

La API intenta almacenar en caché automáticamente. La estimación separa la escritura de los aciertos y excluye reintentos, herramientas, impuestos y recargos. Ver tarifas actuales

El cálculo se ejecuta en este navegador y no envía tus valores. Separa los aciertos automáticos de la escritura de caché y excluye retries, herramientas, impuestos y recargos; comprueba la tarifa oficial antes de fijar un presupuesto.

Prompt corto y respuesta corta

10.000 tokens de entrada y 2.000 de salida cuestan (10.000×3+2.000×15)/1.000.000 = 0,06 $: entrada y salida aportan 0,03 $ cada una. En una tarea única, medir salida y retries suele ser más útil que diseñar una caché que casi nunca se reutiliza.

Primera lectura de un contexto largo

500.000 tokens sin caché y 20.000 de salida cuestan 1,80 $. Si el prefijo se escribe, añade la tarifa de escritura correspondiente; separa el arranque frío de las solicitudes posteriores.

Contexto largo repetido

Con los mismos 500.000 tokens en un acierto y 20.000 de salida, el cálculo baja a 0,45 $. El ahorro está en la entrada, pero una respuesta larga o una traza de herramientas sigue aumentando la salida. Son ejemplos matemáticos, no una garantía de producción.

Escalera de modelos

K2.6 es más barato en la tabla oficial, pero su contexto es menor. Si tus datos caben en 262k tokens, prueba primero una tarea con criterios de aceptación usando la guía de prompts de API (English). Para una secuencia de varios pasos, consulta la guía de configuración de Agent (English) y la evaluación de codificación real (English). Un precio menor no demuestra que el resultado sea intercambiable.

K2.7 Code comparte en esa tabla las tarifas de K2.6, pero la etiqueta, la ventana y el resultado práctico siguen necesitando una prueba separada. Si un límite de 262k obliga a truncar, recuperar o llamar otra vez, el precio por millón puede dejar de ser el coste total más importante. Prueba una respuesta corta, una pregunta sobre documentos largos y un loop con herramientas antes de elegir por precio.

Suscripción, API o navegador

Las páginas oficiales separan las membresías, la pestaña API y la tabla de desarrolladores. Además, muestran monedas y condiciones distintas. En Reddit, unos usuarios describen las cuotas como el problema principal; otros dicen que un plan caro sostiene bucles de Agent durante horas. Son experiencias personales, no cuotas verificadas.reseña comunitaria (English)

La membresía sirve para funciones y límites del producto; la API sirve para claves, usage, reintentos y una factura auditable; el navegador reúne páginas, pestañas y selección de modelo. Ninguna de esas superficies convierte automáticamente un saldo en otro. Un precio mensual no permite inferir cuántos loops de API caben, y una tarifa API no define las funciones de la membresía.

La publicación de u/thegodkingreal critica los límites. u/Timely_Impression_92 describe bucles de varias horas, mientras u/Moppmopp dice que un plan de 200 dólares puede agotarse rápidamente. u/the_stamp_collector informa de horas de uso sin problemas. Web3 Wesley en YouTube plantea la comparación con Claude. Son voces personales, recopiladas el 20 de septiembre de 2026; el vídeo habla de tres meses con el plan Moonshot de 19 dólares junto a Claude y Codex. No verifican cuotas, versión actual ni ROI general.

Lo que observa la comunidad

La cuota se puede sentir como el precio

Estos relatos muestran opiniones opuestas sobre la misma superficie de precio; no sustituyen una cuota publicada.

u/thegodkingreal califica el límite de uso de “ridiculous usage cap”, mientras u/Moppmopp dice que un plan de 200 dólares puede agotarse en medio día. Ambos relatos apuntan al número de loops útiles que una persona puede terminar, no a la tarifa por token. No incluyen una cuota verificable, un contrato o una prueba de versión actual.

El mismo plan puede bastar para otra carga

u/Timely_Impression_92 dice estar satisfecho con un plan de 200 dólares para loops de Agent de varias horas; u/the_stamp_collector afirma usar Kimi durante horas cada día sin problemas. Web3 Wesley plantea si Kimi Code puede sustituir una suscripción de Claude de 100 dólares y describe tres meses con el plan Moonshot de 19 dólares junto a Claude y Codex. Son testimonios fechados y personales, no una cuota común ni un ROI universal.

Una opción práctica: comparar en Tabbit

Si la cuenta actual permite usar K3, puedes abrir la página de Kimi K3 en Tabbit (English), revisar la colección de prompts (English) y comparar una misma tarea con varios modelos. La comparación ayuda a definir el trabajo; no revela una cuota oculta ni garantiza acceso.

Un flujo repetible fija el mismo prompt y la misma aceptación: primero una respuesta corta, después una pregunta sobre un documento largo y finalmente una solicitud de código por etapas. Registra longitud, retries, correcciones humanas y tiempo de finalización. Eso prueba la adecuación de la tarea en el navegador; no es una factura de Kimi ni garantiza que el modelo esté disponible en todas las cuentas.

Chat multimodelo de Tabbit con Kimi K3 junto a otros modelos

Tabbit Browser

Para otra discusión de contexto largo, consulta el artículo de GPT-5.6 Sol, que no es una fuente de precios de K3.

Tabla de decisión

CargaCoste dominantePrimer caminoRiesgo
Prompt y respuesta cortosSalida y reintentosAPI con límite de salidaLa salida vale 5× la entrada
Prefijo largo repetidoEscritura, TTL y aciertosAPI con registro de hits y escriturasLa escritura fría no es un acierto
Más de 262k tokensContexto y número de llamadasComparar K3 con truncamientoEl modelo caro puede reducir llamadas
Bucle de AgentSalida, cuota y concurrenciaProbar un bucle representativoLa experiencia varía entre usuarios
Investigación ocasionalFunciones y cuota de membresíaComparar la página actualMembresía no es facturación de API
Trabajo multimodelo en navegadorAcceso, ajuste y tiempo de configuraciónProbar modelos compatibles en TabbitDepende de la cuenta y la edición actuales

Veredicto

Presupuesta K3 cuando su contexto de 1M y su capacidad compensen la línea de 15 $/M de salida. Si el trabajo cabe en K2.6 y pasa tus pruebas, mide primero la opción barata. Construye tres escenarios: solicitud fría, solicitud con caché y bucle con reintento; después vuelve a comprobar la tarifa API oficial y la página de membresía.

Las cifras son una instantánea comprobada el 20 de septiembre de 2026. Tarifas USD, planes CNY, impuestos, región, elegibilidad, herramientas y disponibilidad pueden cambiar por separado. Guarda la fecha de cada tarifa y el usage real; la comunidad y una prueba en Tabbit sirven para diseñar un piloto, no para reemplazar las fuentes oficiales.

Preguntas frecuentes

¿Cuál es el precio oficial de la API de Kimi K3?

La tabla oficial muestra 3 dólares por millón de tokens de entrada sin caché, 0,30 dólares por millón de entrada en caché y 15 dólares por millón de salida. Las escrituras de caché se cobran aparte según el TTL.

¿Cuánto ahorra una entrada en caché?

La entrada con caché cuesta 0,30 dólares por millón frente a 3 dólares sin caché. Es una diferencia de diez veces en esa línea, pero la primera escritura y la salida siguen contando.

¿Kimi K3 cobra la escritura de caché?

Sí. La tabla oficial separa la escritura de cinco minutos y de una hora. La API intenta usar caché automáticamente y no requiere cache ID, TTL ni parámetro extra; una escritura y un acierto posterior se cobran de forma distinta.

¿Una suscripción de Kimi incluye crédito de API?

No. La suscripción ofrece funciones y cuotas de producto, mientras que la API factura por tokens. La página personal actual muestra Andante a ¥49/mes, Moderato a ¥99, Allegretto a ¥199 y Allegro a ¥699; la facturación anual solo se describe como más favorable, con un ahorro de hasta ¥1.680, así que hay que comprobar el importe exacto en vivo.

¿Kimi K3 puede salir más caro que K2.6?

Sí. K2.6 aparece con tarifas menores y una ventana de 262.144 tokens, mientras que K3 ofrece una ventana de 1.048.576 tokens. La comparación debe incluir llamadas, truncamiento y calidad aceptable.

¿Puede cambiar el precio de Kimi K3?

Sí. Región, impuestos, elegibilidad, cuotas y herramientas pueden cambiar por separado. Comprueba las páginas oficiales antes de presupuestar o comprar.

Da el siguiente paso

Deja que Tabbit trabaje junto a ti.

Investiga entre pestañas, automatiza el trabajo repetitivo del navegador y mantén todo el contexto al alcance.