TabbitBlog

Precio de Gemini 3.8 Flash: el aumento 2× de 2027 y coste por tarea

Fórmulas y ejemplos para calcular el coste de Gemini 3.8 Flash, incluido thinking, caché, Batch y Flex.

En este artículo
  1. Puntos clave
  2. Tarifas
  3. Dos ejemplos reproducibles
  4. Batch, Flex, herramientas y reintentos
  5. Tabbit como capa de navegador
  6. Comparación de cargas
  7. Qué aportan los creadores
  8. Debate comunitario sobre el coste por tarea
  9. Escalera familiar, esfuerzo y límites de cobro
  10. Dos cargas de trabajo con supuestos explícitos
  11. Después del cálculo, elige dónde ejecutar el flujo
  12. Fuentes y siguiente paso

El precio de Gemini 3.8 Flash depende del uso real. Hasta el 31 de diciembre de 2026, el API Standard cobra 0,75 USD por millón de tokens de entrada y 3,75 USD por millón de tokens de salida. La salida ya incluye thinking. La lectura de caché cuesta 0,075 USD y guardar la caché cuesta 0,50 USD por millón de tokens-hora. Desde el 1 de enero de 2027, Google publica el doble de esas tarifas Standard.

La fórmula es: (entrada sin caché×tarifa + lectura de caché×tarifa + salida con thinking×tarifa)/1.000.000 + almacenamiento. La suscripción de Gemini y el coste de Tabbit no son créditos del API.

Página oficial de Google, capturada el 2026-09-20; especificaciones, no una prueba de inferencia en Tabbit.
Página oficial de Google, capturada el 2026-09-20; especificaciones, no una prueba de inferencia en Tabbit.

Puntos clave

  • Thinking se cuenta una sola vez dentro de la salida.

  • Batch y Flex son modos separados; sus descuentos no se multiplican.

  • El presupuesto mensual incluye tareas, reintentos, herramientas y horas de almacenamiento.

  • Consulta la página oficial de precios y la página del modelo.

Tarifas

ConceptoHasta 2026-12-31Desde 2027-01-01Unidad
Entrada Standard$0.75$1.501M tokens
Salida Standard, incluido thinking$3.75$7.501M tokens
Lectura de caché$0.075$0.151M tokens
Almacenamiento de caché$0.50$1.001M tokens-hora
Entrada Batch$0.375$0.751M tokens
Salida Batch$1.875$3.751M tokens
Lectura Batch$0.0375$0.0751M tokens

La tabla de Google separa Standard, Batch, Flex y Priority. Que el modelo admita Batch o Flex no cambia automáticamente una petición Standard.

Dos ejemplos reproducibles

Para 200.000 tokens de entrada sin caché y 20.000 tokens de salida total, en Standard 2026:

(0,2×$0,75) + (0,02×$3,75) = $0,225 por tarea

100 tareas cuestan $22,50. Con un multiplicador de reintento de 1,2, el presupuesto es $22,50×1,2=$27,00, sin herramientas. En 2027, la misma tarea cuesta $0,45.

Para una caché de 900.000 tokens durante 10 horas, cada tarea lee 900.000 tokens, añade 100.000 sin caché y genera 30.000 de salida:

tokens = (0,1×$0,75)+(0,9×$0,075)+(0,03×$3,75) = $0,255
almacenamiento = 0,9×10×$0,50 = $4,50

Con 20 tareas en esa ventana: $4,50+(20×$0,255)=$9,60. Leer la caché y almacenarla son cargos distintos.

Batch, Flex, herramientas y reintentos

Batch sirve para trabajos que pueden esperar. Flex es otro modo seleccionado por separado; comprueba su fila actual en la página oficial. Search grounding, Maps, URL context, Code execution y File Search tienen reglas adicionales. La sección de herramientas explica qué entra en tokens y qué tiene tarifa propia.

Usa tareas correctas×coste por tarea×multiplicador de reintento + herramientas + almacenamiento para el presupuesto mensual. No trates automáticamente una ejecución fallida como coste cero.

Tabbit como capa de navegador

Tabbit Browser puede ayudar a organizar páginas para una investigación; consulta AI browser, navegador agentic, automatización y recursos del modelo (English). En la prueba, el selector de un cliente mostró Gemini-3.8-Flash, pero una tarea nueva dio error de carga y no terminó ninguna inferencia. No es prueba de acceso en producción ni de un precio de Tabbit.

La guía general, la reseña y las alternativas cubren acceso, evidencia y selección. Compara también opciones de navegadores IA. Mantén API, suscripción y producto separados.

Comparación de cargas

CargaEstimación 2026 (USD)No incluido
100 tareas sin caché; 1,2 intentos por éxito27.00Herramientas y creación de caché cuando corresponda
20 tareas con caché en 10 horas; sin reintentos9.60Herramientas y creación de caché cuando corresponda

Qué aportan los creadores

NERD UP se centra en el consumo de tokens y el coste oculto; Bijan Bowen muestra tareas de código y navegador. Solo se usan los títulos y capítulos visibles, no facturas ni pruebas comparables. El presupuesto debe contar los reintentos y toda la salida.

C_tokens = (I_uncached × P_input + I_cached × P_cached + O_total × P_output) / 1,000,000
C_total = sum(C_tokens for ALL attempts) + C_storage + C_tools
C_success = C_total / N_success   [N_success > 0]

Cuente todos los intentos facturables, incluidos los fallidos; añada almacenamiento y herramientas una sola vez. Sin tareas exitosas no se define un coste por éxito.

Debate comunitario sobre el coste por tarea

En un debate del mismo día en Hacker News aparecen dos lecturas: gundmc defiende comparar coste por tarea, mientras bermudi y criley2 señalan que más tokens de salida y distintos niveles de esfuerzo pueden cambiar el orden. Son opiniones sobre vistas enlazadas de Artificial Analysis, no un ranking reproducido aquí.

Comentarios originales: gundmc (2 sep.), bermudi (2 sep.), criley2 (2 sep.) y criley2 (3 sep.).

Comentario de gundmc sobre coste por tarea en Hacker News
gundmc: el coste por tarea puede cambiar la comparación; comentario comunitario, no medición independiente de Tabbit.
Comentario de bermudi sobre tokens de salida por tarea
bermudi: más tokens de salida pueden borrar una ventaja de precio; no es un ranking verificado.
Comentario de criley2 cuestionando una comparación de coste
criley2 cuestiona la comparación usando distintos niveles de esfuerzo; la disputa queda abierta.
Comentario de criley2 sobre coste y nivel de esfuerzo
Seguimiento de criley2: el coste cambia con el esfuerzo; debate del mismo día, no prueba reproducida.

La conclusión práctica es registrar el esfuerzo y la salida total antes de aplicar la tarifa oficial.

Escalera familiar, esfuerzo y límites de cobro

En la tabla Standard de 2026, Gemini 3.8 Flash, 3.7 Flash y 3.6 Flash aparecen con $0,75 de entrada, $3,75 de salida y $0,075 de lectura de caché por millón de tokens. La misma tarifa no significa la misma calidad, latencia o disponibilidad. El coste real depende de la proporción en caché, la salida total (incluido thinking), las rondas y los reintentos. Reducir el esfuerzo solo ahorra si reduce la salida sin perder un resultado útil.

Thinking está incluido en la salida; leer caché no es lo mismo que almacenarla. Batch y Flex son modos separados y sus tarifas de tokens publicadas para 2026 no se acumulan. Search, Maps, URL context y File Search tienen reglas propias. Un intento fallido puede consumir tokens facturables.

Dos cargas de trabajo con supuestos explícitos

Tarifas Standard de 2026. La salida incluye el razonamiento una sola vez; se excluyen almacenamiento, herramientas, reintentos e impuestos. Con las tarifas Standard de 2027 publicadas, los totales mensuales de tokens serían 30 y 36 dólares.

CargaEntrada por tareaPorcentaje en cachéSalida total por tareaTareas al mesCoste mensual de tokens
Extracción breve10,0000%2,0001,000$15
Análisis repetido de documentos1,000,00090%10,000100$18

Cálculo local

Estima el coste mensual de tokens

Tarifas API Standard hasta el 31-12-2026. Incluye el razonamiento una sola vez en la salida. Los valores permanecen en el navegador.

Gemini 3.8 Flash$0.4500 / tarea$45.00 / mes
Gemini 3.7 Flash$0.4500 / tarea$45.00 / mes
Gemini 3.6 Flash$0.4500 / tarea$45.00 / mes

Excluye almacenamiento, herramientas, reintentos e impuestos. Igual tarifa no implica igual consumo por tarea. Revisado: 20-09-2026. Consultar tarifas actuales

El cálculo ocurre localmente, compara tres modelos conocidos y no convierte datos desconocidos en cero. Excluye almacenamiento, herramientas, reintentos e impuestos. Comprueba la tabla oficial antes de cerrar un presupuesto.

Después del cálculo, elige dónde ejecutar el flujo

Tabbit Browser puede servir para organizar páginas y contexto; consulta su página del modelo Gemini 3.8 Flash (English). En Tabbit Browser Dev, con una cuenta autenticada del sitio de prueba, una tarea de extracción de registros de pago devolvió correctamente cuatro campos: currency, paid_total, overdue_ids y unknown_status_ids. La interfaz mostró la marca Google Search, pero no se verificó de forma independiente si se ejecutó una búsqueda; tampoco se midieron coste, tiempo o estabilidad.

Tabbit Browser
Tabbit Browser muestra un resultado de extracción estructurada con Gemini 3.8 Flash
Una muestra de extracción devolvió el JSON esperado; no se infieren coste, latencia ni estabilidad.

Fuentes y siguiente paso

Verifica la tarifa de Gemini API y la documentación de Gemini 3.8 Flash. Si el trabajo cruza el 1 de enero de 2027, duplica las líneas Standard de tokens y caché antes de sustituir las hipótesis con tus registros.

Preguntas frecuentes

¿Cuánto cuesta Gemini 3.8 Flash antes del 31 de diciembre de 2026?

El precio Standard es de 0,75 USD por millón de tokens de entrada y 3,75 USD por millón de tokens de salida, incluido thinking. La lectura de caché cuesta 0,075 USD y el almacenamiento 0,50 USD por millón de tokens-hora.

¿Se cobra thinking aparte?

No. Google incluye los tokens de thinking en el precio de salida. Súmalos una sola vez al total de salida.

¿Qué cambia en 2027?

Desde el 1 de enero de 2027, las tarifas Standard pasan a 1,50 USD de entrada, 7,50 USD de salida, 0,15 USD de lectura de caché y 1,00 USD por millón de tokens-hora.

¿Se pueden combinar Batch y Flex?

No. Son modos distintos. Elige uno y aplica su propia tabla de precios.

¿Una suscripción de Gemini o Tabbit paga la API?

No. La suscripción de consumidor, la cuenta de Gemini Developer API y las condiciones de Tabbit son productos separados.

¿Cómo incluyo los reintentos?

Multiplica el coste de una ejecución correcta por el número esperado de intentos y añade herramientas y almacenamiento. Una llamada fallida también puede consumir tokens facturables.

Da el siguiente paso

Deja que Tabbit trabaje junto a ti.

Investiga entre pestañas, automatiza el trabajo repetitivo del navegador y mantén todo el contexto al alcance.