Si buscas “precio de DeepSeek V4 Flash”, empieza por la identidad del modelo. Desde el 10 de septiembre de 2026, el V4 Flash anterior está retirado. deepseek-v4-flash todavía funciona como alias de compatibilidad, pero redirige a DeepSeek-V4.1-Flash. Las integraciones nuevas deben usar deepseek-flash; una tarifa antigua no es un presupuesto actual.
Puedes revisar la página del modelo DeepSeek V4 Flash (English), la colección de prompts (English) y las evidencias de evaluación (English). Si quieres trabajar desde el navegador, Tabbit es una ruta separada y no una cuenta de facturación de la API.
Puntos clave
Las integraciones nuevas deben usar
deepseek-flash;deepseek-v4-flashes un alias temporal.En valle, la entrada hit cuesta $0.003, la entrada miss $0.15 y la salida $0.60 por millón de tokens.
En punta son $0.006, $0.30 y $1.20; el cache hit exige un prefijo persistido que coincida.
Reintentos, herramientas, reparación y revisión humana también forman parte del coste real.
La tarifa actual
Los datos proceden de la documentación oficial de precios, consultada el 20-09-2026. Son importes por millón de tokens.
| Concepto | Valle | Punta | Significado |
|---|---|---|---|
| Entrada, caché hit | $0.003 | $0.006 | Prefijo persistido y coincidente |
| Entrada, caché miss | $0.15 | $0.30 | Entrada nueva o no coincidente |
| Salida | $0.60 | $1.20 | Incluye salida de razonamiento cuando aplica |
| Horas punta | — | 01:00–04:00 y 06:00–10:00 UTC, lunes–viernes | El resto es valle |
| Contexto / concurrencia | 1M / 2.500 | 1M / 2.500 | Límites, no garantía de velocidad |
El modelo actual es deepseek-flash, identificado como V4.1 Flash. La tabla oficial incluye pensamiento y no pensamiento, JSON, herramientas, Responses API, Anthropic API y visión. Los nombres antiguos se redirigen de forma temporal.
El dato clave: el alias sobrevivió, la tarifa no
El cambio del 10 de septiembre se documenta en el registro oficial de cambios. Que tu código siga enviando deepseek-v4-flash no demuestra que siga usando el modelo de julio ni la tarifa de julio. Guarda el nombre, la fecha de consulta y el horario de facturación.
Cómo calcular el caché
La guía oficial de caché explica que está activado por defecto, pero solo hay hit cuando coincide un prefijo persistido.
coste = (tokens hit × tarifa hit ÷ 1.000.000)
+ (tokens miss × tarifa miss ÷ 1.000.000)
+ (tokens salida × tarifa salida ÷ 1.000.000)Dos presupuestos reproducibles
| Trabajo | Supuestos | Valle | Punta | No incluye |
|---|---|---|---|---|
| Extracción corta | 0,8 M hit + 0,2 M miss + 0,1 M salida | $0.0924 | $0.1848 | Reintentos, herramientas, impuestos |
| Bucle de agente | 9 M hit + 1 M miss + 0,5 M salida | $0.477 | $0.954 | Fallos y supervisión |
El primer cálculo es 0.8 × 0.003 + 0.2 × 0.15 + 0.1 × 0.60 = $0.0924; el segundo es 9 × 0.003 + 1 × 0.15 + 0.5 × 0.60 = $0.477. En punta se duplican.
Cálculo local
Estima el coste de tokens de DeepSeek Flash
Usa las tarifas oficiales de V4.1 Flash comprobadas el 20-09-2026. Los valores permanecen en este navegador.
Excluye reintentos, herramientas, impuestos, recargos y revisión humana. Ver tarifas actuales
El cálculo se ejecuta solo en este navegador. Usa las tarifas oficiales de V4.1 Flash comprobadas el 20-09-2026 y no envía tus valores. Excluye reintentos, herramientas, impuestos, recargos y revisión humana; revisa la tarifa oficial antes de cerrar el presupuesto.
Lo que la tarifa no resuelve
La comunidad aporta contexto, no autoridad de precios. Un usuario de Reddit informó 11.500 llamadas por $4,12; otro redujo una tarea de cinco horas a una hora por unos $1,63. También hay informes de fallos al seguir reglas y skills. Son experiencias individuales y deben contrastarse con tus propios criterios de éxito.
Lo que la comunidad pagó y aprendió
Un usuario de Reddit informó 11.500 llamadas por $4,12; otro explicó en una discusión de tareas complejas que redujo cinco horas a una por unos $1,63. Un usuario de LocalLLaMA señaló problemas con reglas y skills, mientras otro hilo de DeepSeek combinó elogios al coste con dudas sobre la capacidad. El vídeo de AICodeKing es una prueba del 31 de julio. Son informes personales de julio-agosto de 2026, no pruebas del precio, capacidad o rendimiento actual de V4.1.
Las horas valle sirven para evaluaciones en cola, pero no eliminan los límites. La documentación de límites indica una concurrencia de cuenta de 2.500 para deepseek-flash. Para el trabajo de navegador, consulta razonamiento agéntico y la guía del plugin DeepSeek Harness.
Tabla de decisión
| Tu caso | Empieza con | Por qué | Comprueba |
|---|---|---|---|
| Prefijos largos y trabajos programables | API directa con registro de caché | Combina valle y hits | Estabilidad del prefijo y reintentos |
| Investigación web con revisión humana | Un navegador compatible, como Tabbit Browser | Mantiene páginas, pestañas y modelo juntos | Disponibilidad; no es facturación API |
| Entrada visual | V4.1 Flash o ruta multimodal verificada | La documentación actual lista visión | Model ID y modalidad en cada llamada |
| Código con errores costosos | Piloto fijo y modelo revisor | Token barato no equivale a reparación barata | Tiempo humano y fallback |
Para probar páginas, verifica el selector en el espacio de trabajo del modelo (English) y usa los prompts (English). La comparativa de navegadores AI y la explicación de navegadores agénticos ayudan a separar esa decisión de la API.
Una ruta práctica en el navegador
Si tu trabajo empieza en páginas y pestañas, comprueba primero si el selector de Tabbit Browser ofrece el modelo para tu edición y cuenta. Tabbit, los términos del producto y la facturación de la API son independientes; elegir un modelo en el navegador no crea una factura de DeepSeek.
Veredicto
El precio es atractivo si tienes prefijos repetidos, horarios flexibles y una métrica de éxito. La primera tarea de presupuesto es confirmar que las llamadas ahora usan V4.1 Flash, separar hits y misses y guardar la hora de cada lote. Revisa la página oficial de precios antes de comprometer un gasto.
Sources
Las tarifas, horarios, alias y límites proceden de la documentación oficial de precios, la nota de V4.1 Flash, el registro de cambios, la guía de caché y la documentación de límites, comprobadas el 20-09-2026. Las cinco fuentes comunitarias enlazadas arriba son pruebas personales fechadas, no autoridad de precios.
Preguntas frecuentes
¿deepseek-v4-flash sigue siendo el modelo Flash actual?
No. DeepSeek retiró el V4 Flash anterior el 10 de septiembre de 2026. El nombre antiguo sigue aceptándose como alias de compatibilidad y se dirige a V4.1 Flash; las llamadas nuevas deben usar deepseek-flash.
¿Cuánto cuesta DeepSeek V4.1 Flash?
En horas valle cuesta 0,15 USD por millón de tokens de entrada sin caché y 0,60 USD por millón de tokens de salida. En horas punta cuesta 0,30 y 1,20 USD; la entrada con caché cuesta 0,003 o 0,006 USD.
¿Cuándo son las horas punta de DeepSeek Flash?
Son de 01:00–04:00 y 06:00–10:00 UTC de lunes a viernes. El resto del horario publicado es valle; conviértelo a tu zona antes de programar trabajos.
¿Cómo cambia la factura una coincidencia de caché?
Un prefijo de entrada persistido y coincidente usa la tarifa de caché en lugar de la tarifa sin caché. Un contexto largo no garantiza una coincidencia.
¿Puedo estimar un presupuesto mensual por tokens?
Sí. Separa tokens de entrada con caché, sin caché y de salida, aplica cada tarifa y divide por un millón. Añade por separado reintentos y llamadas a herramientas.
¿Usar DeepSeek en Tabbit consume mi saldo de la API de DeepSeek?
No. Una sesión de Tabbit y una cuenta de API de DeepSeek son rutas independientes de acceso y facturación. Comprueba el selector del producto y sus condiciones.