Ao pesquisar “preço do DeepSeek V4 Flash”, confirme primeiro a identidade do modelo. Desde 10 de setembro de 2026, o V4 Flash antigo foi retirado. deepseek-v4-flash ainda funciona como alias de compatibilidade, mas é roteado para o DeepSeek-V4.1-Flash. Integrações novas devem usar deepseek-flash; uma tabela de preços antiga não é um orçamento atual.
Veja a página do modelo DeepSeek V4 Flash (English), a coleção de prompts (English) e as evidências de review (English). Para um fluxo no navegador, o Tabbit é uma rota independente e não uma conta de cobrança da API.
Pontos principais
Use
deepseek-flashnas integrações novas;deepseek-v4-flashé um alias temporário de compatibilidade.Fora do pico, a entrada hit custa $0.003, a entrada miss $0.15 e a saída $0.60 por milhão de tokens.
No pico, os valores são $0.006, $0.30 e $1.20; o cache exige um prefixo persistido e correspondente.
Retries, ferramentas, correções e revisão humana também entram no custo real.
A tabela atual
Dados da documentação oficial de preços, verificada em 20/09/2026. Valores por milhão de tokens.
| Item | Fora do pico | Pico | O que significa |
|---|---|---|---|
| Entrada, cache hit | $0.003 | $0.006 | Prefixo persistido e correspondente |
| Entrada, cache miss | $0.15 | $0.30 | Entrada nova ou não correspondente |
| Saída | $0.60 | $1.20 | Inclui saída de raciocínio quando aplicável |
| Horário de pico | — | 01:00–04:00 e 06:00–10:00 UTC, seg–sex | O restante é fora do pico |
| Contexto / concorrência | 1M / 2.500 | 1M / 2.500 | Limites, não garantia de velocidade |
O modelo atual da API é deepseek-flash, identificado como V4.1 Flash. A tabela oficial informa modos com e sem raciocínio, JSON, ferramentas, Responses API, Anthropic API e visão. Os nomes antigos são apenas uma rota temporária de compatibilidade.
A mudança importante é o alias
O log oficial de mudanças registra a migração de julho para o V4.1 Flash. Se o código continua enviando deepseek-v4-flash, isso não prova que o modelo ou o preço de julho continuam ativos. Registre nome, data de consulta e horário de cobrança.
Como calcular o cache
O guia oficial de cache explica que o cache é padrão, mas exige um prefixo persistido que corresponda ao novo pedido.
custo = entrada hit × tarifa hit ÷ 1.000.000
+ entrada miss × tarifa miss ÷ 1.000.000
+ saída × tarifa de saída ÷ 1.000.000Dois orçamentos reproduzíveis
| Trabalho | Premissas | Fora do pico | Pico | Não inclui |
|---|---|---|---|---|
| Extração curta | 0,8 M hit + 0,2 M miss + 0,1 M saída | $0.0924 | $0.1848 | Retries, ferramentas, impostos |
| Loop longo de agente | 9 M hit + 1 M miss + 0,5 M saída | $0.477 | $0.954 | Falhas e supervisão |
O primeiro exemplo é 0.8 × 0.003 + 0.2 × 0.15 + 0.1 × 0.60 = $0.0924; o segundo é 9 × 0.003 + 1 × 0.15 + 0.5 × 0.60 = $0.477. No horário de pico, o valor dobra.
Cálculo local
Estime o custo de tokens do DeepSeek Flash
Usa as tarifas oficiais do V4.1 Flash verificadas em 20/09/2026. Os valores ficam neste navegador.
Exclui novas tentativas, ferramentas, impostos, acréscimos e revisão humana. Ver tarifas atuais
O cálculo acontece apenas neste navegador. Usa as tarifas oficiais do V4.1 Flash verificadas em 20/09/2026 e não envia seus valores. Exclui retries, ferramentas, impostos, acréscimos e revisão humana; confira a tabela oficial antes de fechar o orçamento.
O que a tarifa não mostra
Usuários do Reddit relataram 11.500 chamadas por US$ 4,12 e uma tarefa reduzida de cinco horas para uma hora por cerca de US$ 1,63. Outros relataram dificuldade para seguir regras e skills. São experiências pessoais, não uma garantia de preço ou desempenho.
O que a comunidade pagou e aprendeu
Um usuário relatou 11.500 chamadas por US$ 4,12; outro explicou em uma discussão de trabalho complexo que reduziu cinco horas para uma por cerca de US$ 1,63. Um usuário do LocalLLaMA apontou problemas com regras e skills, enquanto outro tópico do DeepSeek elogiou o custo e mostrou preocupação com a capacidade. O teste de AICodeKing no YouTube é de 31 de julho. São relatos pessoais de julho-agosto de 2026, não provas do preço, da capacidade ou do desempenho atual do V4.1.
O horário fora do pico ajuda em avaliações enfileiradas, mas não remove limites. A documentação de limites informa concorrência de conta de 2.500 para deepseek-flash. Para trabalho no navegador, leia sobre raciocínio agentic e o plugin de navegador DeepSeek Harness.
Tabela de decisão
| Seu caso | Comece com | Por quê | Verifique |
|---|---|---|---|
| Prefixos longos e tarefas agendáveis | API direta com log de cache | Combina hits e horário fora do pico | Estabilidade do prefixo e retries |
| Pesquisa web com revisão humana | Um navegador compatível, como Tabbit Browser | Mantém páginas, abas e modelo juntos | Disponibilidade; não é cobrança de API |
| Entrada de imagem | V4.1 Flash ou rota multimodal verificada | A documentação atual lista visão | Model ID e modalidade |
| Código com erro caro | Piloto fixo e modelo revisor | Token barato pode gerar reparo caro | Critérios de sucesso e fallback |
Para tarefas web, confirme a disponibilidade no workspace do modelo (English), e use a comparação de navegadores de IA e a explicação de navegadores agentic para separar as funções.
Um caminho prático no navegador
Veja a apresentação do Tabbit Browser e confirme se o seletor da sua edição e conta mostra DeepSeek. Os termos do Tabbit e a cobrança da API DeepSeek são independentes; escolher um modelo no navegador não cria uma cobrança de API.
Veredito
O preço é atraente quando há prefixos repetidos, horários flexíveis e um critério de sucesso mensurável. Confirme o roteamento para V4.1 Flash, separe hits, misses e horários, e revise a página oficial de preços antes de fechar o orçamento.
Sources
Tarifas, horários, aliases e limites: documentação oficial de preços, lançamento do V4.1 Flash, log de mudanças, guia de cache e limites, verificados em 20/09/2026. Os quatro tópicos do Reddit e o relato de AICodeKing no YouTube são testes pessoais datados, não uma prova independente dos preços ou do desempenho atual.
Perguntas frequentes
deepseek-v4-flash ainda é o modelo Flash atual?
Não. A DeepSeek retirou o V4 Flash antigo em 10 de setembro de 2026. O nome antigo continua aceito como alias de compatibilidade para o V4.1 Flash; chamadas novas devem usar deepseek-flash.
Quanto custa o DeepSeek V4.1 Flash?
Fora do pico, a entrada sem cache custa US$ 0,15 e a saída US$ 0,60 por milhão de tokens. No pico, os valores são US$ 0,30 e US$ 1,20; a entrada com cache custa US$ 0,003 ou US$ 0,006.
Quando são os horários de pico?
De segunda a sexta, das 01:00–04:00 e 06:00–10:00 UTC. O restante é fora do pico; converta os horários para sua região antes de agendar.
Como o cache muda a cobrança?
Somente um prefixo de entrada persistido e correspondente recebe o preço de cache. Uma janela de contexto longa não garante um cache hit.
Posso estimar um orçamento mensal com tokens?
Sim. Separe tokens de entrada com cache, sem cache e de saída, aplique cada preço e divida por um milhão. Acrescente retries e chamadas de ferramentas separadamente.
Usar DeepSeek no Tabbit consome meu saldo da API DeepSeek?
Não. Uma sessão do Tabbit e uma conta da API DeepSeek são caminhos separados de acesso e cobrança. Confira o seletor de modelo e os termos do produto.