O custo real do Gemini 3.8 Flash depende dos tokens usados por cada tarefa. Até 31 de dezembro de 2026, o API Standard cobra US$0,75 por milhão de tokens de entrada e US$3,75 por milhão de saída. A saída já inclui thinking. A leitura do cache custa US$0,075 e o armazenamento US$0,50 por milhão de tokens-hora. Em 1º de janeiro de 2027, o Google lista o dobro desses preços Standard.
A fórmula é (entrada sem cache×preço + leitura do cache×preço + saída com thinking×preço)/1.000.000 + armazenamento. Assinaturas e taxas do Tabbit não são créditos da API.

Principais pontos
Thinking entra uma vez no total de saída.
Batch e Flex são modos separados; descontos não se acumulam.
O orçamento mensal inclui tarefas, tentativas, ferramentas e horas de armazenamento.
Confira a página oficial de preços e a página do modelo.
Tabela de preços
| Item | Até 31-12-2026 | A partir de 01-01-2027 | Unidade |
|---|---|---|---|
| Entrada Standard | $0.75 | $1.50 | 1M tokens |
| Saída Standard, incluindo thinking | $3.75 | $7.50 | 1M tokens |
| Leitura do cache | $0.075 | $0.15 | 1M tokens |
| Armazenamento do cache | $0.50 | $1.00 | 1M tokens-hora |
| Entrada Batch | $0.375 | $0.75 | 1M tokens |
| Saída Batch | $1.875 | $3.75 | 1M tokens |
| Leitura Batch | $0.0375 | $0.075 | 1M tokens |
Standard, Batch, Flex e Priority aparecem como modos separados. O suporte do modelo a um modo não transforma automaticamente uma chamada Standard em chamada com desconto.
Dois exemplos
Com 200.000 tokens de entrada sem cache e 20.000 tokens de saída incluindo thinking:
(0,2×$0,75) + (0,02×$3,75) = $0,225100 tarefas custam US$22,50. Com fator de tentativa 1,2, reserve $22,50×1,2=$27,00, sem ferramentas. Em 2027, a mesma tarefa custa US$0,45.
Para um documento de 900.000 tokens armazenado por 10 horas, lendo 900.000 em cache, acrescentando 100.000 sem cache e gerando 30.000 de saída:
tokens = (0,1×$0,75)+(0,9×$0,075)+(0,03×$3,75) = $0,255
armazenamento = 0,9×10×$0,50 = $4,50Com 20 tarefas nessa janela: $4,50+(20×$0,255)=$9,60. Leitura e armazenamento são cobranças diferentes.
Batch, Flex, ferramentas e tentativas
Batch serve para trabalhos que podem esperar. Flex é outro modo de inferência; use a linha atual da página oficial. Search grounding, Maps, URL context, Code execution e File Search têm regras próprias. Consulte a seção de ferramentas. A estimativa mensal é tarefas bem-sucedidas×custo de tokens por tentativa×tentativas por sucesso + ferramentas + armazenamento.
A fronteira do Tabbit
Tabbit Browser pode ajudar a organizar páginas de pesquisa; veja AI browser, navegador agentic, automação e recursos do modelo (English). O cliente de teste mostrou Gemini-3.8-Flash no seletor, mas uma tarefa nova falhou ao carregar e nenhuma inferência foi concluída. Isso não comprova acesso em produção nem preço do Tabbit.
Consulte também a visão geral, a avaliação e as alternativas, além da comparação de navegadores IA, mantendo API, assinatura e produto separados.
Comparação de cargas
| Carga | Estimativa 2026 (USD) | Fora do cálculo |
|---|---|---|
| 100 tarefas sem cache, 1,2 tentativa por sucesso | 27.00 | Ferramentas e criação do cache quando aplicável |
| 20 tarefas com cache em 10 horas, sem novas tentativas | 9.60 | Ferramentas e criação do cache quando aplicável |
O que dizem os criadores
NERD UP aborda o consumo de tokens e custos ocultos; Bijan Bowen apresenta tarefas de código e navegador. Citamos apenas os títulos e capítulos visíveis, não faturas ou testes comparáveis. O orçamento deve contar as novas tentativas e toda a saída.
C_tokens = (I_uncached × P_input + I_cached × P_cached + O_total × P_output) / 1,000,000
C_total = sum(C_tokens for ALL attempts) + C_storage + C_tools
C_success = C_total / N_success [N_success > 0]Conte todas as tentativas cobradas, incluindo falhas; acrescente armazenamento e ferramentas uma única vez. Sem sucessos, o custo por sucesso é indefinido.
Debate da comunidade sobre custo por tarefa
Em uma discussão do mesmo dia no Hacker News, gundmc defende o custo por tarefa, enquanto bermudi e criley2 observam que tokens de saída e níveis de effort diferentes podem mudar a ordem. São leituras de links do Artificial Analysis, não um ranking reproduzido aqui.
Comentários originais: gundmc (2 de set.), bermudi (2 de set.), criley2 (2 de set.) e criley2 (3 de set.).




Na prática, registre o effort e a saída total antes de aplicar o preço oficial.
Escada da família, effort e limites da cobrança
Na tabela Standard de 2026, Gemini 3.8 Flash, 3.7 Flash e 3.6 Flash aparecem com US$0,75 de entrada, US$3,75 de saída e US$0,075 de leitura de cache por milhão de tokens. A mesma tarifa não prova a mesma qualidade, latência ou disponibilidade. O custo real depende da proporção em cache, da saída total (incluindo thinking), das rodadas e das tentativas. Reduzir o effort só economiza quando reduz a saída sem prejudicar o resultado.
Thinking já está incluído na saída; leitura e armazenamento de cache são linhas diferentes. Batch e Flex são modos separados e as tarifas de tokens de 2026 não se acumulam. Search, Maps, URL context e File Search têm regras próprias. Uma chamada que falha ainda pode consumir tokens.
Duas cargas de trabalho com premissas explícitas
Tarifas Standard de 2026. A saída inclui o raciocínio uma vez; armazenamento, ferramentas, tentativas e impostos ficam de fora. Nas tarifas Standard de 2027 publicadas, os totais mensais de tokens seriam 30 e 36 dólares.
| Carga | Entrada por tarefa | Parte em cache | Saída total por tarefa | Tarefas por mês | Custo mensal de tokens |
|---|---|---|---|---|---|
| Extração curta | 10,000 | 0% | 2,000 | 1,000 | $15 |
| Análise repetida de documentos | 1,000,000 | 90% | 10,000 | 100 | $18 |
Cálculo local
Estime o custo mensal de tokens
Tarifas API Standard até 31-12-2026. Inclua o raciocínio uma única vez na saída. Os valores ficam no navegador.
Exclui armazenamento, ferramentas, tentativas e impostos. Tarifas iguais não significam uso igual. Verificado em 20-09-2026. Ver tarifas atuais
O cálculo é local e compara três modelos conhecidos. Preços desconhecidos não viram zero. Armazenamento, ferramentas, tentativas e impostos ficam fora. Confira a tabela oficial antes de fechar o orçamento.
Depois de calcular, escolha onde executar o fluxo
O Tabbit Browser pode organizar páginas e contexto; veja a página do modelo Gemini 3.8 Flash (English). No Tabbit Browser Dev, com uma conta autenticada no site de teste, uma tarefa de extração de registros de pagamento devolveu corretamente quatro campos: currency, paid_total, overdue_ids e unknown_status_ids. A interface mostrou a marca Google Search, mas não verificamos de forma independente se uma busca foi executada; custo, tempo e estabilidade também não foram medidos.

Fontes
Verifique os preços da Gemini API e a documentação do Gemini 3.8 Flash. Para trabalhos que atravessam 1º de janeiro de 2027, dobre as linhas Standard de tokens e cache antes de substituir as hipóteses pelos seus logs.
Perguntas frequentes
Quanto custa o Gemini 3.8 Flash até 31 de dezembro de 2026?
O Standard custa US$0,75 por milhão de tokens de entrada e US$3,75 por milhão de tokens de saída, incluindo thinking. A leitura do cache custa US$0,075 e o armazenamento US$0,50 por milhão de tokens-hora.
Thinking é cobrado à parte?
Não. O Google inclui esses tokens no preço de saída. Some-os uma vez ao total de saída.
O que muda em 2027?
A partir de 1º de janeiro de 2027, os preços Standard passam a US$1,50 de entrada, US$7,50 de saída, US$0,15 de leitura e US$1,00 de armazenamento.
Batch e Flex podem ser combinados?
Não. São modos diferentes. Escolha um e use somente a tabela correspondente.
Uma assinatura Gemini ou uma taxa do Tabbit paga a API?
Não. Assinatura de consumidor, conta Developer API e condições do Tabbit são separadas.
Como incluir novas tentativas no orçamento?
Multiplique o custo de uma execução bem-sucedida pelo número esperado de tentativas e acrescente ferramentas e armazenamento. Uma chamada que falha também pode consumir tokens faturáveis.