TabbitBlog

Preço do Grok 4.7: a tabela de $2/$6 e a conta real

O Grok 4.7 mantém as tarifas de API do Grok 4.6: $2, $0,50 e $6. O esforço, o corte de 200 mil, o Fast e a linha de 256 mil do Cursor mudam a conta.

Neste artigo
  1. O que vale guardar
  2. Preços de relance
  3. O número que importa: de $1,58 a $6,01 por tarefa
  4. O que “2,5 vezes mais caro” mediu
  5. As linhas que não estão no título de $2
  6. A escada da família, e a linha que de fato é mais barata
  7. O que você ainda paga quando o modelo recusa
  8. Onde o modelo realmente roda
  9. Dois orçamentos de API já calculados
  10. Depois da tabela, um lugar para rodar o modelo
  11. Qual conta você está escolhendo
  12. Veredito
  13. Fontes

Na API pública da xAI, com um prompt de menos de 200 mil tokens, o Grok 4.7 custa $2 por milhão de tokens de entrada, $0,50 por milhão de entrada em cache e $6 por milhão de saída. A linha de contexto longo é $4 / $1 / $12. Na página de preços da API, aberta em 22 de setembro de 2026, esses três números e a linha longa coincidem com o Grok 4.6. O preço de tabela não se moveu. A conta ainda pode se mover.

Na mesma nota de lançamento, o gráfico CursorBench 4.0 da xAI coloca uma tarefa do Grok 4.7 em $1,58 no Low e $6,01 no Extra High. É um salto de cerca de 3,8 vezes sem mexer na tabela por token. Um usuário do Cursor Ultra, em extra high e com o fast mode desligado, resumiu assim: “Grok 4.7 is about 2.5 times as expensive as 4.6.” (r/cursor, 21 de setembro de 2026). Depois, o Tabbit é um lugar para testar um caminho quando o orçamento já está claro. Primeiro, a tabela.

O que vale guardar

  • O rótulo coincide com o Grok 4.6. O contexto curto é $2 / $0,50 / $6 por milhão de tokens. Aos 200 mil tokens de entrada, o pedido inteiro passa para $4 / $1 / $12.

  • O esforço é o número que se move. Os pontos do CursorBench da xAI mostram $1,58, $3,49, $4,69 e $6,01 por tarefa, do Low ao Extra High. O esforço de raciocínio padrão na API é high.

  • Fast é uma segunda tabela, não um slogan. As tarifas Fast impressas são $4 / $1 / $12 abaixo de 200 mil e $6 / $1,50 / $18 acima. O Fast é só Cursor e Grok Build, e está fora da API pública.

  • O corte do Cursor é 256 mil, não 200 mil. A página do modelo no Cursor dobra as tarifas padrão sob demanda depois de 256 mil tokens de entrada e coloca o Fast de 500 mil em $6 / $1,50 / $18. A coluna de escrita em cache é um traço, não uma tarifa separada.

  • Não há desconto Batch no grok-4.7. A página do modelo diz que a Batch API não é suportada. Chamadas de ferramenta, os 10% do endpoint dos EUA e a taxa de $0,05 por violação antes da geração ficam fora do título.

Preços de relance

Os valores abaixo são dólares por milhão de tokens, tirados da página de preços da xAI em 22 de setembro de 2026. A visão geral do Grok 4.6 cobre o modelo anterior. Esta tabela é só o dinheiro.

ModeloContextoEntrada curtaCache curtoSaída curtaEntrada longaCache longoSaída longaLimite de contexto longo
grok-4.7500k$2,00$0,50$6,00$4,00$1,00$12,00≥ 200 mil tokens
grok-4.6500k$2,00$0,50$6,00$4,00$1,00$12,00≥ 200 mil tokens
grok-4.5500k$2,00$0,30$6,00$4,00$0,60$12,00≥ 200 mil tokens
grok-build-0.1256k$1,00$0,20$2,00$2,00$0,40$4,00≥ 200 mil tokens
Tabela de preços da API de texto da xAI, com grok-4.7 a 2 dólares de entrada, 0,50 em cache e 6 dólares de saída
Tabela da API de texto da xAI em 22 de setembro de 2026. grok-4.7 e grok-4.6 compartilham as duas linhas.

Os quatro números de contexto curto do grok-4.7 são iguais aos do grok-4.6. A página explica a regra que torna a segunda linha importante: modelos com preço de contexto longo cobram essas tarifas por todos os tokens de um pedido quando o prompt chega ao limite. Cruzar 200 mil não reprecifica só o excesso.

A página de detalhe do modelo repete a tabela curta — entrada $2,00, cache $0,50, saída $6,00 — e um interruptor chamado “Higher context pricing” troca esses valores por $4,00, $1,00 e $12,00. A janela é de 500 mil. Os esforços são low, medium, high e xhigh, com high como padrão. A Batch API aparece como não suportada. A região conferida era us-east-1, com 150 pedidos por segundo e 50.000.000 de tokens por minuto nessa página.

O número que importa: de $1,58 a $6,01 por tarefa

Se ficar com um só número, fique com o intervalo, não com os $2. A nota de lançamento do Grok 4.7 diz que o modelo está “priced starting at $2 per million input tokens and $6 per million output tokens” e que uma variante rápida tem “twice the output speed at twice the price”. A visão de custo do CursorBench 4.0 nessa mesma página, lida nos controles do gráfico em 22 de setembro de 2026, é esta:

Esforço do Grok 4.7Pontuação CursorBench 4.0Custo médio por tarefa
Extra High46,3%$6,01
High43,9%$4,69
Medium41,6%$3,49
Low33,1%$1,58

Extra High custa 3,8 vezes o Low por 13,2 pontos percentuais de pontuação neste gráfico do fornecedor. O tamanho da amostra, o harness e quais tokens compõem o dólar não aparecem nesses controles. São custos de tarefa informados pela xAI, não uma fatura do console da API, e não se comparam a uma tarifa crua por milhão de tokens.

Por isso um “mesmo preço do 4.6” ainda pode parecer caro. O esforço padrão é high. Neste gráfico, high já está em $4,69, contra $1,58 no Low. O guia de raciocínio agêntico serve para decidir quando um laço deve parar; a lição de preço é mais estreita: fixe o orçamento por tarefa concluída, incluindo o esforço que você deixa ligado.

O que “2,5 vezes mais caro” mediu

Publicação no Reddit de Dynamix86 dizendo que o Grok 4.7 custa cerca de 2,5 vezes mais que o Grok 4.6 no Cursor Ultra
r/cursor, 21 de setembro de 2026. Uma conta do Cursor Ultra, extra high, fast mode desligado. Um cronômetro de cota, não uma fatura de API.

Dynamix86 manteve a mesma tarefa por dois dias no Cursor Ultra, trocou do Grok 4.6 para o Grok 4.7 às 22:00, horário da Europa Central, e mediu quanto durava cada ponto percentual do plano. As duas passagens foram extra high e sem fast mode. Os trechos do 4.7 foram 34, 55 e 38 minutos por ponto. Os do 4.6, mais cedo nesse dia, foram 133 e 101 minutos. A partir disso, o autor estimou cerca de 2,5 vezes. A publicação também lê um gráfico da Artificial Analysis como $8,82 contra $3,53 por tarefa. Trate esses dois valores como a leitura que o autor faz de uma captura. Este artigo não mediu de novo esse gráfico, e uma porcentagem de cota do Cursor não é uma linha da API da xAI.

Duas respostas continuam na pergunta do custo:

Comentários no Reddit comparando o custo do Grok 4.7 padrão com o fast mode do Grok 4.6
Respostas no r/cursor: um leitor equipara o 4.7 padrão ao fast mode do 4.6; o autor original diz que ainda é 25% mais caro.

Vegetable-Piano-5313 escreveu: “so using standard grok 4.7 pretty much equals grok 4.6 in fast mode cost-wise i think”. Dynamix86 respondeu: “25% more expensive than 4.6 fast mode even.” Nenhum dos dois publica o registro de tokens. Eles avisam sobre o consumo do plano, não publicam uma segunda tabela oficial.

Comentário no Reddit dizendo que os benchmarks do Grok 4.7 importam pouco porque o custo é alto demais
r/cursor: truecakesnake na mesma discussão. Um juízo sobre preço diante de benchmarks, não uma fatura medida.

“Yep what an awful model release. Obviously benchmarks mean nothing anymore but the cost is clearly too high.” Essa frase é a leitura do susto com o preço. Ela não nomeia esforço, fast mode nem contagem de tokens. O gráfico de lançamento acima é a parte que dá para conferir sem tomar a conclusão do comentário como fato.

As linhas que não estão no título de $2

O corte de 200 mil vale para o pedido inteiro. Um prompt de 199 mil tokens fica em $2 / $0,50 / $6. Um de 200 mil move cada token, saída incluída, para $4 / $1 / $12. Na página de preços não há uma linha de “só o excesso”.

A linha Fast impressa de contexto longo não é o dobro da linha padrão longa. A página diz que o Grok 4.7 Fast é o mesmo modelo em infraestrutura mais rápida, “at twice the standard token rates”, só no Cursor e no Grok Build, não na API pública, e não dentro da cota gratuita do Grok Build. A tabela sob essa frase é:

Tamanho do promptEntrada FastEntrada em cache FastSaída Fast
Abaixo de 200 mil$4,00$1,00$12,00
A partir de 200 mil$6,00$1,50$18,00

Abaixo de 200 mil, $4 / $1 / $12 é exatamente 2 vezes a tabela curta. Acima, 2 vezes a tabela longa seria $8 / $2 / $24. A linha impressa é $6 / $1,50 / $18: 1,5 vez as tarifas padrão de contexto longo e 3 vezes as de contexto curto. Orce a linha impressa. Não multiplique por dois a linha padrão longa e chame isso de Fast.

O Cursor usa 256 mil, e o Fast é a velocidade padrão no Pro e acima. A documentação do Grok 4.7 no Cursor, aberta em 22 de setembro de 2026, põe o uso padrão sob demanda em $2 de entrada, $0,50 de entrada em cache e $6 de saída por milhão. O Fast é $4 / $1 / $12. Depois de 256 mil tokens de entrada, pedidos padrão são 2 vezes essas tarifas padrão e pedidos Fast são 3 vezes, até 500 mil. As linhas da tabela são Grok 4.7 a $2 / — / $0,50 / $6, Fast a $4 / — / $1 / $12, 500k a $4 / — / $1 / $12 e 500k Fast a $6 / — / $1,50 / $18. A coluna de escrita em cache é um traço. O Cursor também diz que o Fast é o nível de velocidade padrão no Pro e planos superiores, enquanto o plano Start (só Índia) trava o Grok 4.7 em esforço medium e velocidade padrão. Um prompt de 220 mil tokens pode ser contexto longo na API da xAI e ainda ser padrão dentro do Cursor.

Batch não é a alavanca de desconto. A página de preços dá 20% só ao grok-4.3 e às variantes grok-4.20, e diz que modelos não listados não têm desconto em lote. A própria página do grok-4.7 diz que a Batch API não é suportada. Deixar o trabalho para a noite não reduz este modelo pela metade.

Ferramentas são um segundo medidor. Pedidos que usam ferramentas de servidor da xAI pagam tokens mais invocações. A busca na web (web_search) e a execução de código custam $5 por 1.000 chamadas. A busca em coleções custa $2,50 por 1.000. Anexos (attachment_search) custam $10 por 1.000. Desde 21 de setembro de 2026 às 12:00 PT, o X Search custa $5 por 1.000 publicações obtidas e $10 por 1.000 perfis de usuário, no lugar de $5 por 1.000 chamadas. view_image, view_x_video e ferramentas MCP remotas não têm taxa de invocação; cobram tokens. A busca de imagens faz parte da busca na web.

O endpoint dos EUA é 1,1 vez. Pedidos para https://us.api.x.ai/v1 são cobrados a 1,1 vez as tarifas globais de tokens. Para o grok-4.7, a página imprime $2,20 / $0,55 / $6,60 abaixo de 200 mil e $4,40 / $1,10 / $13,20 acima. O cache é aplicado antes do multiplicador. A página diz que este endpoint cobre agora grok-4.7 e grok-4.6.

O processamento prioritário é outro 2 vezes, e só se a resposta disser isso. Priority é cobrado a 2 vezes as tarifas padrão em tokens de entrada, saída, cache e raciocínio, com o cache aplicado antes do multiplicador. Você paga a tarifa prioritária só quando a resposta confirma "service_tier": "priority". Não está disponível para Batch, e o Fast é um produto distinto desta flag da API.

A escada da família, e a linha que de fato é mais barata

A linha contraintuitiva não é um desconto novo do Grok 4.7. A entrada em cache do Grok 4.5 é $0,30, contra $0,50 no 4.6 e no 4.7, com a mesma entrada de $2 e a mesma saída de $6 abaixo de 200 mil. Se o seu laço depende muito de cache e o 4.5 basta, a tabela nova é um aumento da leitura em cache, não um corte. O grok-build-0.1 vale metade do 4.7 em cada número de contexto curto ($1 / $0,20 / $2) e a janela dele é de 256 mil, não de 500 mil. É outro id de modelo, não um nível de raciocínio do 4.7.

O outro ponto contraintuitivo é o esforço. Extra High não tem preço próprio de entrada. Ele gasta mais tokens de saída ao mesmo $6. A documentação do Cursor diz que as distâncias entre xhigh, high, medium e low são mais largas do que no Grok 4.6, e que tarefas mais difíceis pensam por mais tempo. Deixar o padrão em high é uma decisão de compra.

O que você ainda paga quando o modelo recusa

Uma recusa não é uma linha grátis nesta tabela.

  • Se o sistema pega uma violação das regras de uso antes da geração na Responses API, a xAI cobra $0,05 por pedido.

  • Se o pedido é julgado como violação e a geração já rodou, essa geração também é cobrada.

  • A entrada em cache é um desconto ($0,50 em vez de $2,00 abaixo de 200 mil). A tabela de texto não tem um preço separado de escrita em cache. A coluna de escrita do Cursor é um traço. A entrada sem cache vai à tarifa cheia de entrada.

  • Novas tentativas e falhas que produziram tokens continuam sendo uso de tokens. A tabela não as perdoa.

  • Uma assinatura de chat do Grok, a cota de um plano do Cursor e uma fatura de API são três objetos diferentes. Este artigo não converte o preço mensal de um plano de consumo em dólares de API; esse preço de assinatura não foi reconferido como valor de checkout ao vivo em 22 de setembro de 2026.

Comentário no Hacker News citando uma página que lista o Grok 4.7 a zero dólar por milhão de tokens
Hacker News, 22 de setembro de 2026. nomel cita um preço de $0,00. Esse valor não é a tabela da xAI.

Um comentário no Hacker News cita uma página que afirma que o Grok 4.7 (xhigh) custa “$0.00 per 1M input tokens” e “$0.00 per 1M output tokens”, e depois diz que o domínio é “appropriately descriptive”. Um zero num widget de terceiros não é um corte de preço. A tabela de API acima é a que se deve orçar.

Onde o modelo realmente roda

A documentação do Grok 4.7 lista a API pública (grok-4.7), o endpoint regional dos EUA, o Grok Build como modelo padrão do agente de código, o Cursor em todos os planos e os gateways OpenRouter, Vercel e Cloudflare. Os preços de tabela dos gateways não foram reauditados para este artigo; um trecho de busca que não bata com $2 / $6 não é motivo para abandonar a tabela oficial.

O grupo do Cursor para planos pessoais e de equipe inclui Grok 4.7, Grok 4.6, Grok 4.5 e Composer 2.5. Esse grupo é uma cota, não uma pilha pré-paga de tokens de API. Fast como padrão no Pro e acima significa que um plano pode queimar a linha Fast sem uma opção separada a cada turno.

O nível gratuito do Grok Build não inclui Fast. A nota de lançamento também diz que dá para experimentar o Grok Build em x.ai/build. “Try for free” nessa página não afirma que os tokens da API do grok-4.7 são grátis.

Dois orçamentos de API já calculados

Eles usam só a tabela da xAI: sem ferramentas, sem os 10% dos EUA, sem a flag de prioridade e sem novas tentativas. São aritmética, não uma previsão.

Uma resposta curta na tabela padrão, abaixo do corte. 10 mil tokens de entrada sem cache e 2 mil de saída:

(10,000 × $2 + 2,000 × $6) / 1,000,000 = $0.032

A mesma forma no Fast curto impresso é $0,064. A saída vale 3 vezes a entrada, então um raciocínio longo domina mesmo quando o prompt é pequeno.

Um prompt de agente a frio que cruza 200 mil. 250 mil tokens de entrada sem cache e 8 mil de saída. As tarifas de contexto longo valem para tudo:

(250,000 × $4 + 8,000 × $12) / 1,000,000 = $1.096

As mesmas contagens, se fossem cobradas como contexto curto, seriam $0,548. O corte é a diferença. Com 90% de entrada em cache, ainda na linha longa:

(25,000 × $4 + 225,000 × $1 + 8,000 × $12) / 1,000,000 = $0.421

O Fast impresso acima de 200 mil, a frio, é (250,000 × $6 + 8,000 × $18) / 1,000,000 = $1.644. Dobrar a linha padrão longa inventaria $2,192. Use $1,644.

Cálculo local

Estime a fatura mensal da API

Tarifas oficiais da xAI verificadas em 22 de setembro de 2026. A saída é cobrada uma vez e inclui o raciocínio. O que você digita fica nesta página.

grok-4.7$0.0320 / tarefa$6.4000 / mês
grok-4.6$0.0320 / tarefa$6.4000 / mês
grok-4.5$0.0320 / tarefa$6.4000 / mês

A partir de 200.000 tokens de entrada, o pedido inteiro usa a linha de contexto longo. Fast usa a tabela impressa, que não é o dobro simples dessa linha. Exclui ferramentas, os 10% do endpoint dos EUA, prioridade, novas tentativas e o limite de 256 mil do Cursor. Verificar a tarifa

A calculadora fica no navegador. Ela muda o pedido inteiro para as tarifas de contexto longo a partir de 200 mil tokens de entrada, e a opção Fast usa a tabela Fast impressa só para o grok-4.7. grok-4.6 e grok-4.5 ficam nas linhas padrão para a diferença de cache do 4.5 continuar visível. Ela não modela taxas de ferramenta, os 10% dos EUA, prioridade, novas tentativas nem o limite de 256 mil do Cursor. Reabra a página oficial de preços antes de fechar um orçamento.

Depois da tabela, um lugar para rodar o modelo

Conhecer a tabela não liga o modelo às páginas e aos arquivos que você já tem abertos. O Tabbit Browser é o cliente desse passo: o seletor de modelos, a página ativa e os arquivos locais ficam na mesma superfície, então comparar um caminho é uma seleção, não uma integração nova de cobrança.

O limite é o sentido desta seção. O Tabbit não substitui a fatura da xAI e não muda a regra de 256 mil do Cursor. A página do modelo Grok 4.7 (English) lista o modelo e diz que a disponibilidade no Tabbit depende do seletor ao vivo da conta. As notas de prompts (English) e as notas de avaliação (English) são o rastro de como a API é chamada e de como os benchmarks públicos foram lidos. Não são uma conta medida do Tabbit. Este artigo não rodou uma tarefa cronometrada no Tabbit, então não afirma custo, latência nem taxa de sucesso do Tabbit.

Tabbit Browser

Se o trabalho é a própria sessão do navegador, comece pelo guia do navegador de IA, a visão geral de navegadores agênticos, o que é um navegador agêntico e o guia de automação do navegador. A comparação de navegadores de 2026 e as notas de uso do Tabbit separam a escolha do cliente da tabela de tokens.

Qual conta você está escolhendo

CargaO que domina a contaComece aquiObserve
Chamadas curtas de APITokens de saída a $6 / 1Mgrok-4.7, esforço low ou mediumO esforço padrão é high
Prompts repetidos abaixo de 200 milLeituras em cache a $0,50API padrão com uma chave de cache estávelAs leituras em cache do 4.5 são $0,30 se a qualidade bastar
Prompts de 200 mil ou mais na APIO corte do pedido inteiroReestruture, ou orce $4 / $12Não é “só o excesso”
O mesmo prompt dentro do CursorA linha de 256 mil e o Fast padrãoVelocidade padrão, salvo se a latência exigir FastPro e acima usam Fast por padrão
Latência acima do custoTabela Fast impressaFast do Cursor ou do Grok BuildNão está na API pública; sem cota gratuita do Grok Build
Agentes com muitas ferramentas$5 / 1.000 chamadas mais tokensLimite busca e execução de códigoA cobrança do X Search mudou em 21 de setembro de 2026

Veredito

Compre o Grok 4.7 quando a tarefa for longa o bastante para o esforço extra merecer os tokens, e compre de propósito o esforço e a superfície. A tabela da API continua sendo a do Grok 4.6. Nesse gráfico, Low é $1,58 por tarefa e Extra High é $6,01. Mantenha os prompts abaixo de 200 mil tokens na API, salvo se você já precificou $4 / $12 para o pedido inteiro. Trate o Fast como a tabela impressa de $4 / $1 / $12 e $6 / $1,50 / $18, e lembre que o Cursor vira em 256 mil, não em 200 mil. Use grok-4.5 ou grok-build-0.1 quando o cache mais barato ou a linha pela metade bastar. Não espere um desconto Batch que a página do modelo diz que não existe.

Os artigos de visão geral, avaliação e alternativas deste modelo ainda não foram publicados. Até lá, o artigo do Grok 4.6, as notas do modelo (English) e as páginas oficiais abaixo são o rastro. Confira a tabela de novo antes de um compromisso mensal; a mudança do X Search nesta mesma página de preços tem data de 21 de setembro de 2026.

Fontes

Perguntas frequentes

Quanto custa o Grok 4.7?

Na API da xAI, conferida em 22 de setembro de 2026, o grok-4.7 custa $2 por milhão de tokens de entrada, $0,50 por milhão de entrada em cache e $6 por milhão de tokens de saída quando o prompt fica abaixo de 200 mil tokens. A partir desse limite, o pedido inteiro passa para $4, $1 e $12. O id público do modelo é grok-4.7.

O Grok 4.7 tem o mesmo preço do Grok 4.6?

As linhas de contexto curto e longo coincidem com o Grok 4.6: $2/$0,50/$6 abaixo de 200 mil tokens de entrada e $4/$1/$12 a partir daí. Esse é o preço de tabela. O gráfico CursorBench da xAI ainda mostra o Grok 4.7 Extra High a $6,01 por tarefa e o Low a $1,58, então o esforço muda a conta sem mudar a tabela. Um usuário do Cursor Ultra que cronometrou uma tarefa também estimou cerca de 2,5 vezes o consumo de cota em relação ao Grok 4.6, em extra high e com o fast mode desligado.

Qual é o preço de contexto longo do Grok 4.7?

Na API da xAI, quando um prompt chega a 200 mil tokens, cada token desse pedido é cobrado a $4 de entrada, $1 de entrada em cache e $12 de saída por milhão. O Cursor documenta outro limite: o uso padrão sob demanda dobra só depois de 256 mil tokens de entrada, até uma janela de 500 mil. Não misture os dois cortes.

Quanto custa o Grok 4.7 Fast?

A página de preços da xAI lista o Fast, disponível só no Cursor e no Grok Build, a $4/$1/$12 por milhão abaixo de 200 mil tokens de prompt e a $6/$1,50/$18 a partir dessa linha. O texto também diz o dobro das tarifas padrão. A linha Fast impressa de contexto longo é 1,5 vez a linha padrão de contexto longo, não o dobro. O Fast não está na API pública da xAI e fica fora da cota gratuita do Grok Build.

A API Batch desconta o Grok 4.7?

Não. A página do modelo grok-4.7 marca a Batch API como não suportada. A página de preços dá 20% de desconto em lote só a modelos anteriores, como grok-4.3 e as variantes grok-4.20, e diz que modelos fora dessa lista não têm desconto em lote.

Chamadas de ferramenta e recusas custam à parte?

Ferramentas do lado do servidor são cobradas além dos tokens. Busca na web e execução de código custam $5 por 1.000 chamadas. Desde 21 de setembro de 2026 às 12:00 PT, o X Search custa $5 por 1.000 publicações obtidas e $10 por 1.000 perfis de usuário. Um pedido da Responses API marcado como violação das regras antes da geração é cobrado a $0,05. Se a geração termina e depois viola, os tokens continuam cobrados.

Dê o próximo passo

Deixe o Tabbit trabalhar ao seu lado.

Pesquise entre abas, automatize o trabalho repetitivo do navegador e mantenha todo o contexto ao alcance.