Caminho errado
A chave do AI Studio e as credenciais do Vertex AI são caminhos diferentes. Outra chave não corrige permissão ausente.
GEMINI 2.5 FLASH-LITE × CONFIGURAÇÕES
O Gemini 2.5 Flash-Lite tem muitos controles, mas não há configuração ideal universal. Fixe o provedor e o ID do modelo e mude uma variável compatível por vez.

A ARMADILHA DAS CONFIGURAÇÕES
Um preset pode misturar campos do provedor, padrões do conector e gosto pessoal. Fixe o caminho da solicitação e registre o estado da resposta.
A chave do AI Studio e as credenciais do Vertex AI são caminhos diferentes. Outra chave não corrige permissão ausente.
Mudar temperature, top-p e contexto juntos não mostra o que ajudou.
Uma resposta vazia pode ser bloqueio, cota, ID incorreto ou formato inválido.
BASE DOCUMENTADA
O Google documenta o modelo estável e seus limites. Use apenas campos aceitos pela API ou pelo conector.
Escolha Google AI Studio ou Vertex AI e use `gemini-2.5-flash-lite`; o preview foi encerrado.
O limite é 1.048.576 tokens de entrada e 65.536 de saída. É um teto, não memória perfeita.
Temperature, top-p, top-k, seed e stop sequences só entram quando o suporte está documentado.
O Google lista thinking como compatível. Streaming muda a entrega, não a política de segurança.
UMA VARIÁVEL POR VEZ
Use o mesmo prompt, instrução, contexto e objetivo de saída. Compare duas ou três respostas e guarde só a melhora.
Defina papel, tarefa, formato e o que não deve ser inventado. “Avance a cena, sem repetir o usuário” é uma preferência testável.
Se a resposta for cortada, aumente o limite antes de aumentar temperature.
Teste temperature, top-p ou top-k, nunca os três juntos. Mantenha seed fixo se houver suporte.
Compare quando o conector expuser o controle e a tarefa exigir planejamento.
Bloqueio, candidato vazio ou stop sequence não são o mesmo que baixa qualidade.
Não use jailbreaks nem tente contornar filtros. Isso é inseguro e pode violar as regras do provedor.

DIAGNÓSTICO
Relacione o sintoma ao caminho da solicitação.
| Sintoma | Tente primeiro | Depois verifique |
|---|---|---|
| 400 / invalid request | Remova um campo incompatível e teste um prompt curto. | Valide JSON, nomes de campos e suporte do conector. |
| 401 / não autenticado | Reconecte com a credencial prevista. | AI Studio e Vertex AI têm caminhos diferentes. |
| 403 / permissão ou política | Confirme projeto, cobrança e acesso. | Leia a mensagem; não tente contorná-la. |
| 404 / modelo não encontrado | Use exatamente `gemini-2.5-flash-lite`. | Confirme endpoint, região e lista do conector. |
| 429 / RESOURCE_EXHAUSTED | Aguarde, reduza a frequência e o payload. | Confira RPM, TPM e RPD do projeto. |
| Resposta vazia | Teste prompt curto e benigno sem formato opcional. | Veja segurança, finish reason, stop sequences e streaming. |
ONDE ENTRA O TABBIT
Tabbit reúne as páginas e arquivos do teste. O snapshot internacional atual lista Gemini 2.5 Flash-Lite, mas o seletor ao vivo é a referência.
Mantenha documentação, registro de prompts e planilha de teste nas abas.
Use @ para citar uma página, captura ou arquivo e comparar duas execuções.
Tabbit não aceita provider do SillyTavern nem chave do AI Studio e não o substitui.

FONTES
FAQ
Use `gemini-2.5-flash-lite`; o preview foi encerrado.
Não há valor universal. Comece pelo padrão do conector e compare uma variável por vez.
Somente se a API ou o conector documentar suporte para este modelo.
É compatível segundo o Google; teste se o controle existir e a tarefa exigir planejamento.
Verifique segurança, finish reason, stop sequences, streaming, ID e cota.
Geralmente indicam solicitação inválida, autenticação, permissão/política, modelo/rota e limite de taxa.
O snapshot internacional atual o habilita, mas conta, edição e cota podem mudar.
Não. Ele não aceita esse provider nem uma chave do AI Studio.
Use o ID estável, registre o estado e respeite a segurança. Abra o Tabbit para manter documentos e arquivos junto do teste.
Disponível para macOS e Windows. Modelos e limites podem mudar.