COMUNIDADE
Raciocínio excessivo é um sintoma
Um system prompt menor ou um nível de reasoning mais baixo pode ajudar. Uma resposta longa também pode vir do modelo, do histórico ou do provedor. Teste uma conversa limpa.
PRESET LAB / KIMI K3
As discussões da comunidade repetem os mesmos problemas: raciocínio excessivo, instruções mal seguidas, prefill parcial e samplers que mudam entre provedores. Comece limpo e altere uma camada por vez.
Relatos da comunidade são experimentos, não um preset universal. Confira primeiro o provedor e o seletor de modelos.

O QUE A COMUNIDADE RELATA
O tópico de presets no Reddit e o tópico sobre excesso de raciocínio pedem soluções para seguir instruções, censura, prefill parcial e provedores que tratam prefill de forma diferente. A documentação oficial da Kimi descreve modelo e API, não um único preset para SillyTavern.
COMUNIDADE
Um system prompt menor ou um nível de reasoning mais baixo pode ajudar. Uma resposta longa também pode vir do modelo, do histórico ou do provedor. Teste uma conversa limpa.
OFICIAL
O guia rápido da API Kimi K3 ajuda a verificar o slug e o formato atuais. Parâmetros e acesso podem mudar por provedor.
FRONTEND
Usuários no Reddit perguntam quais provedores aceitam prefill e relatam problemas com prefill parcial. Trate-o como uma camada opcional de compatibilidade.
TABELA DE DECISÃO
O preset mais seguro é aquele cujas mudanças você consegue explicar e desfazer. Use estes perfis como planos de teste; não importe JSON não verificado só pelo nome.
Esta página não distribui arquivo de preset da comunidade. “Overthinking fix” descreve o objetivo de um tópico, não um download oficial.
Mantenha o system prompt curto, defina a voz uma vez e altere temperatura ou criatividade com moderação. Teste uma cena de dois turnos.
✓ O tom permanece estável sem repetir a instrução.
Use um contrato de formato curto e um exemplo. Defina tamanho e parada, removendo regras duplicadas antes de tocar no sampler.
✓ A estrutura funciona em uma conversa nova.
Preserve espaço de contexto e não misture um preset de roleplay a um prompt de pesquisa. Verifique se o histórico ou provedor cortou dados.
✓ Os detalhes importantes chegam ao próximo turno.
ORDEM SEGURA DE IMPORTAÇÃO
Salve o preset atual antes de alterá-lo. Uma base conhecida facilita comparar resultados e voltar atrás.
Um preset não corrige 401, 404, 429, histórico truncado ou parâmetro sem suporte. Corrija essa camada primeiro.
Guarde preset, system prompt, parâmetros de geração e uma conversa curta de teste. Anote também provedor e alias do modelo.
✓ Você consegue restaurar a base exata.
Abra o JSON como texto. Confira campos alterados, system prompt embutido e frontend ou provedor de destino.
✓ Você conhece cada campo que mudará.
Altere um campo entre temperature, top_p, min_p, repetição ou limite de tokens. O gateway pode ignorar ou renomear campos.
✓ Cada resultado tem uma causa registrada.
O raciocínio do K3 e o suporte do provedor podem variar. Teste uma resposta limpa e só depois ative uma extensão se o sintoma exigir.
✓ A resposta final chega e o turno assistant completo permanece.
SINTOMA → CAMADA → TESTE
Associe o sintoma à menor camada provável. Os tópicos dão pistas, mas sua requisição e resposta são a evidência.
| Sintoma | Camada provável | Próximo teste |
|---|---|---|
| K3 explica sem parar ou repete | Thinking, prompt ou histórico | Abra um chat limpo, encurte o system prompt e teste um reasoning menor se o provedor oferecer. |
| Ignora o formato pedido | System prompt ou sampler | Remova regras duplicadas, adicione um exemplo e teste sem alterar o sampler. |
| Prefill é cortado ou gera resposta estranha | Compatibilidade do provedor | Desative prefill e compare uma resposta limpa. Confirme a documentação do provedor para o modelo. |
| Não há resposta após o bloco thinking | Mapeamento da resposta | Verifique se reasoning e content chegam em campos separados e preserve o turno assistant completo. |
| Temperature ou top_p não mudam nada | Parâmetro sem suporte | Confira a documentação ou o corpo da requisição. Gateways podem ignorar campos ou usar outros nomes. |
| 401, 404, 429 ou timeout | Provedor e cota | Verifique chave, URL base, alias, limites, concorrência e tentativas antes de editar o preset. |
OUTRO FLUXO
Para tarefas baseadas em página, PDF, planilha ou pesquisa, o Tabbit oferece chat no navegador. Confira Kimi-K3 no seletor e referencie o contexto com @.
Abra o artigo, a documentação ou o arquivo. O Tabbit pode referenciar páginas visíveis, capturas, grupos de abas e arquivos.
✓ A fonte fica ao lado da conversa.

Selecione Kimi-K3 no seletor de modelos. A lista mostra o acesso real da sua edição e plano.
✓ O modelo correto está selecionado.

Use Chat para perguntar, vários modelos para comparar ou Agent para agir em uma página. O Tabbit não importa cards do SillyTavern nem substitui suas extensões.
✓ A resposta continua ligada à página ou ao arquivo.

FAQ DE PRESET
A documentação de modelo e API da Kimi não lista um preset universal oficial. Experimentos da comunidade dependem do frontend, provedor, histórico e uso.
Use uma fonte que possa ser inspecionada e seja confiável. Exporte suas configurações e compare os campos antes de importar.
Não há um conjunto universal entre provedores. Altere um campo por vez, registre o resultado e confirme que o gateway o aplica.
Não para começar. Conecte com um prompt limpo e adicione uma extensão apenas quando souber o comportamento a mudar e houver compatibilidade documentada.
Provedores podem mudar alias, padrões, cotas, contexto e suporte a prefill. O frontend também pode serializar reasoning de outro modo.
Não. O Tabbit oferece seleção de modelos e contexto de páginas ou arquivos no navegador. Cards, lorebooks, extensões e chats em grupo continuam no SillyTavern.
Mantenha o preset reversível, teste uma camada por vez e use o provedor ativo como evidência. Para trabalhar ao lado de páginas ou arquivos, abra o Tabbit e escolha Kimi-K3.
Disponível para macOS e Windows. Acesso e cotas variam por edição e plano.