Nom officiel
L’annonce Qwen du 3 août 2026 utilise le nom Qwen3.8-Max. Elle indique 2,4 billions de paramètres au total et 95 milliards actifs. Ces chiffres ne prouvent pas l’existence d’un modèle 27B.
Qwen 3.8 · guide pratique pour SillyTavern
Ce nom recouvre plusieurs choses. La version officielle de Qwen s’appelle Qwen3.8-Max, avec 2,4 billions de paramètres au total et 95 milliards actifs. « Qwen3.8-27B » apparaît dans des résultats communautaires, mais nous n’avons pas trouvé ici de publication officielle ni de contrat API Qwen correspondant à ce nom. Vérifiez le modèle réellement proposé par votre fournisseur avant de modifier un preset.
Ce guide sépare les informations officielles des retours de la communauté. Il ne propose pas de contourner les protections et ne promet pas ce modèle sur chaque compte Tabbit.

Commencez par le bon nom
Les problèmes commencent souvent avant le premier message : un extrait de recherche, un checkpoint local et un alias hébergé sont traités comme un seul contrat.
L’annonce Qwen du 3 août 2026 utilise le nom Qwen3.8-Max. Elle indique 2,4 billions de paramètres au total et 95 milliards actifs. Ces chiffres ne prouvent pas l’existence d’un modèle 27B.
« Qwen3.8-27B » se trouve dans des publications communautaires et des extraits de recherche, mais nous ne l’avons pas vérifié comme checkpoint officiel Qwen. Ne téléchargez pas un fichier et ne choisissez pas une quantification sur le seul nom.
L’exemple officiel utilise qwen3.8-max. Un guide tiers mentionne aussi qwen3.8-max-preview pour un canal de prévisualisation. Dans SillyTavern, utilisez l’ID exact fourni par votre service et notez le model renvoyé.
Un endpoint hébergé suit le protocole et le template de son fournisseur. Un checkpoint local utilise son tokenizer et son template de chat. N’ajoutez pas un template Qwen à un endpoint qui formate déjà les messages.
Parcours de configuration SillyTavern
Les cartes de personnage et les presets ne réparent pas un mauvais endpoint. Vérifiez d’abord la connexion, puis faites une courte comparaison RP.
SillyTavern est un frontend dédié au RP. Les noms de presets et le comportement du fournisseur appartiennent à leurs auteurs et services, pas à la note de sortie Qwen.
Ouvrez la liste actuelle des modèles du fournisseur. Si Qwen3.8-Max n’y figure pas ou si l’ID est différent, cessez d’utiliser un alias qwen3.8 deviné. Les filtres et la latence relèvent du fournisseur.
Pour une route compatible OpenAI, utilisez Chat Completions et le champ model documenté par le fournisseur. Gardez la clé API et la Base URL dans ses réglages, pas dans la carte ni dans le prompt.
Les routes hébergées sérialisent généralement les messages. Pour des poids locaux, utilisez le template officiel du tokenizer quand la documentation du checkpoint le fournit. Un mauvais template peut passer pour un problème de roleplay.
Les notes officielles de Qwen listent low, medium et xhigh, avec xhigh par défaut. Commencez par low ou medium pour mesurer latence et respect du format, puis comparez xhigh avec la même carte.
Diagnostic rapide
Gardez la carte, le message initial, la limite de contexte et la sortie maximale fixes. Ne changez qu’une variable à la fois.
| Ce que vous voyez | À vérifier d’abord | Petite correction |
|---|---|---|
| Modèle introuvable ou remplacement silencieux | Liste du fournisseur et model renvoyé | Copiez l’ID exposé et supprimez les alias 27B devinés. |
| Le balisage ou le rôle est incorrect | Mode de l’endpoint et responsable du template | Utilisez le template du fournisseur ou celui du checkpoint local, pas les deux. |
| Long raisonnement, peu d’action dans la scène | reasoning_effort, limite de sortie et longueur du preset | Comparez low/medium à xhigh et demandez un changement concret dans la scène. |
| Le personnage ignore les règles de format | Longueur, position et branche active des règles | Placez un contrat de format court à la fin et testez deux tours de plus. |
| Filtre ou refus différent selon le fournisseur | Route directe et route tierce | Notez le comportement du fournisseur, sans le présenter comme un fait du modèle. |
Contrat du prompt RP
Le fil communautaire rapporte à la fois un raisonnement trop long et un respect du format plus faible. Utilisez un contrat court, puis observez les deux tours suivants.
Rôle : Vous êtes [personnage]. Scène : [lieu, relation, conflit actuel]. Style : [point de vue, langue, longueur des phrases]. Direction : Faites avancer une action observable par tour. Ne parlez pas et ne décidez pas à la place de l’utilisateur. Continuité : Utilisez uniquement les faits confirmés ; posez une question en cas de doute. Format : Action d’abord, dialogue ensuite. De 250 à 450 mots. Pas de résumé ni d’explication des règles. Vérification : Gardez la voix, le format, les limites et l’indice non résolu du tour précédent.
Pour comparer proprement, utilisez la même carte une fois avec le raisonnement désactivé ou en low, puis avec medium ou xhigh. Notez latence, répétitions, respect des règles et progression de la scène.
Parcours navigateur
SillyTavern convient aux cartes et aux lorebooks. Tabbit répond à un autre besoin : garder un wiki, une page de référence ou un fichier à côté de la conversation.
Ouvrez la fiche du personnage, le wiki de l’univers ou le brief d’écriture dans un onglet. Vous pouvez le citer sans coller chaque paragraphe dans le prompt.
Ouvrez le sélecteur de modèles Tabbit et choisissez Qwen3.8-Max uniquement s’il apparaît dans votre édition et votre compte. Le sélecteur indique les modèles disponibles dans Tabbit.
Utilisez @ pour envoyer un onglet, une capture ou un fichier ouvert dans le contexte. Demandez une vérification de continuité, une courte réécriture ou une comparaison avec les faits de la source.
Utilisez le chat multimodèle pour faire relire le même document. La capture montre un vrai parcours navigateur, sans garantir le même accès aux modèles.

Tabbit

01
Nom officiel, date du 3 août 2026, chiffres 2,4T et 95B, et réglages de raisonnement API.

02
Utilisez le chat multimodèle pour faire relire le même document. La capture montre un vrai parcours navigateur, sans garantir le même accès aux modèles.
Choisir le frontend
Choisissez l’outil qui prend en charge le point difficile de votre flux. Les deux permettent de discuter, mais leurs réglages diffèrent.
| Besoin | SillyTavern | Tabbit |
|---|---|---|
| Cartes de personnages et lorebooks | Contrôles dédiés | Citer pages et fichiers |
| Presets et ordre du prompt | Contrôle précis | Prompt système et Skills |
| Recherche à côté du RP | Extensions ou copier-coller | Les onglets ouverts deviennent le contexte |
| Comparer les modèles | Réglages fournisseur ou extensions | Chat multimodèle dans le navigateur |
| Premier geste | Vérifier fournisseur, template et carte | Ouvrir la source puis vérifier le sélecteur |
Ouvrir les preuves
La page distingue les faits officiels sur le modèle de l’expérience de la communauté. Lisez les pages sources avant de changer un réglage durable.
Questions fréquentes
Ce guide n’a pas pu le vérifier comme une sortie officielle de Qwen. L’annonce Qwen utilise Qwen3.8-Max et indique 2,4T de paramètres totaux et 95B actifs. Traitez 27B comme une étiquette communautaire non vérifiée jusqu’à ce qu’une page officielle de checkpoint l’atteste.
Utilisez l’ID exact renvoyé par le fournisseur. L’exemple officiel utilise qwen3.8-max ; qwen3.8-max-preview correspond à un canal de prévisualisation dans un guide tiers. Ne devinez pas un alias depuis un extrait de recherche.
Les fournisseurs hébergés gèrent normalement la sérialisation des messages. Les poids locaux doivent suivre le tokenizer et la documentation du checkpoint. Appliquer un template dans le frontend et un autre chez le fournisseur peut corrompre les rôles.
Commencez avec low ou medium pour établir une mesure de latence, puis comparez xhigh avec la même carte. Les notes Qwen listent low, medium et xhigh, avec xhigh par défaut. Plus de raisonnement ne garantit pas une meilleure voix de personnage.
Le fil Reddit contient des retours de raisonnement long et des réponses plus rapides qui suivent moins bien le format. Vérifiez séparément le fournisseur, la longueur du preset, reasoning_effort et la position des règles.
Seulement s’il apparaît dans le sélecteur de modèles de votre Tabbit. S’il est disponible, gardez ouverte la page ou le fichier du personnage et citez-le avec @. La disponibilité varie selon l’édition, la région, le compte et le déploiement.
Installez Tabbit pour macOS ou Windows, vérifiez le sélecteur et apportez les références du personnage dans une conversation du navigateur.
L’accès aux modèles et les conditions varient selon l’édition et le déploiement.