Qwen 3.8 · guide pratique pour SillyTavern

Qwen 3.8 dans SillyTavern

Ce nom recouvre plusieurs choses. La version officielle de Qwen s’appelle Qwen3.8-Max, avec 2,4 billions de paramètres au total et 95 milliards actifs. « Qwen3.8-27B » apparaît dans des résultats communautaires, mais nous n’avons pas trouvé ici de publication officielle ni de contrat API Qwen correspondant à ce nom. Vérifiez le modèle réellement proposé par votre fournisseur avant de modifier un preset.

Vérifier le contrat du modèle

Ce guide sépare les informations officielles des retours de la communauté. Il ne propose pas de contourner les protections et ne promet pas ce modèle sur chaque compte Tabbit.

Nouvel onglet Tabbit avec sélecteur de modèles et champ pour citer des pages ou des fichiers

Commencez par le bon nom

Trois étiquettes, trois questions

Les problèmes commencent souvent avant le premier message : un extrait de recherche, un checkpoint local et un alias hébergé sont traités comme un seul contrat.

01

Nom officiel

L’annonce Qwen du 3 août 2026 utilise le nom Qwen3.8-Max. Elle indique 2,4 billions de paramètres au total et 95 milliards actifs. Ces chiffres ne prouvent pas l’existence d’un modèle 27B.

02

L’affirmation 27B

« Qwen3.8-27B » se trouve dans des publications communautaires et des extraits de recherche, mais nous ne l’avons pas vérifié comme checkpoint officiel Qwen. Ne téléchargez pas un fichier et ne choisissez pas une quantification sur le seul nom.

03

ID du modèle hébergé

L’exemple officiel utilise qwen3.8-max. Un guide tiers mentionne aussi qwen3.8-max-preview pour un canal de prévisualisation. Dans SillyTavern, utilisez l’ID exact fourni par votre service et notez le model renvoyé.

04

Local ou API

Un endpoint hébergé suit le protocole et le template de son fournisseur. Un checkpoint local utilise son tokenizer et son template de chat. N’ajoutez pas un template Qwen à un endpoint qui formate déjà les messages.

Parcours de configuration SillyTavern

Corriger le contrat avant le style

Les cartes de personnage et les presets ne réparent pas un mauvais endpoint. Vérifiez d’abord la connexion, puis faites une courte comparaison RP.

SillyTavern est un frontend dédié au RP. Les noms de presets et le comportement du fournisseur appartiennent à leurs auteurs et services, pas à la note de sortie Qwen.

  1. 1. Confirmer le fournisseur

    Ouvrez la liste actuelle des modèles du fournisseur. Si Qwen3.8-Max n’y figure pas ou si l’ID est différent, cessez d’utiliser un alias qwen3.8 deviné. Les filtres et la latence relèvent du fournisseur.

  2. 2. Adapter l’endpoint

    Pour une route compatible OpenAI, utilisez Chat Completions et le champ model documenté par le fournisseur. Gardez la clé API et la Base URL dans ses réglages, pas dans la carte ni dans le prompt.

  3. 3. Confier le template à un seul endroit

    Les routes hébergées sérialisent généralement les messages. Pour des poids locaux, utilisez le template officiel du tokenizer quand la documentation du checkpoint le fournit. Un mauvais template peut passer pour un problème de roleplay.

  4. 4. Commencer avec peu de raisonnement

    Les notes officielles de Qwen listent low, medium et xhigh, avec xhigh par défaut. Commencez par low ou medium pour mesurer latence et respect du format, puis comparez xhigh avec la même carte.

Diagnostic rapide

Trouver la cause en trois tours

Gardez la carte, le message initial, la limite de contexte et la sortie maximale fixes. Ne changez qu’une variable à la fois.

Ce que vous voyezÀ vérifier d’abordPetite correction
Modèle introuvable ou remplacement silencieuxListe du fournisseur et model renvoyéCopiez l’ID exposé et supprimez les alias 27B devinés.
Le balisage ou le rôle est incorrectMode de l’endpoint et responsable du templateUtilisez le template du fournisseur ou celui du checkpoint local, pas les deux.
Long raisonnement, peu d’action dans la scènereasoning_effort, limite de sortie et longueur du presetComparez low/medium à xhigh et demandez un changement concret dans la scène.
Le personnage ignore les règles de formatLongueur, position et branche active des règlesPlacez un contrat de format court à la fin et testez deux tours de plus.
Filtre ou refus différent selon le fournisseurRoute directe et route tierceNotez le comportement du fournisseur, sans le présenter comme un fait du modèle.

Contrat du prompt RP

Réduire les règles qui se perdent

Le fil communautaire rapporte à la fois un raisonnement trop long et un respect du format plus faible. Utilisez un contrat court, puis observez les deux tours suivants.

Rôle : Vous êtes [personnage].
Scène : [lieu, relation, conflit actuel].
Style : [point de vue, langue, longueur des phrases].
Direction : Faites avancer une action observable par tour. Ne parlez pas et ne décidez pas à la place de l’utilisateur.
Continuité : Utilisez uniquement les faits confirmés ; posez une question en cas de doute.
Format : Action d’abord, dialogue ensuite. De 250 à 450 mots. Pas de résumé ni d’explication des règles.
Vérification : Gardez la voix, le format, les limites et l’indice non résolu du tour précédent.

Pour comparer proprement, utilisez la même carte une fois avec le raisonnement désactivé ou en low, puis avec medium ou xhigh. Notez latence, répétitions, respect des règles et progression de la scène.

Parcours navigateur

Utiliser Tabbit quand les documents du personnage sont déjà en ligne

SillyTavern convient aux cartes et aux lorebooks. Tabbit répond à un autre besoin : garder un wiki, une page de référence ou un fichier à côté de la conversation.

  1. 1

    Garder la source ouverte

    Ouvrez la fiche du personnage, le wiki de l’univers ou le brief d’écriture dans un onglet. Vous pouvez le citer sans coller chaque paragraphe dans le prompt.

  2. 2

    Regarder le sélecteur

    Ouvrez le sélecteur de modèles Tabbit et choisissez Qwen3.8-Max uniquement s’il apparaît dans votre édition et votre compte. Le sélecteur indique les modèles disponibles dans Tabbit.

  3. 3

    Citer avec @

    Utilisez @ pour envoyer un onglet, une capture ou un fichier ouvert dans le contexte. Demandez une vérification de continuité, une courte réécriture ou une comparaison avec les faits de la source.

  4. 4

    Comparer sans perdre la page

    Utilisez le chat multimodèle pour faire relire le même document. La capture montre un vrai parcours navigateur, sans garantir le même accès aux modèles.

Sélecteur de modèles Tabbit avec modèles de chat et champ pour citer des pages ou envoyer des fichiers

Tabbit

Citer avec @

Qwen officiel : sortie de Qwen3.8-Max

01

Qwen officiel : sortie de Qwen3.8-Max

Nom officiel, date du 3 août 2026, chiffres 2,4T et 95B, et réglages de raisonnement API.

Sélecteur de modèles Tabbit avec modèles de chat et champ pour citer des pages ou envoyer des fichiers

02

Comparer sans perdre la page

Utilisez le chat multimodèle pour faire relire le même document. La capture montre un vrai parcours navigateur, sans garantir le même accès aux modèles.

Choisir le frontend

SillyTavern ou Tabbit ?

Choisissez l’outil qui prend en charge le point difficile de votre flux. Les deux permettent de discuter, mais leurs réglages diffèrent.

BesoinSillyTavernTabbit
Cartes de personnages et lorebooksContrôles dédiésCiter pages et fichiers
Presets et ordre du promptContrôle précisPrompt système et Skills
Recherche à côté du RPExtensions ou copier-collerLes onglets ouverts deviennent le contexte
Comparer les modèlesRéglages fournisseur ou extensionsChat multimodèle dans le navigateur
Premier gesteVérifier fournisseur, template et carteOuvrir la source puis vérifier le sélecteur

Questions fréquentes

Questions sur Qwen 3.8 et SillyTavern

Qwen3.8-27B est-il un modèle officiel ?+

Ce guide n’a pas pu le vérifier comme une sortie officielle de Qwen. L’annonce Qwen utilise Qwen3.8-Max et indique 2,4T de paramètres totaux et 95B actifs. Traitez 27B comme une étiquette communautaire non vérifiée jusqu’à ce qu’une page officielle de checkpoint l’atteste.

Quel ID entrer dans SillyTavern ?+

Utilisez l’ID exact renvoyé par le fournisseur. L’exemple officiel utilise qwen3.8-max ; qwen3.8-max-preview correspond à un canal de prévisualisation dans un guide tiers. Ne devinez pas un alias depuis un extrait de recherche.

Quel template de chat utiliser ?+

Les fournisseurs hébergés gèrent normalement la sérialisation des messages. Les poids locaux doivent suivre le tokenizer et la documentation du checkpoint. Appliquer un template dans le frontend et un autre chez le fournisseur peut corrompre les rôles.

Faut-il activer le raisonnement pour le RP ?+

Commencez avec low ou medium pour établir une mesure de latence, puis comparez xhigh avec la même carte. Les notes Qwen listent low, medium et xhigh, avec xhigh par défaut. Plus de raisonnement ne garantit pas une meilleure voix de personnage.

Pourquoi le RP Qwen 3.8 est-il lent ou ignore-t-il les règles ?+

Le fil Reddit contient des retours de raisonnement long et des réponses plus rapides qui suivent moins bien le format. Vérifiez séparément le fournisseur, la longueur du preset, reasoning_effort et la position des règles.

Puis-je utiliser Qwen3.8-Max dans Tabbit ?+

Seulement s’il apparaît dans le sélecteur de modèles de votre Tabbit. S’il est disponible, gardez ouverte la page ou le fichier du personnage et citez-le avec @. La disponibilité varie selon l’édition, la région, le compte et le déploiement.

Garder la source près de la scène

Installez Tabbit pour macOS ou Windows, vérifiez le sélecteur et apportez les références du personnage dans une conversation du navigateur.

L’accès aux modèles et les conditions varient selon l’édition et le déploiement.

© 2026 Tabbit Browser. Le navigateur natif IA qui comprend votre contexte.