TabbitBlog

Claude Sonnet 5 : ce qui change et comment y accéder

Un guide sourcé sur Claude Sonnet 5 : changements depuis Sonnet 4.6, accès, limites, coût par tâche et usages adaptés.

Dans cet article
  1. À retenir
  2. Spécifications et accès
  3. Ce qui change depuis Sonnet 4.6
  4. Risques encore inconnus
  5. Ce que dit la communauté
  6. Qui devrait l’essayer ?
  7. Prochaine étape : mesurer une tâche terminée
  8. Verdict final
  9. Sources

Claude Sonnet 5 mérite un pilote contrôlé lorsque le travail exige plusieurs appels d’outils, du code et un suivi sur plusieurs étapes. Commencez par des tâches agentiques bornées et du travail de connaissance pour lesquels la capacité d’Opus serait utile, mais dont le coût ou l’accès pose problème. Gardez Sonnet 4.6 ou un modèle supérieur en comparaison si la couverture brute des bugs, la convergence rapide ou un outil spécialisé est prioritaire.

Anthropic a présenté Claude Sonnet 5 le 30 juin 2026. Son ID actuel est claude-sonnet-5. Cet article s’appuie sur l’annonce Anthropic et le catalogue Claude Platform vérifiés le 20 septembre 2026. Le choix ne dépend pas seulement de la nouveauté : l’effort, les outils et la route de fourniture déterminent le coût et le résultat. (Anthropic, Claude Platform)

À retenir

  • Sonnet 5 est le Sonnet d’Anthropic le plus orienté agents : planification, outils, code et tâches professionnelles en plusieurs étapes.

  • Le catalogue indique claude-sonnet-5, la réflexion adaptative, un contexte d’un million de tokens et 128K de sortie maximale. Tous les clients ne montrent pas ces contrôles.

  • La capture API indique 2 dollars en entrée et 10 dollars en sortie par million de tokens. L’effort, les tokens de réflexion et les reprises augmentent le coût par tâche.

  • Les évaluations publiques sont conditionnelles : Terminal-Bench et le travail de connaissance sont proches d’Opus 4.8, tandis que CodeRabbit observe un compromis précision/rappel en revue de code.

  • Ce brouillon n’a exécuté aucune tâche Sonnet 5 dans Tabbit et ne contient aucune capture. Vérifiez la fiche Claude Sonnet 5 (English) et votre sélecteur.

Spécifications et accès

QuestionCapture actuelleLimite de décision
ID du modèleclaude-sonnet-5Conservez l’ID exact dans les journaux.
Sortie30 juin 2026Comparez avec la même tâche et le même environnement.
Entrée / sortieTexte et image / texteLes outils dépendent de la route.
Contexte / sortie max.1 million / 128K tokensPlafonds du catalogue ; le client peut limiter davantage.
RéflexionAdaptative ; effort par défaut highComparez les niveaux d’effort.
Prix API2 / 10 dollars par MTokAbonnement, cloud et Tabbit sont séparés.
AccèsForfaits Claude et API selon AnthropicConfirmez compte, région, quota et sélecteur.

Le catalogue affiche janvier 2026 comme date de connaissances fiables. Ce n’est pas une garantie d’actualité pour un outil connecté. Un navigateur agentique peut agir sur des pages vivantes, mais le modèle ne reçoit pas ces permissions automatiquement.

Ce qui change depuis Sonnet 4.6

Anthropic met en avant les plans longs, les outils de navigateur et de terminal, le code, le raisonnement et le travail de connaissance. L’entreprise dit aussi que les comportements indésirables sont moins fréquents et que les protections cyber sont activées par défaut. Ce sont des affirmations du fournisseur, pas un test Tabbit.

DimensionSonnet 4.6Sonnet 5Action
Suivi agentiqueBase précédenteDavantage de tâches multi-étapes et vérification annoncéesFixez une condition d’arrêt et une commande de contrôle.
OutilsDépend de la routeAu centre du lancementVérifiez les droits et journalisez les appels.
Terminal67,0 % dans la comparaison datée80,4 % sur Terminal-Bench 2.1Évaluation publiée, pas une reproduction locale.
Travail de connaissanceBase précédente1 618 contre 1 615 pour Opus 4.8Trois points ne désignent pas un vainqueur général.
Revue de codeEnviron 63 % de rappel strict, 29 % de précisionEnviron 50–51 %, 38–40 %Choisissez couverture ou commentaires plus nets.
SécuritéBase Sonnet 4.6Moins de comportements indésirables selon AnthropicGardez revue humaine et tests spécialisés.

Vellum signale que certaines bases Sonnet 4.6 ont été recalculées. Ne mélangez pas dates, évaluateurs et configurations dans un classement. Les sources de revue Sonnet 5 (English) et le guide de raisonnement agentique donnent le contexte.

Risques encore inconnus

Une évaluation publique n’est pas votre environnement. Endor Labs montre que Sonnet 5 avec Claude Code est solide sur la correction fonctionnelle mais plus faible pour fermer des vulnérabilités. Son résumé indique 83,2 % de FuncPass, tandis que le corps indique 82,6 % ; aucun chiffre n’est donc repris comme fait définitif. Un correctif qui passe les tests fonctionnels n’est pas forcément sécurisé.

L’effort modifie aussi la facture. CodeRabbit n’a pas observé d’amélioration nette du rappel strict en effort élevé, alors que le coût de revue doublait presque. Mesurez tokens de réflexion, reprises, outils et corrections humaines, pas seulement le prix au million.

L’accès est lui aussi propre à la route. Le catalogue ne prouve pas qu’un navigateur ou un fournisseur tiers expose le même modèle et les mêmes outils.

Ce que dit la communauté

Sur Reddit, Exodus_Green estime que Sonnet 4.6 en low effort peut dépasser Sonnet 5 en medium sur la recherche agentique, d’après le graphique publié (commentaire). Rent_South a répété son évaluation de flux logiques cinq fois par modèle et conclut que le choix dépend du flux (même discussion). qubedView juge Sonnet bien moins cher pour l’extraction documentaire en une passe, mais préfère Opus pour le code difficile (discussion). TheRealJesus2 conseille de découper le travail, les petits modèles gérant l’effort bas ou moyen et les grands la planification et la vérification (même discussion).

Ce sont des expériences personnelles, pas des benchmarks. X et YouTube ont été essayés le 20 septembre, sans texte stable et attribuable. Aucune capture n’est inventée ; le brouillon reste bloqué.

Qui devrait l’essayer ?

SituationPremière étapePourquoi
Extraction, classification ou routage répétitifEssayer en effort bas/moyenLes tâches bornées offrent un coût plus prévisible.
Code multi-fichiers avec testsActiver les outils et piloterLe suivi long est le principal signal positif.
Revue de sécurité à haut risqueGarder un modèle spécialisé ou supérieurLa correction fonctionnelle ne ferme pas une vulnérabilité.
Petite modification ou chat très sensible à la latenceComparer Sonnet 4.6 ou un modèle rapideIl peut trop réfléchir pour une petite tâche.
ID absent du sélecteurNe pas promettre l’accès ; vérifier compte et régionLe nom du catalogue n’est pas une autorisation.

L’automatisation du navigateur ne supprime ni authentification, ni limites, ni revue. Pour comparer des produits, utilisez la comparaison des navigateurs IA et le guide des navigateurs IA.

Prochaine étape : mesurer une tâche terminée

Choisissez une tâche réversible, notez l’ID, le client, l’effort, le contexte, les droits, les tokens, le temps, les reprises, les appels d’outils, le résultat indépendant et l’intervention humaine. Lancez le même échantillon de test avec Sonnet 4.6 ou votre modèle actuel. Décidez sur le coût par résultat terminé, pas par token.

Le guide Tabbit Browser présente le flux navigateur et les pratiques Tabbit expliquent comment garder une personne dans la boucle. Aucun test Sonnet 5 n’ayant été exécuté dans Tabbit ici, l’accès n’est pas affirmé.

Tabbit Browser

Verdict final

Claude Sonnet 5 mérite un pilote pour le code agentique, les flux avec outils et le travail de connaissance répétitif. Ce n’est ni un remplacement automatique d’Opus, ni une garantie de sécurité ou d’économie. L’effort, les reprises, la route et le découpage du travail font la différence. Gardez ce texte en brouillon jusqu’au test réel dans Tabbit et aux captures communautaires requises.

Sources

Questions fréquentes

Qu’est-ce que Claude Sonnet 5 ?

Claude Sonnet 5 est le modèle intermédiaire d’Anthropic pour le code, les outils, le travail de connaissance et les flux agentiques. Le catalogue Claude Platform vérifié le 20 septembre 2026 indique l’ID claude-sonnet-5, la réflexion adaptative, un contexte d’un million de tokens et une sortie maximale de 128K.

Qu’est-ce qui change par rapport à Sonnet 4.6 ?

Anthropic présente Sonnet 5 comme une version plus agentique, avec des progrès en raisonnement, outils, code et travail professionnel. Des rapports indépendants montrent aussi un compromis : les commentaires de revue peuvent être plus précis, avec une détection stricte des bugs plus faible selon le banc d’essai.

Quelles sont les limites de contexte et de sortie ?

Le catalogue Claude Platform consulté le 20 septembre 2026 indique un contexte d’un million de tokens et une sortie maximale de 128K. Ce sont des limites du catalogue ; le client, le forfait ou le fournisseur peut exposer des limites effectives différentes.

Combien coûte Claude Sonnet 5 ?

La capture actuelle de Claude Platform indique 2 dollars par million de tokens en entrée et 10 dollars en sortie. L’API, les abonnements, le cloud et les majorations de tiers sont séparés, et la réflexion adaptative modifie le coût par tâche.

Où utiliser Claude Sonnet 5 ?

L’annonce d’Anthropic cite les forfaits Claude et l’API Claude. Le sélecteur, la région, le quota et les outils dépendent de la route ; vérifiez le compte réel avant de promettre l’accès à une équipe.

Comment le tester avant de migrer ?

Choisissez une tâche représentative, notez l’ID du modèle, l’effort, les appels d’outils, le temps, les tokens et toute intervention humaine, puis comparez-la à Sonnet 4.6 ou au modèle actuel. Une seule réussite ne prouve pas la fiabilité en production.

Passez à la suite

Laissez Tabbit travailler à vos côtés.

Faites des recherches entre les onglets, automatisez les tâches répétitives du navigateur et gardez chaque élément de contexte à portée de main.