Gemini 3.7 Flash est le modèle multimodal stable de Google pour le code, les appels d'outils et les agents. Il mérite un essai lorsque la vitesse et un tarif API prévisible comptent, mais les faits et les gros changements de code doivent rester vérifiés.
Le 20 septembre 2026, la page stable de Google indiquait gemini-3.7-flash, 1 048 576 tokens d'entrée, 65 536 de sortie et les niveaux de raisonnement low, medium et high. La fiche modèle dit qu'il repose sur Gemini 3.6 ; Gemini 3.8 Flash est une route séparée. Commencez par la page du modèle Gemini 3.7 (English), puis vérifiez le produit et le compte réels.
Décision rapide
C'est un candidat efficace pour les entrées multimodales, les sorties structurées, le code et les outils.
Les benchmarks sont des instantanés datés d'un fournisseur et d'un harness, pas une garantie pour votre dépôt.
La fiche Google cite les hallucinations, l'amélioration continue contre les jailbreaks et les ralentissements ou timeouts occasionnels.
La facturation API, les abonnements Google et l'accès Tabbit sont trois décisions distinctes.
Fiche technique
| Question | Réponse actuelle | Conséquence |
|---|---|---|
| ID stable | gemini-3.7-flash | Confirmer l'ID complet dans le sélecteur et la requête. |
| Entrée/sortie | Texte, image, vidéo, audio, PDF / texte | La liste API ne prouve pas l'exposition de chaque client. |
| Limites | 1 048 576 en entrée ; 65 536 en sortie | La fenêtre réelle peut être plus petite. |
| Raisonnement | Low, medium, high | Minimal est indisponible ; l'effort élevé peut consommer plus. |
| Outils | Cache, code, computer use preview, fichiers, fonctions, grounding, sorties structurées, URL context | Vérifier le compte et le client. |
| Cutoff | Mars 2026 dans la fiche | Les faits actuels exigent des sources. |
Les ressources de prompts (English) et les sources de revue (English) aident à reproduire les tâches sans modifier les limites API.
Le changement depuis 3.6
Google présente 3.7 comme une évolution de la famille 3.6. La comparaison discutée par Eesel donne 85,8 contre 78,0 à Terminal-Bench 2.1, 65,3 contre 48,6 à DeepSWE et 1588 contre 1538 en Code Arena Elo. CharXiv avec outils donne 88,7 contre 89,4 : l'amélioration n'est donc pas universelle.
BenchLM, consulté le 20 septembre 2026, affiche 85,8 % à Terminal-Bench 2.1, 30,4 % à AutomationBench, 47,9 % à OSWorld 2.0, 97 % à MRCR 64K-128K et 93,9 % à GPQA Diamond. Ces valeurs dépendent du fournisseur, du harness et de l'échantillon. Pour un test interne, consultez le guide de raisonnement agentique.
| Point | 3.6 Flash | 3.7 Flash | Lecture |
|---|---|---|---|
| Base | Flash précédent | Fondé sur 3.6 | Comparer avec le même cas et la même acceptation. |
| Code et agents | Plus bas sur plusieurs lignes citées | Plus haut sur plusieurs lignes | Signal utile, pas classement total. |
| Multimodal | Légèrement meilleur sur la ligne CharXiv avec outils | Légèrement inférieur sur cette ligne | Ne pas généraliser à toute vision. |
| Prix jusqu'au 31-12-2026 | Même tarif de lancement | 0,75/3,75 dollar par million | Même prix catalogue, usage de tokens différent. |
La frontière avec 3.8
Le guide Gemini 3.8, sa revue et son analyse de prix couvrent cette autre route. Google la destine aux plans plus longs et au travail autonome. Un rapport communautaire estime environ 30 minutes avec 3.7 contre une heure avec 3.8, mais plus de revue avec 3.7 ; un autre trouve 3.8 plus lent mais plus réfléchi. Ce sont des expériences uniques.
Notez l'ID, le client, le niveau de raisonnement et la date ; donnez les mêmes fichiers et critères ; mesurez temps, tokens, appels d'outils et corrections. La présentation des navigateurs IA explique pourquoi un client web peut différer de l'API. Un abonnement Google ne prouve ni un compte API ni l'accès Tabbit.
Accès, prix et frontières
| Route | À vérifier | Ne pas déduire |
|---|---|---|
| Google AI Studio | Sélecteur, région, quota, clé | Que le gratuit égale le payant. |
| Gemini API | ID, facturation, rate limit, tokens | Que le navigateur expose les mêmes outils. |
| Antigravity / Android Studio | Déploiement et compte | Qu'une clé API suffise pour l'IDE. |
| Gemini Enterprise | Contrat, région, administrateur | Que les conditions grand public s'appliquent. |
| Spark / Google AI | Offre, pays, rollout | Que des crédits API soient inclus. |
Google indique 0,75 dollar en entrée et 3,75 en sortie par million jusqu'au 31 décembre 2026, puis 1,50 et 7,50 en 2027. Cache, grounding, Batch et Flex ont leurs propres règles ; la sortie peut inclure les tokens de raisonnement. Ne mélangez pas API, abonnement et Tabbit.
Auto-vérification
Avant de faire confiance au résultat, notez ID, client, compte, région, date et niveau de raisonnement. Ajoutez les modalités, la taille des fichiers, les outils, le schema de sortie et le critère d'acceptation. Testez le code localement, gardez un champ absent dans les extractions et limitez les appels d'un agent. Préparez une réponse aux timeouts, outils non disponibles, faits anciens et JSON invalide.
Aucun test authentifié de Gemini 3.7 n'a été fait dans Tabbit Browser. Cet article ne revendique donc ni sélecteur, ni contexte effectif, ni latence, ni abonnement, ni coût. Si le modèle apparaît, faites une petite extraction et répétez-la avec une réponse connue. La présentation Tabbit AI Browser décrit la frontière du produit, pas un benchmark API.
Verdict
Gemini 3.7 Flash est un candidat efficace pour le code multimodal et les outils. Les données indiquent des progrès sur plusieurs mesures par rapport à 3.6, pas une supériorité générale. Utilisez un test fixe, comparez 3.8 si la planification longue vaut le temps et les tokens, et gardez une autre option pour les tâches critiques.
Sources et questions
Références : documentation Google, annonce, fiche DeepMind, prix API, BenchLM et Eesel. Les dates et limites des sources communautaires figurent dans les sections concernées ci-dessus.
Est-il stable ?
L'API marque gemini-3.7-flash stable, mais le produit peut appliquer ses propres quotas et régions.
Tous les clients lisent-ils un million de tokens ?
Non. C'est le plafond API ; un client peut offrir moins.
3.7 ou 3.8 ?
Répétez le même cas avec la même acceptation. 3.7 favorise l'efficacité, 3.8 les tâches longues.
Le prix API inclut-il l'abonnement ?
Non. Les conditions API, grand public et Tabbit sont séparées.
Les connaissances sont-elles actuelles ?
La fiche donne mars 2026 comme cutoff. Vérifiez les faits actuels.
Peut-on l'utiliser dans Tabbit ?
Une session authentifiée n'a pas été vérifiée. Contrôlez votre sélecteur.
Questions fréquentes
Qu'est-ce que Gemini 3.7 Flash ?
C'est le modèle Flash multimodal stable de Google pour le code, les outils et les flux d'agents. L'API accepte texte, images, vidéo, audio et PDF, puis renvoie du texte.
Quelles sont ses limites ?
Google indique 1 048 576 tokens en entrée et 65 536 en sortie. Le raisonnement accepte low, medium et high ; minimal n'est pas pris en charge.
Quel est le prix ?
Jusqu'au 31 décembre 2026, le tarif standard est de 0,75 dollar par million de tokens en entrée et 3,75 en sortie ; les montants indiqués pour 2027 sont 1,50 et 7,50 dollars.
Où l'utiliser ?
Google cite AI Studio, Gemini API, Google Antigravity, Android Studio, Gemini Enterprise et Spark. Les conditions varient selon le produit, le pays et le compte.
Quelle différence avec 3.6 et 3.8 ?
La fiche Google indique que 3.7 repose sur 3.6. Les comparaisons indépendantes montrent des gains sur plusieurs tests de code ; 3.8 est une route voisine pour les travaux plus longs.
Est-il disponible dans Tabbit ?
Aucun test 3.7 n'a été fait avec un compte Tabbit authentifié. L'article ne déduit donc ni disponibilité, ni latence, ni coût ; vérifiez votre sélecteur.