DevNews

Gemini 3.6 Flash dans Copilot, 17 % de tokens en moins

Sur cette page
  1. Ce que Google a livre
  2. Les chiffres qui comptent
  3. Deja en deploiement dans GitHub Copilot
  4. Un palier de travail, avec Gemini 4 a l'horizon
  5. Sources et pour aller plus loin

Google a livre Gemini 3.6 Flash le mardi vingt et un juillet, et pour une fois le chiffre qui compte n'est pas un benchmark, c'est une facture. Le nouveau modele de travail consomme environ dix sept pour cent de tokens de sortie en moins que Gemini 3.5 Flash sur l'indice Artificial Analysis, et Google a baisse le prix de sortie de neuf dollars a sept dollars cinquante par million de tokens dans le meme temps. Il arrive avec Gemini 3.5 Flash Lite, et il se deploie deja dans GitHub Copilot pour le code et le travail agentique. Si vous faites tourner des agents qui multiplient les appels d'outils sur de longues taches, des tokens moins chers qui finissent aussi en moins d'etapes, c'est le genre de changement qui se voit sur votre facture, voici donc ce qui a ete livre et comment y penser.

The short answer

Google a lance Gemini 3.6 Flash le vingt et un juillet, un modele Flash moins cher et plus econome en tokens concu pour le code et les flux agentiques. Il depense environ dix sept pour cent de tokens de sortie en moins que Gemini 3.5 Flash, baisse le prix de sortie a sept dollars cinquante par million, et affiche de meilleurs scores sur le code et l'usage de l'ordinateur. Il est arrive avec Gemini 3.5 Flash Lite et se deploie deja dans GitHub Copilot, tandis que le phare 3.5 Pro reste en test.

17 %de tokens de sortie en moins que 3.5 Flash
7,50 $le prix de sortie par million, contre 9,00 $
Copilotdisponible et en cours de deploiement
Carte reponse : Google a lance Gemini 3.6 Flash le vingt et un juillet, un modele Flash moins cher et plus econome en tokens pour le code agentique qui consomme environ dix sept pour cent de tokens de sortie en moins que 3.5 Flash et se deploie dans GitHub Copilot.
Le palier Flash est la ou se trouve la capacite fraiche et largement disponible pendant que Gemini 3.5 Pro reste en test limite. PNG

La plupart des lancements de modeles vous demandent de regarder un classement. Celui ci vous demande de regarder votre compteur de tokens. Gemini 3.6 Flash n'est pas presente comme un nouveau plafond de pointe, mais comme le modele du quotidien que vous laissez tourner sous les agents et les outils de code, et toute l'histoire tient a faire le meme travail pour moins cher. Pour les equipes qui surveillent la depense sur de longues chaines agentiques, c'est une promesse plus utile qu'un point de plus sur un graphique.

Ce que Google a livre

Le mardi vingt et un juillet, Google DeepMind a lance Gemini 3.6 Flash comme nouveau modele par defaut de sa gamme Flash, rapide et a faible cout, remplacant Gemini 3.5 Flash en tete de ce palier. Il est arrive avec Gemini 3.5 Flash Lite, l'option la moins chere de la famille, la mise a jour rafraichit donc tout le palier de travail plutot qu'un seul modele.

Le prix est la partie a noter. L'entree reste a un dollar cinquante par million de tokens, et la sortie tombe a sept dollars cinquante par million, contre neuf dollars sur 3.5 Flash. Google decrit le modele comme prenant moins d'etapes de raisonnement et d'appels d'outils pour finir des flux en plusieurs etapes, ce qui compte car dans le travail agentique c'est le nombre de tokens, pas seulement le prix affiche, qui fixe votre cout.

Les chiffres qui comptent

Google indique que Gemini 3.6 Flash consomme environ dix sept pour cent de tokens de sortie en moins que 3.5 Flash sur l'indice Artificial Analysis, et jusqu'a soixante cinq pour cent en moins sur le benchmark de code DeepSWE. Ajoutez le prix unitaire plus bas et le cout reel d'un run de code ou d'agent peut baisser plus que la seule reduction de prix ne le laisse penser.

Cote capacite brute, le modele progresse sur les tests qui interessent ce public. DeepSWE monte a quarante neuf pour cent contre trente sept, MLE Bench a soixante trois virgule neuf contre quarante neuf virgule sept, et OSWorld Verified, qui mesure l'usage de l'ordinateur, a quatre vingt trois contre soixante dix huit virgule quatre. Son score GDPval sur l'indice Artificial Analysis version deux est de mille quatre cent vingt et un contre mille trois cent quarante neuf. Rien de tout cela n'en fait un modele de pointe phare, et Google ne le pretend pas, mais un modele de travail qui code mieux et coute moins, c'est exactement le compromis que veut la plupart des equipes.

Carte reponse : gains de Gemini 3.6 Flash sur 3.5 Flash, DeepSWE quarante neuf contre trente sept, MLE Bench soixante trois virgule neuf contre quarante neuf virgule sept, OSWorld Verified quatre vingt trois contre soixante dix huit virgule quatre, avec un prix de sortie passant de neuf dollars a sept dollars cinquante par million de tokens.
Meilleurs scores de code et d'usage de l'ordinateur, moins de tokens et un prix de sortie plus bas. Les gains vont tous dans le meme sens. PNG

Deja en deploiement dans GitHub Copilot

Ce qui rend ce lancement concret pour les developpeurs aujourd'hui, c'est Copilot. Gemini 3.6 Flash est disponible de facon generale et se deploie dans GitHub Copilot pour les offres Pro, Pro Plus, Max, Business et Enterprise, selectionnable depuis le selecteur de modeles. GitHub le positionne pour le developpement web et applicatif, le code et les taches agentiques a long horizon, et indique que les premiers tests ont montre de meilleurs taux d'achevement des taches et une meilleure efficacite en tokens que 3.5 Flash.

Deux remarques pratiques. Le deploiement est progressif, donc si le modele n'est pas encore dans votre selecteur, il devrait apparaitre sous peu. Et sur Copilot Business et Copilot Enterprise, un administrateur doit activer la politique Gemini 3.6 Flash dans les parametres Copilot avant que votre equipe puisse le choisir, donc si vous gerez un espace de travail, ce reglage est la porte d'entree.

L'annonce officielle de GitHub indiquant que Gemini 3.6 Flash est disponible et se deploie dans Copilot.

Un palier de travail, avec Gemini 4 a l'horizon

Deux elements de contexte meritent d'accompagner ce lancement. D'abord, le modele phare Gemini 3.5 Pro est toujours en test limite chez des partenaires plutot qu'en sortie generale, donc pour l'instant le palier Flash est la ou vit vraiment la capacite fraiche et largement disponible de Google. Si vous attendiez Pro, 3.6 Flash est le modele que vous pouvez faire tourner cette semaine. Ensuite, Google a dit avoir lance son plus ambitieux entrainement prealable a ce jour, pour Gemini 4, un signal que ce rafraichissement Flash est une etape, pas le dernier mot de l'ete.

Pour une equipe qui travaille, la marche a suivre est simple. Si vous routez deja des agents ou des taches de code par le palier Flash, testez 3.6 Flash sur vos vraies charges, surveillez le nombre de tokens d'aussi pres que le taux de reussite, et laissez les chiffres de votre propre trafic decider. Le modele prend en charge un effort de raisonnement configurable et l'usage d'outils en parallele, vous pouvez donc pousser la reflexion pour les problemes difficiles et la garder rapide et bon marche partout ailleurs.

Sources et pour aller plus loin

Questions fréquentes

De combien Gemini 3.6 Flash est il moins cher ?

De deux manieres. Le prix de sortie affiche est passe de neuf dollars a sept dollars cinquante par million de tokens, l'entree restant a un dollar cinquante par million. En plus, Google indique que le modele depense environ dix sept pour cent de tokens de sortie en moins que 3.5 Flash sur l'indice Artificial Analysis, et jusqu'a soixante cinq pour cent en moins sur le benchmark de code DeepSWE. L'economie de tokens se cumule avec le prix unitaire plus bas, donc de vraies charges agentiques peuvent tomber bien en dessous de ce qu'une simple comparaison de prix suggere. Mesurez votre propre trafic avant de supposer un pourcentage fixe.

Gemini 3.6 Flash est il disponible dans GitHub Copilot ?

Oui. Gemini 3.6 Flash est disponible de facon generale et se deploie dans GitHub Copilot pour les offres Pro, Pro Plus, Max, Business et Enterprise. Le deploiement est progressif, il peut donc ne pas apparaitre tout de suite dans votre selecteur de modeles. Sur Copilot Business et Copilot Enterprise, un administrateur doit activer la politique Gemini 3.6 Flash dans les parametres Copilot avant que quiconque dans l'organisation puisse le selectionner.

Comment se compare t il a Gemini 3.5 Flash sur les benchmarks ?

Google rapporte des gains sur le code et les tests agentiques. Sur DeepSWE il obtient quarante neuf pour cent contre trente sept pour 3.5 Flash, sur MLE Bench soixante trois virgule neuf contre quarante neuf virgule sept, et sur OSWorld Verified, qui mesure l'usage de l'ordinateur, quatre vingt trois contre soixante dix huit virgule quatre. Son score GDPval sur l'indice Artificial Analysis version deux est de mille quatre cent vingt et un contre mille trois cent quarante neuf. Google le presente comme un modele de travail plutot qu'un modele de pointe phare.

Qu'a lance Google avec lui ?

Gemini 3.6 Flash est arrive avec Gemini 3.5 Flash Lite, le modele le plus econome de la classe, dans la meme mise a jour du palier Flash. Google a aussi annonce avoir demarre son plus ambitieux entrainement prealable a ce jour, pour Gemini 4. Par ailleurs, le modele phare Gemini 3.5 Pro reste en test limite chez des partenaires plutot qu'en sortie generale, donc le palier Flash est la ou se trouve aujourd'hui la capacite fraiche et largement disponible.

Ou puis je utiliser Gemini 3.6 Flash aujourd'hui ?

Via l'API Gemini dans Google AI Studio et Android Studio, dans la Gemini Enterprise Agent Platform, dans Google Antigravity et dans l'application Gemini, en plus du deploiement GitHub Copilot. Le modele prend en charge un effort de raisonnement configurable et l'usage d'outils en parallele, vous pouvez donc pousser la reflexion pour les taches difficiles et la garder basse pour des appels rapides et bon marche.

Advertisement