Google a lancé Gemini 3.7 Flash jeudi, un modèle de codage et d'agents à faible coût désormais généralement disponible.
OpenAI a présenté GPT-5.6 Sol Ultrafast, un niveau propulsé par Cerebras exécutant son modèle le plus performant jusqu'à 14 fois plus rapidement.
La course à la vitesse est passée de l'intelligence brute aux agents en temps réel, mais seul le modèle de Google est accessible à tous les développeurs aujourd'hui.
Google et OpenAI ont tous deux diffusé le même message aujourd'hui : l'IA est désormais assez rapide pour impressionner ceux qui utilisent des agents IA, chaque entreprise annonçant des modèles ultra rapides.
Les deux lancements sont construits différemment, et un seul est réellement entre vos mains aujourd'hui.
Google a lancé Gemini 3.7 Flash, son dernier modèle optimisé pour le codage logiciel et les flux de travail d'entreprise autonomes. OpenAI a ouvert un aperçu limité de GPT-5.6 Sol Ultrafast, un nouveau niveau de service qui exécute son modèle le plus performant à une vitesse allant jusqu'à 750 jetons de sortie par seconde.
Aujourd'hui, nous présentons Gemini 3.7 Flash, notre modèle de travail le plus intelligent à ce jour pour le codage et les agents.
Ce modèle apporte des gains substantiels dans le génie logiciel, le développement web et le travail de connaissance complexe.
Gemini 3.7 Flash est un modèle en disponibilité générale. Il accepte jusqu'à un million de jetons d'entrée (environ 750 000 mots) et en renvoie 64 000, traitant le texte, les images, les vidéos, l'audio et les PDF, et il peut appeler des outils et contrôler un ordinateur. Google le présente comme le cerveau économique des systèmes autonomes qui planifient des tâches et accomplissent des travaux en plusieurs étapes avec moins d'aide humaine.
Le modèle ne sacrifie pas la qualité pour la vitesse. Il est à la fois plus performant et plus efficace, capable de terminer notre tâche de test de codage en 2 minutes et 13 secondes, alors que le dernier modèle Flash a pris plus de 5 minutes. L'écart de qualité entre les deux est également notable.
L'Ultrafast d'OpenAI n'est pas un nouveau modèle. C'est GPT-5.6 Sol—le même modèle qu'OpenAI a utilisé avec une équipe rouge d'IA pour renforcer contre les attaques par injection de prompt avant le lancement—sur une voie plus rapide, propulsé par le fabricant de puces Cerebras. Il est environ 14 fois plus rapide que la vitesse standard de GPT-5.6 Sol.
Aperçu du mode Ultrafast : GPT-5.6 Sol jusqu'à 14 fois plus rapide.
Lancement d'abord dans l'API OpenAI à un groupe sélectionné de clients avec un accès élargi à plus d'entreprises à mesure que la capacité augmente. pic.twitter.com/a5dleofiDJ
Les puces à l'échelle de la tranche de Cerebras génèrent jusqu'à 750 tokens par seconde, environ 560 mots, assez rapidement pour qu'un agent vocal puisse réfléchir en plein appel.
Les chiffres qui comptent
La propre fiche de référence de Google place Gemini 3.7 Flash en tête de Claude Sonnet 5, GPT-5.6 Terra et d'autres dans 11 des 18 catégories testées, notamment un score de 1 588 Elo en tête du Code Arena pour le développement web et 30,4 % sur AutomationBench pour les flux de travail d'entreprise. Tout cela repose sur la méthodologie de Google, il faut donc considérer cette avance comme une affirmation de l'entreprise.
Comme tout Gemini Flash, le modèle est également bon marché. À 75 cents par million de jetons en entrée et 3,75 $ par million de jetons en sortie jusqu'à la fin de l'année, c'est la moitié du tarif initial de Gemini 3.6 Flash. Ce prix de lancement expire le 31 décembre, puis double pour atteindre 1,50 $ et 7,50 $, ce qui reste bon marché pour un modèle de Google.
OpenAI n'a pas publié de scores comparatifs pour Ultrafast au-delà des citations de clients. L'ingénieur IA de Jane Street, John Crepezzi, a déclaré dans l'annonce d'OpenAI que la vitesse de Cerebras « permet d'utiliser les modèles de différentes manières ». Le responsable produit de Podium, Courtland Lykins, l'a qualifiée d'« inestimable dans notre pile vocale », affirmant que la vitesse « change complètement l'expérience d'appel ». Le niveau est actuellement sur invitation uniquement.
Cette poussée de vitesse intervient alors que les laboratoires passent de « qui est le plus intelligent » à « qui est assez rapide pour les agents ». Le timing de Google est pointu. Son produit phare Gemini 3.5 Pro est toujours absent, sans date de sortie annoncée, trois semaines après 3.6 Flash et quelques jours après un remaniement de la direction de DeepMind qui a écarté Demis Hassabis au profit de son adjoint Koray Kavukcuoglu. OpenAI, quant à lui, loue la vitesse de Cerebras plutôt que d'attendre sa propre pile.
Gemini 3.7 Flash est disponible dès maintenant dans plus de 160 pays ; GPT-5.6 Sol Ultrafast est toujours sur invitation uniquement.