Aperçu du mode « Ultrafast » : GPT-5.6 Sol avec une vitesse jusqu’à 14 fois supérieure

Les dernières heures ont apporté leur lot d’informations dans l’écosystème IA.

Aperçu du mode « Ultrafast » : GPT-5.6 Sol avec une vitesse jusqu’à 14 fois supérieure

Une dernière dimension en matière d’intelligence de pointe, qui transforme la rapidité en avantage concurrentiel.

Aujourd’hui, nous vous présentons en avant-première « Ultrafast », un nouveau niveau de service qui exécute GPT-5.6 Sol jusqu’à 14 fois plus promptement que le traitement « Standard », et qui sera d’abord lancé via l’API OpenAI. Grâce à la technologie Cerebras, Ultrafast génère jusqu’à 750 tokens de sortie par seconde, permettant de cette manière d’intégrer notre système le plus intelligent dans des produits et des flux de travail où chaque seconde compte.

Ces améliorations ont rendu l’intelligence avancée plus abordable et plus utile pour un plus grand nombre de personnes.

Avec GPT-5.6, nous repoussons les limites des capacités de nos modèles et les rendons plus efficaces à tous les niveaux de notre infrastructure. Ces améliorations ont rendu l’intelligence avancée plus abordable et plus utile pour un plus grand nombre de personnes. Jusqu’à présent, pour bénéficier d’une vitesse en temps réel, il fallait généralement opter pour un modèle plus petit ou plus spécialisé. « Ultrafast » marque une avancée dans une nouvelle direction : davantage de travail utile par seconde.

À noter également, lorsque la rapidité ne s’accompagnera plus d’un sacrifice de l’intelligence, l’IA pourra s’imposer dans les domaines les plus urgents d’une entreprise, ouvrant par conséquent la voie à de nouveaux types de travail. Nous avons déjà observé des scénarios encourageants pour la technologie « Ultrafast » :

Notons par ailleurs, gPT-5.6 Sol Ultrafast et la version standard créent, côte à côte, un simulateur d’entrepôt en 3D fonctionnel à partir de la même consigne textuelle.

Nous avons testé GPT-5.6 Sol en mode « Ultrafast » auprès d’un premier groupe d’entreprises issues des secteurs du développement logiciel, du commerce, de la recherche financière, du support client et d’autres applications interactives. Le fait de commencer par des flux de travail professionnels nous rend possible d’étudier ces conditions dans des environnements de production réels. Leurs premiers travaux nous aident à comprendre dans quels cas un gain de vitesse d’un ordre de grandeur génère le plus de valeur, et comment les produits évoluent lorsque le modèle parvient à s’adapter au rythme de l’utilisateur. Nous nous appuierons sur ces conclusions pour orienter le déploiement à mesure que la capacité augmentera.

Au sein d’OpenAI, un groupe de développeurs a testé GPT-5.6 Sol en mode « Ultrafast » afin de déterminer quels flux de travail tirent parti de cette intelligence de pointe capable de fournir des réponses en temps réel.

Les acteurs concernés devront s’adapter à ce nouveau contexte.

Dans le même ordre d’idées :


D’après OpenAI : OpenAI