Le secteur technologique continue de livrer des avancées remarquables.
GPT-5.6 : une intelligence de pointe qui s’adapte à vos ambitions
Plus d’intelligence par jeton, un meilleur rapport performance/prix et davantage de capacités à la demande pour vos tâches les plus exigeantes.
Après une phase de préversion limitée, nous lançons la gamme de modèles GPT-5.6 pour une disponibilité générale : notre tout nouveau modèle phare, Sol, aux côtés de Terra, un modèle équilibré destiné aux tâches quotidiennes, et de Luna, notre modèle le plus économique.
GPT-5.6 Sol établit une nouvelle référence en matière d’intelligence et d’efficacité, en obtenant des résultats de pointe dans les domaines du codage, du travail intellectuel, de la cybersécurité et des sciences, tout en surpassant les modèles de pointe précédents et concurrents avec moins de tokens et à un coût estimé inférieur. Il en résulte un meilleur rapport performance/prix : davantage de résultats positifs pour un budget identique, ou des résultats comparables à un coût total inférieur. Nous proposons également une nouvelle méthode pour accélérer les tâches les plus exigeantes : « ultra » est notre paramètre le plus performant, qui coordonne de multiples agents au sein de flux de travail parallèles afin d’accomplir plus rapidement des tâches complexes. Grâce à une utilisation plus poussée des ressources informatiques et à un meilleur jugement en matière de conception, GPT-5.6 Sol est notre collaborateur le plus abouti à ce jour, capable d’analyser, d’affiner et de fournir des résultats prêts à l’emploi.
Par ailleurs, nous avons entraîné GPT-5.6 afin de tirer le meilleur parti de chaque token. Lors du « Last Exam » d’OnAgents (s’ouvre dans une nouvelle fenêtre), une évaluation des flux de travail professionnels de longue durée dans 55 domaines, GPT-5.6 Sol établit un nouveau record de 53,6, devançant Claude Fable 5 (raisonnement adaptatif) de 13,1 points. Même avec un niveau de raisonnement moyen, il devance Fable 5 de 11,4 points, pour un coût estimé à environ un quart de celui de ce dernier. Cette efficacité s’étend aux modèles de plus petite taille, qui sont essentiels pour rendre l’intelligence artificielle plus répandue et plus abordable : les modèles GPT-5.6 Terra et GPT-5.6 Luna surpassent Fable 5 pour un coût environ seize fois inférieur. Selon l’indice d’analyse de l’intelligence artificielle (s’ouvre dans une nouvelle fenêtre), un indicateur global de l’intelligence couvrant le travail agentique, le codage, le raisonnement scientifique et les capacités techniques générales, le modèle GPT-5.6 Sol avec un raisonnement maximal se situe à moins d’un point de Fable 5, tout en accomplissant les tâches en 61 % de temps en moins et à environ la moitié du coût estimé.
De plus, « Agents’ Last Exam » (s’ouvre dans une nouvelle fenêtre) : flux de travail agentiques à long terme dans différents domaines professionnels.
Dans la foulée, gPT-5.6 est lancé avec nos mécanismes de protection les plus solides à ce jour, conçus pour résister à des utilisations abusives ciblées et adaptatives sans pour autant restreindre de manière générale les activités légitimes. Avant sa mise à disposition générale, nous avons soumis les modèles et ces mécanismes de protection à notre période d’évaluation la plus approfondie à ce jour, combinant des tests de simulation d’attaques menés par des experts (red teaming) à des tests automatisés à grande échelle. Au cours de la phase de pré-sortie, nous avons travaillé en étroite collaboration avec des organismes spécialisés et des partenaires de confiance afin de tester les mécanismes de défense sous pression et de renforcer les mesures de sécurité avant le lancement à grande échelle. Le système de ce fait mis au point associe les protections intégrées au modèle à des contrôles en temps réel, à une surveillance et à des droits d’accès adaptés au niveau de confiance et au niveau de risque.
Le contexte technologique évolue, et ce type d’annonce en témoigne.
Dans le même ordre d’idées :
Information publiée en premier lieu par OpenAI : OpenAI