Présentation de GPT-5.6 Sol : un modèle de nouvelle génération

Cette semaine apporte son nouveau chapitre dans le grand livre de l’IA.

Présentation de GPT-5.6 Sol : un modèle de nouvelle génération

Nous lançons une préversion limitée de la série GPT-5.6 : Sol, notre modèle phare ; Terra, un modèle équilibré destiné à une utilisation quotidienne ; et Luna, un modèle rapide et abordable. Terra offre des performances comparables à celles du GPT-5.5 tout en étant deux fois moins cher, tandis que Luna propose des capacités solides au meilleur prix.

À relever, gPT-5.6 Sol est lancé avec notre ensemble de mesures de sécurité le plus robuste à ce jour. Nous avons renforcé les protections contre les activités à haut risque, les requêtes sensibles en matière de cybersécurité et les utilisations abusives répétées. Nous avons également consacré plusieurs semaines à identifier les failles, à soumettre notre système à des tests de résistance et à le renforcer contre les attaques réelles.

De plus, nous croyons en un accès élargi et prévoyons de rendre GPT-5.6 Sol, Terra et Luna accessibles au grand public dans les semaines à venir. Dans le cadre de notre collaboration continue avec le gouvernement américain, nous avons présenté un aperçu de nos projets et des compétences de ces modèles avant le lancement d’aujourd’hui. À leur demande, nous lançons dans un premier temps une préversion limitée destinée à un petit groupe de partenaires de confiance, dont la participation a été communiquée au gouvernement, avant de procéder à un déploiement à plus grande échelle. Au cours de cette phase de préversion, nous poursuivrons les tests et travaillerons en étroite collaboration avec nos partenaires afin de préparer une mise à disposition plus large. Nous ne pensons pas que ce type de procédure d’accès gouvernemental doive devenir la norme à long terme. Elle prive en effet les utilisateurs, les développeurs, les entreprises, les cyberdéfenseurs et nos partenaires internationaux qui en ont besoin des meilleurs outils. Nous prenons cette mesure à court terme car nous estimons qu’il s’agit du moyen le plus performante d’assurer une disponibilité plus large dans les semaines à venir, tandis que nous travaillons avec l’administration pour élaborer le cadre du décret exécutif sur la cybersécurité et un processus reproductible pour les futures versions du modèle.

Il faut souligner, gPT-5.6 Sol est notre modèle le plus performant à ce jour. Pour vous donner un aperçu de ses performances, nous vous présentons une série d’évaluations mettant en évidence ses compétences améliorées en matière de programmation, de biologie et de cybersécurité. D’autres évaluations relatives à la sécurité et à la préparation sont disponibles dans la fiche descriptive de notre mécanisme⁠(s’ouvre dans une nouvelle fenêtre). Nous publierons une série plus complète de résultats d’évaluation lorsque nous mettrons ce modèle à la disposition du grand public.

Avec GPT-5.6, nous lançons une récente fonctionnalité « maxreasoning » afin de donner à Sol un maximum de temps pour mener une réflexion approfondie. De plus, nous introduisons un nouveau « ultramode » qui dépasse les capacités d’un seul agent en s’appuyant sur des sous-agents pour accélérer les tâches complexes.

En matière de workflows de programmation, GPT-5.6 Sol établit une nouvelle référence sur Terminal-Bench 2.1, qui évalue les workflows en ligne de commande nécessitant une planification, des itérations et la coordination d’outils.

GPT-5.6 Sol affiche en outre des améliorations significatives dans les flux de travail liés à la biologie. Sur OnGeneBench v1, qui évalue les analyses génomiques et de biologie quantitative à long terme, il obtient de meilleurs résultats que GPT-5.5 tout en utilisant moins de tokens.

Ce développement s’ajoute à une longue série d’évolutions dans le secteur.

Sur le même sujet :


Reportage initial : OpenAI : OpenAI