Une évolution notable vient d’être rendue publique dans le domaine.
OpenAI va commencer à apposer un filigrane sur les textes générés par ChatGPT dans l’UE | TechCrunch
OpenAI va commencer à ajouter un filigrane invisible au texte généré par ChatGPT et Codex au sein de l’Union européenne afin de se conformer à la loi européenne sur l’IA, a dévoilé lundi l’entreprise dans un article de blog.
Notons par ailleurs, les règles de transparence prévues par la loi européenne sur l’IA, entrées en vigueur le 2 août, imposent aux firmes du segment de l’IA de signaler les contenus générés par l’IA de manière à ce que d’autres systèmes puissent les identifier.
Notons par ailleurs, openAI a indiqué que le filigrane serait déployé au cours des prochaines semaines auprès des usagers éligibles de ChatGPT et Codex, tous forfaits confondus, cependant uniquement au sein de l’Union européenne. Les programmeurs utilisant l’API d’OpenAI partout dans le monde peuvent l’activer dès aujourd’hui pour certains modèles ; cette fonctionnalité est désactivée par défaut. OpenAI a précisé qu’il ne rendrait pas le tatouage numérique du texte obligatoire à l’échelle mondiale dès le lancement.
Point notable, le filigrane n’est pas un symbole à proprement parler, mais il agit en influençant subtilement le choix des mots du modèle, laissant ainsi une empreinte invisible pour les lecteurs, mais détectable par un détecteur. Comme il est intégré aux mots eux-mêmes, il est transféré avec le texte lorsqu’il est copié-collé. OpenAI a déclaré que le filigrane n’identifiait pas l’utilisateur et qu’il n’avait constaté aucun changement significatif dans les performances de ses modèles lorsqu’il était activé.
Parallèlement à cette annonce, OpenAI a en outre publié un rapport technique sur sa méthode, baptisée « textGrain ». Rédigé en collaboration avec des chercheurs de l’université de Pennsylvanie et de Yale, ce rapport présente un exemple d’utilisation d’une clé secrète pour trier les prédictions du mot suivant afin de compléter la phrase. En cumulant des centaines de ces indices, le détecteur est capable d’identifier un contenu généré par l’IA en se basant uniquement sur le texte et la clé.
D’un autre côté, le filigrane peut-il être supprimé par modification du texte ? Les tests menés par OpenAI semblent indiquer que oui. Lors d’un test, le fait de remplacer 10 % des mots par des synonymes a fait passer le taux de détection d’environ 92 % à 66 %. L’entreprise a en outre indiqué que les courts passages, les réponses mathématiques et les textes traduits sont plus difficiles à détecter.
Difficile à ce stade de prédire tous les impacts de cette annonce.
Pour aller plus loin :
Source : TechCrunch AI : TechCrunch AI