Ceci vise à se conformer aux nouvelles règles de transparence en matière d’IA de la région.
OpenAI vient d’annoncer ses plans pour se conformer à une partie des nouvelles règles de transparence de l’IA de l’Union européenne. L’entreprise commencera bientôt à ajouter un filigrane invisible au texte et au code générés dans l’UE. Cette démarche suit une initiative similaire d’Anthropic plus tôt cette année.
OpenAI utilise un système propriétaire appelé textGrain qui « ajoute un signal statistique invisible aux choix de mots du modèle. » Une fois ajouté, un détecteur peut repérer ces signaux et déterminer s’il y a un filigrane.
L’entreprise dit que le système « a égalé ou dépassé » les performances d’autres approches, comme SynthID pour le texte. Cependant, elle avertit que « des performances solides en conditions idéales ne garantissent pas une détection fiable en usage quotidien ».
C’est une tournure d’entreprise signifiant « cela peut ne pas fonctionner tout le temps. » Elle admet que les textes plus courts sont plus difficiles à détecter, avec un taux de réussite d’environ 80 pour cent. Il en va de même pour « des contenus tels que les mathématiques. » Même modifier le texte semble faire baisser le taux de réussite. OpenAI prévoit toutefois de rendre la technologie disponible en open source afin que d’autres puissent la modifier.
Le filigrane ne sera pas activé par défaut, sauf pour les sorties de texte éligibles de ChatGPT et Codex dans l’Union européenne. Les clients pourront opter pour « des modèles sélectionnés », bien qu’il n’ait pas précisé quels modèles seraient accessibles au grand public mondial.
OpenAI est un peu plus prudent lorsqu’il s’agit du logiciel de détection. L’accès sera initialement limité à « des chercheurs approuvés et des organisations d’experts. » De plus, le détecteur n’identifie pas l’utilisateur ni ne révèle les invites ou les conversations.
L’article 50 de la loi UE sur l’IA impose que les fournisseurs de systèmes d’IA générative rendent les sorties textuelles identifiables de manière lisible par machine. Cela concerne déjà les nouvelles entreprises entrant sur le marché, mais les entités existantes disposent jusqu’au 2 décembre pour se conformer. Cela inclut des organisations comme OpenAI et Anthropic, bien sûr, mais aussi Microsoft, Google et Meta, parmi d’autres.