IA

ChatGPT tatoue ses textes en Europe, avec l’outil qu’OpenAI avait mis au placard en 2024

Adrian Kessler
Ajoutez-nous sur Google

OpenAI a longtemps expliqué publiquement pourquoi l’entreprise ne voulait pas apposer de filigrane sur les textes de ChatGPT. Elle s’apprête pourtant à le faire. Ce n’est pas la technologie qui l’a fait changer d’avis, mais une loi assortie d’une échéance et d’une amende.

L’entreprise annonce que les textes générés par ChatGPT et Codex pour les utilisateurs de l’Union européenne porteront une signature statistique invisible, déployée progressivement au cours des prochaines semaines et sur toutes les offres. Ailleurs, le même marquage n’est disponible que sous la forme d’une option dans l’API destinée aux développeurs, désactivée par défaut. La frontière tracée par OpenAI suit celle de la juridiction qui peut lui infliger une sanction.

Comment fonctionne le filigrane de ChatGPT

La méthode, baptisée textGrain, n’ajoute aucun élément visible au texte produit. Lorsque plusieurs mots suivants conviendraient presque aussi bien à une phrase, une clé secrète oriente le choix vers l’un d’eux. Une telle inflexion ne signifie rien à elle seule. Mais, répétée des centaines de fois dans un texte, elle forme un motif qu’un détecteur disposant de la clé peut rechercher. Comme le signal est intégré aux mots eux-mêmes, il résiste au copier-coller. OpenAI a rédigé le rapport technique avec des chercheurs de l’University of Pennsylvania et de Yale. Selon ses résultats, le procédé n’a pas d’effet notable sur la qualité : sur l’Artificial Analysis Intelligence Index, les textes filigranés obtiennent un score de 49,76, contre 49,57 sans marquage.

L’outil dont OpenAI disposait déjà

Rien de tout cela n’est nouveau chez OpenAI. À l’été 2024, le Wall Street Journal révélait que l’entreprise avait mis au point un filigrane textuel fonctionnel, jugé efficace à 99,9 % dans des documents internes, mais qu’elle le gardait de côté. OpenAI avait répondu qu’elle adoptait « une approche délibérée ». Les raisons avancées étaient d’ordre technique et social : la méthode était « facile à contourner par des acteurs malveillants », qui pouvaient recourir à la traduction ou à une reformulation par un autre modèle, et elle risquait de stigmatiser l’IA comme outil d’aide à l’écriture pour les personnes dont l’anglais n’est pas la langue maternelle. Dans son article consacré à l’annonce de cette semaine, TechCrunch rappelle une troisième raison évoquée à l’époque : la crainte que les utilisateurs ne se tournent vers des concurrents qui n’apposeraient pas de filigrane.

À la lumière de ces éléments, le nouveau déploiement montre lesquelles de ces inquiétudes OpenAI a réellement dissipées. D’après les chiffres de l’entreprise, le problème du contournement reste entier. Quant au risque commercial, il a été circonscrit à un seul marché.

Les chiffres d’OpenAI, pas ceux de ses détracteurs

Dans de bonnes conditions, avec un taux de faux positifs de 1 %, le détecteur repère environ 80 % des textes filigranés de 200 tokens, et près de 95 % de ceux qui en comptent 400. Si 10 % des mots sont remplacés par des synonymes, le taux de détection passe de 92 % à 66 %. Avec un quart des mots remplacés, il tombe à 17 %. Les réponses courtes, les mathématiques et les textes traduits sont particulièrement difficiles à détecter. OpenAI avertit elle-même que de bonnes performances dans des conditions idéales « ne garantissent pas une détection fiable dans les usages quotidiens » et que l’absence de filigrane ne prouve pas qu’un texte a été écrit par un humain. L’entreprise précise également que le marquage ne permet pas d’identifier l’utilisateur.

textGrain constitue donc un signal exploitable contre un simple copier-coller paresseux, mais peu fiable face à quiconque accepte de consacrer une minute à retoucher le texte. Dans un ensemble de pays où l’on lit et écrit dans de nombreuses langues, les limites liées à la traduction ne sont pas un détail.

Pourquoi l’UE, et pourquoi maintenant

Le moteur juridique de cette décision est l’article 50 de l’AI Act, dont les règles de transparence sont entrées en vigueur le 2 août. Il impose aux fournisseurs de systèmes génératifs de marquer les textes, sons, images et vidéos synthétiques de manière lisible par machine, et de proposer un mécanisme de détection. Les systèmes déjà commercialisés avant cette date, dont ChatGPT, ont jusqu’au 2 décembre pour se mettre en conformité. Selon une analyse du cabinet d’avocats Cooley, les infractions peuvent entraîner une amende allant jusqu’à 15 millions d’euros ou 3 % du chiffre d’affaires annuel mondial, le montant le plus élevé étant retenu.

Deux détails montrent à quel point le déploiement répond à cette obligation plutôt qu’à un principe. Le premier concerne le détecteur. La loi exige un mécanisme de détection ; OpenAI en a conçu un, mais ne l’a confié qu’à des chercheurs agréés et à des organisations spécialisées, qui doivent en faire la demande. L’entreprise indique qu’elle élargira l’accès « lorsqu’elle estimera que les résultats pourront être interprétés de manière responsable », rapporte The Decoder, sans donner de calendrier. Aujourd’hui, un enseignant ou un éditeur à Lisbonne ou à Varsovie ne peut pas vérifier un texte suspect.

Le second détail, c’est la carte. Anthropic, qui a commencé à filigraner les textes de Claude en août, applique ce marquage partout dans le monde, quel que soit le moyen utilisé pour accéder à ses modèles, et a essuyé des critiques de la part de certains utilisateurs. OpenAI a choisi la voie opposée : activation par défaut là où un régulateur peut infliger une amende, activation facultative pour les développeurs ailleurs, et aucune activation par défaut à l’échelle mondiale au lancement. Si la crainte ancienne de voir les utilisateurs partir chez des concurrents sans filigrane avait disparu, il y aurait peu de raisons de tracer la carte de cette façon.

Et maintenant ?

OpenAI annonce que textGrain sera publié en open source et qu’il égale ou surpasse des approches comme SynthID de Google. Ces deux affirmations pourront être vérifiées dès que le code sera public. Pour Bruxelles, la question est plus circonscrite : un marquage qui s’efface après de légères retouches et qu’un détecteur presque personne ne peut utiliser répond-il à une règle conçue pour permettre à d’autres systèmes de reconnaître les textes produits par l’IA ?

Après le 2 décembre, les seuls utilisateurs de ChatGPT dont les textes porteront par défaut la signature d’OpenAI seront ceux dont le régulateur peut lui envoyer la facture.

Étiquettes: , , , ,

Ajoutez-nous sur Google

Discussion

Il y a 0 commentaire.