Entreprises et secteurs d’activité

OpenAI ajoute un filigrane invisible aux textes de ChatGPT dans l'UE

Pour se conformer au règlement européen sur l'IA, OpenAI ajoute un filigrane invisible aux textes de ChatGPT et de Codex dans l'Union européenne. La technologie textGrain reste imparfaite et échoue sur les textes courts ou retouchés.

Julien MartinJulien Martin
Popularité : 1,150
OpenAI ajoute un filigrane invisible aux textes de ChatGPT dans l'UE

Pour se conformer au règlement européen sur l'IA, OpenAI ajoute un filigrane invisible aux textes de ChatGPT et de Codex dans l'Union européenne. La technologie, baptisée textGrain, reste imparfaite et ne fonctionnera pas partout.

Ce qu'OpenAI met en place pour le règlement européen sur l'IA

OpenAI a détaillé le 5 octobre sa réponse aux exigences de traçabilité de l'Union européenne. Le règlement européen sur l'IA demande aux fournisseurs de modèles génératifs de rendre les textes produits identifiables par une machine. La firme américaine annonce trois mesures, déployées à des rythmes différents.

Depuis le 5 octobre, les clients de l'API dans le monde entier peuvent activer un filigrane sur les textes, modèle par modèle. L'option reste désactivée par défaut : personne ne se la voit imposer sans le demander. Dans les prochaines semaines, OpenAI ajoutera un filigrane invisible aux textes produits par ChatGPT et Codex dans l'Union européenne, cette fois sans démarche de la part des utilisateurs. L'entreprise ouvre enfin les candidatures pour accéder à son détecteur de filigranes, réservé au départ à des chercheurs et à des organismes experts validés.

Le point à retenir pour un utilisateur européen de ChatGPT : à partir des prochaines semaines, ses réponses textuelles porteront une marque invisible, sans que cela change ce qu'il voit à l'écran. Rien ne change pour lui.

Comment textGrain marque discrètement le texte

Le filigrane d'OpenAI s'appelle textGrain. Son principe : le modèle ne choisit plus ses mots uniquement selon leur pertinence dans le contexte. Un signal statistique invisible vient orienter légèrement cette sélection, et le détecteur d'OpenAI cherche ensuite ce signal pour estimer si un passage porte le filigrane. Voilà pour le principe.

Rien ne garantit une détection fiable au quotidien, et l'entreprise le dit elle-même. « Un bon résultat en conditions idéales ne garantit pas une détection fiable dans un usage courant », écrit OpenAI dans son annonce. Un détecteur peut se tromper de deux façons. Soit il signale un filigrane absent, un faux positif. Soit il manque un filigrane présent, un faux négatif.

Les chiffres publiés donnent la mesure du problème. Pour un taux de faux positifs visé de 1 %, le détecteur repère le filigrane dans environ 80 % des passages de 200 jetons, contre environ 95 % pour des passages de 400 jetons. Les résultats chutent nettement sur des contenus comme les mathématiques, où le choix des mots est plus contraint. Nette différence.

Pourquoi le filigrane d'OpenAI se casse facilement

Modifier légèrement le texte suffit à brouiller les pistes. Sur des passages de 400 jetons, remplacer 10 % des mots par des synonymes fait tomber la détection d'environ 92 % à 66 %. En remplaçant un quart des mots, elle descend à 17 %. Un texte retouché à la main a donc de bonnes chances d'échapper au détecteur.

Ces limites expliquent la prudence d'OpenAI. Donner un détecteur parfaitement fiable entre toutes les mains reviendrait à produire des accusations à tort, par exemple contre un étudiant ou un rédacteur qui n'a rien généré avec une IA. C'est précisément pour cela que l'accès reste, dans un premier temps, limité à des chercheurs et à des organismes capables d'évaluer la fiabilité et les usages responsables de la technologie.

Reste un détail technique qui compte pour la suite : l'entreprise prévoit de publier textGrain en open source, afin que d'autres puissent construire dessus. Une ouverture qui, à terme, pourrait accélérer la mise au point de détecteurs comme de contournements.

Ce que cela change pour les utilisateurs et les développeurs

Pour un utilisateur européen de ChatGPT, la différence sera invisible. Le filigrane ne modifie pas le sens du texte et reste imperceptible à la lecture. À quoi sert-il alors ? À permettre à un outil habilité de dire si un passage a probablement été produit par un modèle d'OpenAI.

Pour les développeurs qui passent par l'API, la logique est différente, car l'activation reste volontaire. Une entreprise qui veut tracer ses propres contenus peut cocher l'option ; celles qui préfèrent garder des sorties sans marque ne sont pas concernées. Ce choix par défaut laisse entendre qu'OpenAI ne considère pas encore la technologie comme prête à être imposée à tous ses clients. Le message est clair.

Le troisième volet, l'ouverture du détecteur, mérite aussi l'attention. Le fait qu'OpenAI encadre l'accès plutôt que de le rendre public montre à quel point la détection de texte généré reste une affaire délicate, où une erreur peut coûter cher à quelqu'un.

Ce qu'il faut retenir sur la traçabilité des textes IA

Le filigrane ne rendra pas les textes générés par l'IA infalsifiables. Il ajoute un signal de provenance, rien de plus, et un signal qui s'affaiblit dès qu'on retouche le texte ou qu'on réduit sa longueur. Le présenter comme une garantie serait une erreur de lecture. La nuance compte.

Ce qu'OpenAI livre, c'est une réponse graduée à une obligation européenne, avec ses angles morts assumés. Les utilisateurs de ChatGPT dans l'UE n'ont rien à faire de leur côté. Les développeurs qui activent le filigrane sur l'API savent désormais ce qu'ils obtiennent : une aide à la traçabilité, pas une preuve absolue. Pour suivre le dossier, le point à observer sera la publication en open source de textGrain et les premiers retours des chercheurs admis à tester le détecteur.

Partager cet article

Sources

Actualités liées à l’IA

ChatGPT teste des publicités visuelles dans sa génération d'images
Produit

ChatGPT teste des publicités visuelles dans sa génération d'images

OpenAI teste un nouveau format publicitaire visuel directement dans la génération d'images de ChatGPT. Les annonces resteront séparées de l'image produite, identifiées, et n'influenceront pas les réponses.

Popularité : 1,100
OpenAI licencie trois chercheurs en sûreté pour partage de données
Entreprises et secteurs d’activité

OpenAI licencie trois chercheurs en sûreté pour partage de données

OpenAI a confirmé avoir licencié trois chercheurs en sûreté pour leur gestion d'informations sensibles. Des médias relient la décision à des données partagées avec des organisations externes de sûreté de l'IA, au moment où l'entreprise était déjà sous pression.

Popularité : 1,150
Interface de messagerie sur téléphone avec plusieurs icônes d'agents ponctuels et des cartes d'agenda et de livraison
Produit

OpenAI Dots : les agents IA de ChatGPT qui agissent seuls

OpenAI lance Dots, des agents IA toujours actifs qui reçoivent des messages dans ChatGPT, Slack et Microsoft Teams, et qui peuvent prendre des initiatives avant qu'on leur demande quoi que ce soit. Leur promesse : anticiper un besoin, pas seulement répondre à une question.

Popularité : 1,200
Couloir de bureaux se terminant sur une porte éclairée, avec un symbole abstrait d'alerte de sécurité
Entreprises et secteurs d’activité

OpenAI : un responsable sécurité démissionne et dénonce une culture « brisée »

David Robinson, qui pilotait la rédaction des rapports de sécurité d'OpenAI depuis trois ans et demi, a annoncé son départ dans une tribune publiée par The Atlantic. Il y décrit une culture interne « brisée » et plaide pour que les laboratoires de pointe s'inspirent du nucléaire et de l'aviation.

Popularité : 1,350