Pour se conformer au règlement européen sur l'IA, OpenAI ajoute un filigrane invisible aux textes de ChatGPT et de Codex dans l'Union européenne. La technologie, baptisée textGrain, reste imparfaite et ne fonctionnera pas partout.
Ce qu'OpenAI met en place pour le règlement européen sur l'IA
OpenAI a détaillé le 5 octobre sa réponse aux exigences de traçabilité de l'Union européenne. Le règlement européen sur l'IA demande aux fournisseurs de modèles génératifs de rendre les textes produits identifiables par une machine. La firme américaine annonce trois mesures, déployées à des rythmes différents.
Depuis le 5 octobre, les clients de l'API dans le monde entier peuvent activer un filigrane sur les textes, modèle par modèle. L'option reste désactivée par défaut : personne ne se la voit imposer sans le demander. Dans les prochaines semaines, OpenAI ajoutera un filigrane invisible aux textes produits par ChatGPT et Codex dans l'Union européenne, cette fois sans démarche de la part des utilisateurs. L'entreprise ouvre enfin les candidatures pour accéder à son détecteur de filigranes, réservé au départ à des chercheurs et à des organismes experts validés.
Le point à retenir pour un utilisateur européen de ChatGPT : à partir des prochaines semaines, ses réponses textuelles porteront une marque invisible, sans que cela change ce qu'il voit à l'écran. Rien ne change pour lui.
Comment textGrain marque discrètement le texte
Le filigrane d'OpenAI s'appelle textGrain. Son principe : le modèle ne choisit plus ses mots uniquement selon leur pertinence dans le contexte. Un signal statistique invisible vient orienter légèrement cette sélection, et le détecteur d'OpenAI cherche ensuite ce signal pour estimer si un passage porte le filigrane. Voilà pour le principe.
Rien ne garantit une détection fiable au quotidien, et l'entreprise le dit elle-même. « Un bon résultat en conditions idéales ne garantit pas une détection fiable dans un usage courant », écrit OpenAI dans son annonce. Un détecteur peut se tromper de deux façons. Soit il signale un filigrane absent, un faux positif. Soit il manque un filigrane présent, un faux négatif.
Les chiffres publiés donnent la mesure du problème. Pour un taux de faux positifs visé de 1 %, le détecteur repère le filigrane dans environ 80 % des passages de 200 jetons, contre environ 95 % pour des passages de 400 jetons. Les résultats chutent nettement sur des contenus comme les mathématiques, où le choix des mots est plus contraint. Nette différence.
Pourquoi le filigrane d'OpenAI se casse facilement
Modifier légèrement le texte suffit à brouiller les pistes. Sur des passages de 400 jetons, remplacer 10 % des mots par des synonymes fait tomber la détection d'environ 92 % à 66 %. En remplaçant un quart des mots, elle descend à 17 %. Un texte retouché à la main a donc de bonnes chances d'échapper au détecteur.
Ces limites expliquent la prudence d'OpenAI. Donner un détecteur parfaitement fiable entre toutes les mains reviendrait à produire des accusations à tort, par exemple contre un étudiant ou un rédacteur qui n'a rien généré avec une IA. C'est précisément pour cela que l'accès reste, dans un premier temps, limité à des chercheurs et à des organismes capables d'évaluer la fiabilité et les usages responsables de la technologie.
Reste un détail technique qui compte pour la suite : l'entreprise prévoit de publier textGrain en open source, afin que d'autres puissent construire dessus. Une ouverture qui, à terme, pourrait accélérer la mise au point de détecteurs comme de contournements.
Ce que cela change pour les utilisateurs et les développeurs
Pour un utilisateur européen de ChatGPT, la différence sera invisible. Le filigrane ne modifie pas le sens du texte et reste imperceptible à la lecture. À quoi sert-il alors ? À permettre à un outil habilité de dire si un passage a probablement été produit par un modèle d'OpenAI.
Pour les développeurs qui passent par l'API, la logique est différente, car l'activation reste volontaire. Une entreprise qui veut tracer ses propres contenus peut cocher l'option ; celles qui préfèrent garder des sorties sans marque ne sont pas concernées. Ce choix par défaut laisse entendre qu'OpenAI ne considère pas encore la technologie comme prête à être imposée à tous ses clients. Le message est clair.
Le troisième volet, l'ouverture du détecteur, mérite aussi l'attention. Le fait qu'OpenAI encadre l'accès plutôt que de le rendre public montre à quel point la détection de texte généré reste une affaire délicate, où une erreur peut coûter cher à quelqu'un.
Ce qu'il faut retenir sur la traçabilité des textes IA
Le filigrane ne rendra pas les textes générés par l'IA infalsifiables. Il ajoute un signal de provenance, rien de plus, et un signal qui s'affaiblit dès qu'on retouche le texte ou qu'on réduit sa longueur. Le présenter comme une garantie serait une erreur de lecture. La nuance compte.
Ce qu'OpenAI livre, c'est une réponse graduée à une obligation européenne, avec ses angles morts assumés. Les utilisateurs de ChatGPT dans l'UE n'ont rien à faire de leur côté. Les développeurs qui activent le filigrane sur l'API savent désormais ce qu'ils obtiennent : une aide à la traçabilité, pas une preuve absolue. Pour suivre le dossier, le point à observer sera la publication en open source de textGrain et les premiers retours des chercheurs admis à tester le détecteur.






