ToolNavs Outils IA à découvrir
Proposer Connexion
Retour à Informations sur l’IA
textGrain, le filigrane textuel arrive : OpenAI marque d'abord ChatGPT et Codex dans l'UE

textGrain, le filigrane textuel arrive : OpenAI marque d'abord ChatGPT et Codex dans l'UE

Informations sur l’IA • Admin • • 6 vues

textGrain est le filigrane invisible qu'OpenAI destine au texte. Le 5 octobre 2026, OpenAI a publié son approche des règles européennes de provenance des textes et annoncé que, dans les semaines à venir, les sorties texte éligibles de ChatGPT et de Codex dans l'Union européenne seraient marquées par textGrain, afin de satisfaire l'exigence de l'AI Act européen : un marquage lisible par machine pour les contenus générés. Les clients API du monde entier peuvent l'activer dès aujourd'hui pour certains modèles, peuvent aussi le laisser désactivé, et y accéderont dans les prochaines semaines via des partenaires cloud comme Microsoft Azure.

La marque se cache dans le choix des mots, pas dans les caractères

textGrain n'insère aucun caractère caché et n'ajoute aucune étiquette visible en fin de paragraphe. Pendant la génération, le modèle ajuste ses choix de mots de sorte qu'un signal statistique invisible se loge dans la façon dont les mots se combinent ; un détecteur associé lit ensuite le passage et juge s'il porte ce signal d'OpenAI. OpenAI précise explicitement ce que ce signal peut et ne peut pas établir : il n'identifie ni un auteur, ni une organisation, ni un compte, ni la conversation d'origine du texte, et détecter un filigrane ne signifie pas que le texte est exact, pas plus qu'il ne tranche les questions de propriété.

Les chiffres d'OpenAI : il faut de la longueur, et les retouches érodent tout

Dans les tests publiés par OpenAI, avec un taux de faux positifs cible de 1 %, le filigrane a été identifié dans environ 95 % des passages de psychologie d'environ 400 tokens ; à 200 tokens, la détection tombait à environ 80 %. Le sujet compte tout autant : les contenus mathématiques laissent au modèle bien moins de liberté dans le choix des mots, et la détection, à longueur égale, n'y atteignait qu'environ 60 %. Les retouches sont la variable la plus lourde — remplacer 10 % des mots d'un passage de 400 tokens par des synonymes fait chuter la détection d'environ 92 % à 66 %, et en remplacer un quart ne laisse que 17 %. OpenAI affirme que textGrain a égalé ou dépassé le filigrane textuel SynthID de Google lors de tests internes, et prévoit de publier la technologie en open source. Sur son modèle de pointe Astra, activer le filigrane n'a produit aucune différence de performance significative sur huit benchmarks, dont GPQA Diamond, BrowseComp et DeepSWE, sans affecter ni la vitesse de génération ni la lisibilité.

Le détecteur est pour l'instant réservé aux chercheurs approuvés

Le premier cercle autorisé à vérifier le filigrane se compose de chercheurs et d'organismes spécialisés approuvés, sur demande et après examen au cas par cas dans le cadre du code de bonnes pratiques européen pour l'IA à usage général. La raison avancée par OpenAI est simple : le détecteur peut signaler un texte dépourvu de filigrane et en manquer un qui en porte, donc tant que les résultats ne pourront pas être interprétés de façon responsable, il ne sera pas ouvert au public. L'outil lui-même ne répond qu'à une seule question — un filigrane OpenAI a-t-il été détecté — et ne révèle ni l'identité des utilisateurs, ni les prompts, ni le contenu des conversations.

Le contraste avec les concurrents est net. Anthropic applique à Claude un filigrane mondial et obligatoire, impossible à désactiver, tandis qu'OpenAI limite l'obligation à ses produits grand public européens et rend le filigrane API volontaire dans le monde entier. Sous la pression réglementaire, tout le monde marque désormais ses textes ; c'est sur qui peut vérifier, et sur la possibilité de désactiver, que les réponses divergent. Les règles californiennes SB 574 pour l'IA suivent la même logique : exiger d'abord la vérifiabilité, discuter ensuite des responsabilités. Pour les utilisateurs, l'attente réaliste est la suivante : les longs passages copiés depuis ChatGPT et Codex dans l'UE pourraient bientôt être détectés comme marqués par une IA — tandis qu'un texte court, traduit ou réécrit qui passe sous le seuil est tout aussi normal, car une non-détection n'a jamais prouvé qu'un humain avait écrit.

Outils Recommandés

Plus