Le filigrane de ChatGPT n'a rien d'un logo dans le coin d'une image. OpenAI l'appelle textGrain : une clé secrète influence les mots que choisit ChatGPT pendant qu'il écrit, et des centaines de ces décisions finissent par former un motif statistique qu'un détecteur peut lire. Il n'y a ni caractères cachés ni espaces étranges à supprimer. La marque vit dans les mots eux-mêmes, et elle voyage donc avec le texte lors du copier-coller. OpenAI la déploie sur ChatGPT et Codex pour toutes les formules dans l'UE, et n'importe quel client de l'API, où qu'il soit, peut l'activer.
OpenAI a aussi publié où le signal se brise. Dans ses propres tests, remplacer 10 % des mots par des synonymes a fait passer la détection d'environ 92 % à 66 %, et les passages courts, les réponses mathématiques, les textes traduits et les éditions lourdes l'affaiblissent encore davantage. Autrement dit, un simple passage de synonymes laisse la marque détectable la plupart du temps. Notre Watermark Remover ne se contente pas de remplacer des mots. Il réécrit la structure des phrases comme le ferait une vraie édition, soit exactement le type de changement auquel textGrain n'est pas conçu pour survivre.