Pourquoi tout ce que les IA écrivent porte une marque invisible

Si tu as demandé à un assistant d'IA de traduire un contrat, de résumer un rapport ou de te réécrire un courrier depuis le 2 août, le texte que tu as reçu porte une marque. Pas un tampon, pas une ligne en bas de page, pas un caractère planqué qu'on pourrait effacer avec un bon éditeur de texte : une marque invisible, tissée dans le choix des mots, et illisible pour toi.

Ce n'est pas une idée d'Anthropic ou d'OpenAI. C'est une obligation européenne entrée en application le 2 août 2026, et elle vise tout fournisseur d'IA qui vend en Europe, même sans le moindre bureau en Europe.

Je vais te raconter ce que la loi demande exactement, comment cette marque se fabrique, et surtout ce qu'elle prouve et ce qu'elle ne prouve pas, parce que c'est là que tout le monde se trompe, y compris des gens très sérieux.

La loi demande quatre choses, et deux te concernent

L'article 50 de l'AI Act, le règlement européen sur l'intelligence artificielle, pose quatre obligations. Un assistant qui discute doit te dire que tu parles à une machine, sauf si c'est évident. Un système qui reconnaît les émotions ou classe les gens doit prévenir ceux qu'il examine. Un contenu truqué, ces vidéos où l'on fait dire n'importe quoi à quelqu'un qui n'a rien dit, doit être signalé comme truqué. Et un système qui produit du texte, du son, de l'image ou de la vidéo doit y insérer une marque lisible par une machine.

Les deux dernières te tombent dessus, parce qu'elles ne visent plus seulement le fabricant mais aussi celui qui publie. Avec une exception qui sauve la mise, et elle est importante : si un humain relit vraiment et assume la publication, l'étiquette n'est plus obligatoire. Autrement dit, la loi ne demande pas de dire qu'une IA a participé, elle demande de dire quand personne n'a vérifié.

Pour les systèmes déjà en ligne avant le 2 août, il y a un délai : ils ont jusqu'au 2 décembre 2026 pour se mettre en règle, et rien n'est rétroactif. Les textes générés avant cette date n'ont pas à être étiquetés.

Frise des trois dates de l'article 50 de l'AI Act, du 2 août au 2 décembre 2026

Trois dates, et celle qui te concerne directement est au milieu : le 14 août, dix jours après l'entrée en application, Anthropic a publié son mécanisme au lieu de le garder pour lui

Les amendes, pour finir, montent à 15 millions d'euros ou 3 % du chiffre d'affaires mondial, et c'est le montant le plus élevé des deux qui s'applique. Voilà pourquoi un laboratoire américain s'est mis à marquer ses sorties le jour même, et dans le monde entier plutôt qu'en Europe seulement. Quand la facture se compte en pourcentage du chiffre d'affaires, on ne discute pas la portée géographique, on prend la version qui marche partout.

Comment on met une marque invisible dans une phrase

Tout le monde imagine un filigrane du genre un caractère invisible glissé entre deux mots, ou une ligne planquée dans les propriétés du fichier. Ce n'est pas ça du tout, et c'est capital pour la suite, parce que ça change complètement ce qu'on peut en faire.

La méthode qu'utilise Anthropic vient d'un travail publié par Google en 2024 dans la revue Nature, et elle porte un nom : SynthID-Text. Le principe tient en une idée simple. Quand un modèle écrit, il hésite en permanence entre plusieurs mots qui feraient l'affaire : important, crucial, capital, essentiel. Avec la marque, c'est une clé secrète qui tranche entre ces candidats, mot après mot, sans jamais lui imposer un mot qu'il n'aurait pas envisagé de lui-même.

Le vocabulaire n'est pas coupé en deux, le texte reste le même texte, mais la suite des petits choix porte une signature que seule la clé permet de reconnaître. Un seul mot ne prouve rien, il faut entre 500 et 1 000 mots pour qu'un détecteur qui possède la clé voie le motif se dessiner. Et Anthropic a tout expliqué le 14 août, soit deux semaines après avoir commencé à marquer sans le dire.

Ce que la marque prouve, et ce qu'elle ne prouve pas

Ici, la plupart des articles se trompent, alors je le dis lentement. La marque dit que le texte est passé par Claude. Elle ne dit pas qui l'a écrit.

Ta lettre de motivation, tu peux l'écrire toi-même à la main pendant trois soirées et demander à Claude de corriger les fautes : elle sortira marquée. La loi exempte justement la correction grammaticale et les fonctions d'édition classiques, mais Anthropic explique qu'il ne sait pas distinguer un texte entier qui traverse la machine d'une virgule, donc il marque dans tous les cas. C'est le choix le plus prudent pour lui et le moins utile pour toi.

Et il n'existe aucun détecteur. Anthropic a annoncé une API de détection gratuite, mais elle n'est toujours pas là : au 23 septembre, personne en dehors d'Anthropic ne peut lire cette marque. Un professeur qui aurait la clé pourrait dire qu'un passage est passé par la machine. Toi, avec ton navigateur, tu ne peux rien vérifier du tout. C'est exactement ce déséquilibre qui fait grincer des dents, et il est difficile de lui donner tort.

Une pile de copies manuscrites sur le bureau d'un enseignant, avec un stylo rouge et des lunettes

Un professeur, un stylo rouge et une pile de copies. Sans la clé, il ne lit rien du tout ; avec la clé, il lira seulement qu'un passage a vu une machine, jamais qui l'a pensé

Pourquoi certains appellent ça des mouchards

Un billet publié le 21 septembre sur le site Brand.io, et repris depuis dans toute la presse technique, propose un autre mot que filigrane : spymark, le mouchard. L'argument tient en une phrase. Un filigrane, c'est visible, déclaré et inerte, une marque qu'on voit et qu'on ignore. Un mouchard, c'est invisible, ça survit au réencodage, et c'est lisible seulement par des gens que tu n'as pas choisis.

Le point technique derrière le vocabulaire est plus intéressant que le vocabulaire lui-même. Dans une image, la version de SynthID pour les photos range un identifiant de 64 bits, ce qui suffit à pointer vers une entrée dans une base de données. L'image ne dit pas seulement qu'elle a été générée par une machine, elle peut dire par quelle requête, à quelle heure et depuis quel compte. Pour le texte, Anthropic décrit la même mécanique sous une autre forme : la clé est chez elle, et chez ceux à qui elle la donnera. Il ne reste plus qu'à nommer la liste, régulateurs, police, rédactions, sociétés de vérification.

Et le cas le plus gênant ne vient même pas de là. Microsoft encode un identifiant dans les images produites par son Paint, y compris sur les machines Copilot+ où le calcul est censé se faire en local, et la fiche technique attachée au fichier, celle qui décrit normalement tout ce que la photo contient comme informations cachées, n'en parle pas. C'est un chercheur qui l'a trouvé en analysant le programme, pas Microsoft qui l'a écrit dans sa documentation.

Concrètement, ça change quoi pour toi

Trois situations, et tu en as traversé au moins une cette semaine.

Un téléphone tenu au-dessus d'une table de cuisine pour photographier un plat de pâtes

Une photo d'assiette prise avec ton téléphone n'a jamais traversé un générateur d'images. Ce détail va compter le jour où quelqu'un voudra trier les photos en deux tas

Le devoir de ton gamin, d'abord. Aujourd'hui, rien ne change, parce que personne ne peut lire la marque, ni toi ni son professeur. Les outils qui prétendent débusquer un texte d'IA restent ce qu'ils étaient hier, des devinettes. Le jour où une école aura la clé, ce sera l'inverse : la marque dira qu'un passage est passé par la machine, et elle ne dira pas qui l'a pensé. L'élève qui fait corriger ses fautes se retrouvera dans le même sac que celui qui a fait écrire tout son travail.

Ton travail ensuite. Si tu écris des courriers, des rapports ou des articles, tu passeras de plus en plus souvent par un assistant, ne serait-ce que pour une relecture, et ces textes sortiront marqués. Ça ne change rien à leur qualité et personne ne te le reprochera aujourd'hui. Mais le jour où un client, un éditeur ou un service de recrutement décidera de trier sur ce critère, il le fera avec un outil dont tu n'auras pas la clé.

Et l'échéance, pour finir, il faut la dire honnêtement : aujourd'hui, ça ne change rien pour toi, et je ne peux pas te dire quand ça changera. Le détecteur arrivera dans quelques mois, ou pas du tout. C'est toute la limite de cette histoire, on a posé une obligation, et l'outil qui la rend vérifiable n'existe pas encore.

Ce qui efface la marque, et ce qui la garde

Anthropic a publié la liste de ce qui abîme sa propre marque, ce qui est plutôt honnête de sa part. Un texte court ne porte pas assez de choix pour tenir. Un texte très factuel, une liste de courses ou du code, laisse trop peu de liberté au modèle pour que la signature s'accroche. Une paraphrase lourde, un passage par un autre modèle ou une réécriture complète la font disparaître. Une capture d'écran d'un texte marqué la lave aussi, puisque ce n'est plus du texte.

Et il y a un détail qui concerne tous les blogs du monde, le mien compris : les métadonnées d'une image, ces informations rangées dans le fichier et pas dans l'image, s'évaporent au premier changement de format ou au premier réencodage par un réseau social. C'est ce qui rend le marquage des textes beaucoup plus solide que tout ce qu'on a bricolé avant. Il n'y a rien à effacer, il n'y a rien à cacher, il n'y a que des mots choisis autrement.

Reste le chiffre que personne n'a publié et qui compte plus que tout le reste : la fréquence des erreurs. Combien de textes humains seront marqués à tort, combien de textes de machine passeront au travers ? Sans ce chiffre, on parle d'un outil de preuve qui n'a jamais été mesuré sur ce point précis. Le jour où une école voudra condamner un élève avec ça, ce sera le premier document à réclamer.

Ma question, et je n'ai pas la réponse, c'est ce qu'on fait d'une preuve que personne ne peut contester parce que personne ne peut la lire. Et pour ce blog, tout est en règle : un humain relit et signe chaque ligne, c'est écrit noir sur blanc dans la loi. Je peux juste pas te le prouver.

Rejoignez la conversation

Vous devez avoir un compte pour commenter cet article. La création est gratuite et prend moins d'une minute.

  • Le fichier XMLTV à télécharger gratuitement, chaque jour
  • Commenter les articles et répondre aux autres lecteurs
  • Être averti par e-mail des nouveaux articles que vous suivez

Aucun commentaire pour le moment.

Une erreur s'est produite. Cette application peut ne plus répondre jusqu'à ce qu'elle soit rechargée.Veuillez contacter l'auteur. Reload 🗙