Les filigranes cachés suivront le texte généré par l’IA

Publié le

Vous vous demandez si un écrit a été généré par l’intelligence artificielle ? Anthropic a une solution : les filigranes.

Mais la récente mise à jour de l’entreprise n’est pas basée sur les demandes du marché ou sur l’innovation. Il découle de la loi sur l’intelligence artificielle de l’Union européenne. Les règles strictes interdisent toutes sortes de comportements et s’accompagnent d’une série de nouvelles exigences pour l’IA jugée à haut risque. Les règles relatives à l’IA « à haut risque » sont entrées en vigueur ce mois-ci.

Les interdictions sur les systèmes d’IA incluent « le déploiement de techniques subliminales, manipulatrices ou trompeuses pour déformer le comportement et entraver la prise de décision éclairée, causant des dommages importants ». Les systèmes d’IA ne peuvent pas non plus « (déduire) des émotions sur les lieux de travail ou dans les établissements d’enseignement, sauf pour des raisons médicales ou de sécurité ». Et bien plus encore.

Les sanctions les plus sévères prévues par la loi européenne sur l’IA sont des amendes pouvant aller jusqu’à 7 % du chiffre d’affaires mondial pour les entreprises reconnues en infraction. Cela fera certainement de l’UE un endroit plus difficile pour les entreprises américaines d’IA. Mais l’impact sera mondial, comme le montre le déploiement des filigranes par Anthropic dans tous les pays, soulignant que le changement est lié aux exigences de transparence de la loi.

Anthropic a détaillé le fonctionnement des filigranes, en adoptant une méthode développée et déjà utilisée par Google. Le processus implique la manière dont le modèle d’IA choisit des mots et des fragments de mots spécifiques dans le texte. Anthropic a une clé qui implique deux listes de mots et le texte généré doit inclure suffisamment de mots d’une liste pour être statistiquement significatif. La méthode a des limites, comme ne pas fonctionner correctement sur des passages plus courts et ne révéler que la « probabilité » d’être écrite par l’IA.

« Étant donné que le filigrane fait partie du texte, il voyagera avec le texte lorsqu’il sera copié et collé ailleurs, et pourra persister lors de certaines modifications », selon Anthropic. « Le filigrane sera appliqué au niveau du modèle, ce qui signifie qu’il sera présent quel que soit le produit ou la surface Claude d’où provient le texte. »

Si cela fonctionne bien, les lecteurs ne devraient pas le remarquer. « Vous ne le verrez pas et cela ne change rien au sens, à la qualité ou à la lisibilité de la réponse de Claude », selon l’entreprise. Théoriquement, les filigranes pourraient aider à identifier le texte généré par l’IA n’importe où. Mais cette décision risque de susciter des inquiétudes quant au pouvoir d’Anthropic sur la production de texte des utilisateurs et à ses implications pour la propriété intellectuelle.

Attendez-vous à ce que l’adoption des filigranes par Anthropic suscite davantage de réticences de la part de l’administration Trump, craignant de contrecarrer l’innovation technologique et de nuire aux géants américains de la technologie. Le président Trump a déclaré le mois dernier que l’administration procéderait à un examen formel pour riposter aux pratiques numériques « discriminatoires » de l’UE, découlant d’une autre loi européenne sur le numérique qui a conduit à d’énormes amendes contre les géants américains de la technologie. La réaction croissante attirera également davantage d’attention sur l’utilisation par Google de filigranes textuels pour son modèle d’IA Gemini.

Avec l’entrée en vigueur progressive de la loi européenne sur l’IA et les géants américains de l’IA qui s’efforcent de s’y conformer, les relations entre les États-Unis et l’Europe ne feront que devenir plus tendues.


Contenu connexe

  • Comment le gel du niveau d’entrée de l’IA retarde la retraite
  • Nous avons lancé 5 défis financiers aux chatbots IA. Voici comment ils ont fait
  • L’avenir du courrier électronique basé sur l’IA
  • La Californie mène la charge alors que les amendes pour atteinte à la vie privée montent en flèche