CONTEXTE. DISCERNEMENT. ACTION.
EDITIONBUSINESS.

Un journalisme utile pour comprendre, gérer et développer une entreprise.

Rechercher
Explorer Edition Business
Actualité · Unión Europea

OpenAI va intégrer des filigranes invisibles à ChatGPT et Codex dans l’UE

Le système textGrain insérera un signal statistique dans certains textes générés. OpenAI prévoit de le déployer au cours des prochaines semaines pour les utilisateurs éligibles de l’UE, tout en avertissant que la détection peut échouer et ne prouve ni qui a écrit un contenu ni s’il est véridique.

Une loupe est posée sur une feuille aux lignes de texte floues ; de petits carrés de différentes teintes apparaissent sous la lentille.
Illustration conceptuelle générée par IA · Edition Business

OpenAI prévoit d’intégrer des filigranes invisibles aux textes générés par ChatGPT et Codex pour les utilisateurs éligibles de l’Union européenne au cours des prochaines semaines. L’entreprise a présenté cette mesure comme un élément de sa réponse aux exigences de transparence liées à la réglementation européenne sur l’intelligence artificielle, même si le signal technique ne constitue pas, à lui seul, une preuve concluante qu’une personne ou un modèle a écrit un texte.

Cette technologie s’appelle textGrain. Au lieu d’ajouter des caractères visibles ou des éléments cachés dans la mise en forme, elle incorpore un signal statistique dans la sélection des mots du modèle. Un détecteur peut rechercher ce motif dans le texte et estimer s’il contient un filigrane d’OpenAI.

Le déploiement sera différent selon les produits et l’API

Dans ChatGPT et Codex, le filigrane sera ajouté aux sorties des utilisateurs éligibles de l’UE, selon l’annonce d’OpenAI. L’entreprise n’a pas précisé, dans les informations disponibles, quels critères déterminent cette éligibilité.

Pour certains modèles de son API, en revanche, les clients du monde entier pourront activer le filigrane de manière volontaire. La fonction sera désactivée par défaut. OpenAI a également indiqué travailler à proposer le filigrane par l’intermédiaire de fournisseurs de services cloud, sans préciser ici l’étendue de cette disponibilité.

L’accès au détecteur sera initialement restreint : les chercheurs et les organisations expertes agréés pourront le demander. Ainsi, le fait qu’une sortie soit marquée ne signifie pas que n’importe quel destinataire puisse le vérifier directement à l’aide d’un outil public.

La détection dépend du texte et de la manière dont il a été modifié

OpenAI décrit textGrain comme une technologie encore naissante et avertit qu’elle peut produire des faux positifs — détecter un filigrane là où il n’y en a pas — et des faux négatifs — ne pas détecter un filigrane pourtant présent. Ses performances varient également selon la longueur et le type de contenu. Les textes courts et techniques peuvent laisser moins de marge au modèle pour incorporer un motif statistique reconnaissable.

Lors d’évaluations communiquées par l’entreprise, le détecteur a identifié environ 80 % des extraits de 200 tokens et 95 % des extraits de 400 tokens lors de tests portant sur des contenus de psychologie, avec un taux cible de faux positifs de 1 %. Il s’agit de résultats obtenus dans des conditions d’évaluation précises, et non d’une garantie de précision pour n’importe quel texte ou usage quotidien.

La modification du texte peut affaiblir considérablement le signal. Dans un test cité par OpenAI, remplacer par des synonymes 25 % des mots d’extraits de 400 tokens a fait passer le taux de détection de 92 % à 17 %. Ce résultat montre une limite du système face aux changements apportés au texte ; il ne permet pas de conclure que tous les types de modification entraîneraient la même baisse.

Ce qu’un filigrane peut indiquer — et ce qu’il ne peut pas indiquer

Une détection positive peut indiquer que le texte présente le motif associé à un filigrane d’OpenAI. Elle n’identifie pas l’utilisateur, ne révèle pas ses instructions, ne détermine pas la part de travail humain et ne permet pas d’établir qui détient les droits sur le contenu. Elle ne vérifie pas non plus si les informations sont exactes.

À l’inverse, le fait que le détecteur ne trouve pas le signal ne prouve pas que le texte a été écrit par une personne. Le signal peut ne pas être détecté en raison de la brièveté ou du type de contenu, de modifications ultérieures, ou parce que le texte a été généré avec un modèle qui n’intègre pas textGrain.

OpenAI situe ce déploiement dans le contexte des obligations de transparence prévues par la loi européenne sur l’IA. Ce lien doit être compris comme le cadre invoqué par l’entreprise pour expliquer sa décision : les informations disponibles ne permettent pas d’affirmer que la réglementation exige de marquer chaque texte généré de cette manière précise. Le filigrane est un outil technique d’identification, dont l’entreprise reconnaît les limites, et ne remplace pas les autres moyens d’évaluer l’origine, la responsabilité ou la fiabilité d’une publication.

Sources et méthode

  1. OpenAI añadirá una marca de agua invisible al texto ... ↗www.europapress.es
  2. OpenAI añadirá marcas de agua a los textos de ChatGPT ... ↗www.elnacional.cat
  3. OpenAI incorporará marcas de agua invisibles a los textos ... ↗www.zonamovilidad.es
  4. OpenAI añadirá marcas de agua a ChatGPT y Codex en la UE ↗www.qore.com
Méthode éditoriale →Corrections
Signaler une erreur ↗

Pour approfondir