TechCrunch AI

OpenAI commencera à ajouter des étiquettes sur les textes de ChatGPT dans l’UE

OpenAI insérera des marqueurs de filigrane dans les textes de ChatGPT et Codex en UE afin de se conformer à la loi sur l’IA. Selon lui, la modification des textes peut rendre les marques invisibles plus difficiles à…

Source de l’image · TechCrunch AI

OpenAI commencera à ajouter une marque d’eau invisible aux textes générés par ChatGPT et Codex dans l’Union européenne afin de se conformer à la loi sur l’intelligence artificielle de l’UE, a déclaré l’entreprise lundi dans un post de blog.

Les règles de transparence de la loi sur l’IA de l’UE, entrée en vigueur le 2 août, exigent que les entreprises de IA marquent le contenu généré par l’IA d’une manière que d’autres systèmes puissent reconnaître.

OpenAI a indiqué que le filigrane sera déployé au cours des prochaines semaines pour les utilisateurs de ChatGPT et Codex qualifiés, dans toutes les plans, mais uniquement en UE. Les développeurs qui utilisent l’API d’OpenAI partout dans le monde peuvent activer ce filigrane pour certains modèles à partir d’aujourd’hui ; il est désactivé par défaut. OpenAI a précisé qu’il ne fait pas de l’affichage de filigrennes de texte une option globale dès le lancement.

L’empreinte d’image n’est pas un symbole réel, mais elle influence subtilement les choix de mots du modèle, créant un motif que les lecteurs ne peuvent pas voir, mais que les détecteurs peuvent repérer. Comme elle se trouve dans les mots eux-mêmes, elle se transmet lorsque le texte est copié et collé. OpenAI a indiqué que l’empreinte d’image ne identifie pas l’utilisateur, et qu’il n’y avait aucune variation significative dans les performances des modèles lorsque cette fonctionnalité était activée.

OpenAI a également publié un rapport technique concernant sa méthode appelée textGrain, en même temps que l’annonce. Co-écrit avec des chercheurs de l’Université de Pennsylvanie et de Yale, il décrit un exemple d’utilisation d’une clé secrète pour trier les prédictions des mots suivants afin de terminer une phrase. En combinant des centaines de ces éléments, le détecteur peut repérer du contenu généré par l’IA en utilisant uniquement le texte et la clé.

Est-il possible de supprimer le filigrane en l’éditant ? Les tests d’OpenAI indiquent que oui. Dans un test, le remplacement de 10 % des mots par des synonymes a fait baisser la détection de environ 92 % à 66 %. L’entreprise a également indiqué que les passages courts, les réponses mathématiques et le texte traduit sont plus difficiles à détecter.

Source:openaiOpenAICrédits des images :OpenAI

« Ces limites contribuent à notre décision de ne permettre l’accès initial au détecteur qu’aux chercheurs approuvés et aux organisations spécialisées, qui peuvent nous aider à évaluer sa fiabilité et son utilisation responsable », a déclaré l’entreprise.

OpenAI a également averti que l’absence d’un filigrane ne prouve pas l’autorité humaine. Le texte pourrait être trop court ou trop modifié, ou il pourrait provenir de l’IA d’une autre entreprise.

"[Les signatures de watermark] peuvent indiquer que un système OpenAI a généré ou traité une partie du texte, mais pas combien de jugement humain, d’édition ou de créativité y a été mis", a déclaré l’entreprise.

L’annonce arrive deux mois après le Anthropic ayant déclaré qu’il ajouterait un filigrane au texte généré par Claude, une mesure qu’il met en œuvre dans le monde entier. Cette décision a provoqué une réaction négative de la part de certains utilisateurs de Claude, qui ont affirmé avoir fourni « les instructions, le contexte et les décisions » tandis que Claude n’était qu’un « outil ».

OpenAI avait déjà créé un filigrane textuel, mais a hésité à le publier, en partie par crainte que les utilisateurs se tournent vers des concurrents qui ne l’utilisent pas, comme l’a rapporté The Wall Street Journal en 2024.

Anthropic, Google, Meta, Microsoft et OpenAI sont parmi les entreprises qui ont engagé leur suivi du code de pratique de l’UE concernant le contenu généré par l’IA.

Source originale

TechCrunch AI

À propos du contenu

La publication originale et les droits appartiennent à la source.

Traduction automatique · Consultez l’original