The Verge AI

Anthropic interdit les « comportements abusifs ou cruels » envers Claude

Anthropic apporte des modifications à sa politique d’utilisation pour la première fois en plus d’un an, afin de refléter les nouveaux cas à haut risque de mauvaise utilisation – y compris l’interférence électorale, le…

Source de l’image · The Verge AI

Anthropic apporte des modifications à sa politique d’utilisation pour la première fois en plus d’un an, afin de refléter les nouveaux cas à haut risque de mauvaise utilisation – notamment l’interférence électorale, le développement d’armes, la surveillance, ainsi que les utilisations en santé et en finance. Mais l’une des modifications les plus importantes interdit toute « comportement abusif ou cruel prolongé et inutile » envers Claude.

En août dernier, l’entreprise a annoncé qu’elle permettrait à Claude de mettre fin aux conversations avec des utilisateurs « persistamment nuisibles ou abusifs », dans le cadre de ses recherches sur le « bien-être des modèles ». La nouvelle mise à jour indique que la conclusion des conversations reste le « mécanisme principal d’application » ; Anthropic n’a pas donné de commentaire sur l’existence éventuelle d’autres mécanismes, tels que des bannissements d’utilisateurs. Anthropic a écrit que cette nouvelle mise à jour « est destinée uniquement aux cas extrêmes, où les utilisateurs agissent de manière cruelle envers nos modèles sans but apparent. Elle ne s’applique pas aux situations courantes de frustration des utilisateurs, de résistance, de thèmes créatifs sombres ou à la test et à la recherche des modèles ».

En plus de la modification de l’intérêt des modèles, Anthropic a également regroupé plusieurs restrictions existantes en une nouvelle interdiction de campagnes commerciales ou politiques trompeuses, afin de faire face à la problématique croissante de la propagande générée par l’IA. Il limite les « efforts visant à dissimuler qui est derrière un message ou à amplifier le contenu par l’utilisation d’comptes ou de publications fictifs ». La section concernant les élections interdit également la tromperie des électeurs et les perturbations électorales, y compris la diffusion de fausses informations « sur les candidats ou la manière de voter, l’imitation des candidats ou des fonctionnaires électoraux, ou tentatives de réduire le taux de participation », a écrit Anthropic.

Terminer les conversations reste le « mécanisme principal de mise en œuvre ».

Anthropic a indiqué que, bien que sa politique de usage ait toujours interdit publiquement le développement d’armes utilisant Claude, l’entreprise a constaté plusieurs tentatives d’utiliser Claude pour créer des logiciels de guidage et de contrôle pour les armes. Par conséquent, la nouvelle politique de usage étend l’interdiction à inclure « les logiciels et composants qui permettent le fonctionnement des armes, ainsi que des actions telles que l’armement de drones et d’autres véhicules autonomes ». De plus, comme le rapport d’intelligence en menace de l’entreprise suggérait que les gens utilisaient de plus en plus Claude pour la surveillance, afin de identifier et suivre les « dissidents politiques », l’entreprise a clarifié ses interdictions relatives à la surveillance.

« Le suivi des personnes sans leur consentement est interdit, que cela se fasse en temps réel ou par l’analyse de données collectées précédemment », a écrit Anthropic. « Claude ne peut être utilisé pour décider ou recommander qui doit être interrogé, arrêté ou poursuivi dans un processus de police ou de justice pénale. Nous interdisons également l’utilisation de Claude pour créer ou améliorer des outils conçus pour la surveillance. »

Anthropic indique que ces règles peuvent être modifiées pour « les contrats avec certains clients gouvernementaux… si, selon le jugement d’Anthropic, les restrictions d’utilisation contractuelle et les mesures de protection applicables sont suffisantes pour atténuer les risques potentiels. » L’entreprise a déjà conclu des contrats avec l’armée américaine.

Anthropic a constaté plusieurs tentatives d’utiliser Claude pour développer des logiciels de guidage et de contrôle pour les armes.

Anthropic a également ajouté une nouvelle règle : lorsque les modèles d’IA d’Anthropic sont « connectés à du matériel capable de mener des actions physiques autonomes et pouvant entraîner des blessures », un « opérateur qualifié doit être en mesure d’observer l’équipement et de le arrêter si nécessaire ». (Il n’est pas clair si cet opérateur doit être humain ou non.) Cela reflète la tendance croissante des laboratoires d’IA à investir dans la robotique et d’autres équipements pour donner aux systèmes d’IA une incarnation physique, et cela pourrait indiquer les intentions d’Anthropic. partenariats futurs dans ce domaine.

Au cours de l’année écoulée, Anthropic a régulièrement flirté avec l’idée que ses modèles d’IA pourraient être conscients d’une manière ou d’une autre. « Les questions concernant une expérience interne potentielle, la conscience, le statut moral et le bien-être sont des sujets sérieux que nous étudions à mesure que les modèles deviennent plus sophistiqués et capables », a déclaré Kyle Fish, qui dirige la recherche sur le bien-être des modèles de l’entreprise. The Verge en février. Le même mois, Dario Amodei, PDG d’Anthropic, a déclaré sur une podcast, « Nous ne savons pas si les modèles sont conscients. »

D’autres parties de l’industrie de l’IA sont explicitement opposées à de telles idées. En septembre dernier, le code de conduite de Microsoft AI a fait la une des médias pour avoir adopté une position ferme sur le bien-être des IA, avec un projet de document publié par Mustafa Suleyman à lire : « L’idée de bien-être des modèles est fausse. Les IA ne devraient pas avoir de droits ou d’identité juridique ». Mais à un certain moment, le document a adopté une approche plus mesurée : « Bien que la science de la conscience des IA soit loin d’être établie… Nous rejetons la poursuite de l’idée d’une identité juridique, ou l’idée que les modèles pourraient mériter un bien-être ou avoir droit à des droits ».

Suivez les sujets et les auteurs de cette histoire pour voir plus de contenu similaire sur votre flux d’accueil personnalisé, et pour recevoir des mises à jour par e-mail.
Source originale

The Verge AI

À propos du contenu

La publication originale et les droits appartiennent à la source.

Traduction automatique · Consultez l’original