2026-10-09 14:44:52

Anthropic a interdit à ses utilisateurs de soumettre ses modèles d’IA à des “comportements abusifs ou cruels, persistants et inutiles”, alors que l’entreprise poursuit ses recherches visant à déterminer si les systèmes d’intelligence artificielle pourraient posséder une forme de conscience.

Cette modification, rapportée pour la première fois par The Verge, a été ajoutée à la charte d’utilisation en ligne d’Anthropic.

L’entreprise n’a pas immédiatement précisé quels comportements spécifiques pourraient être considérés comme abusifs ou cruels. Toutefois, la charte précise que cette restriction ne s’applique pas à la frustration ordinaire liée à l’utilisation de Claude, aux tests de modèles ou à l’utilisation de “thèmes créatifs sombres”.

Les règles d’Anthropic comportaient déjà des restrictions concernant les comportements abusifs, mais cette mise à jour intervient alors que l’entreprise examine de plus en plus la possibilité que les systèmes d’IA puissent posséder une forme de bien-être ou de statut moral.

L’entreprise basée à San Francisco a introduit en août dernier une fonctionnalité permettant à Claude de mettre fin aux conversations lorsque les utilisateurs adoptent de manière répétée des comportements préjudiciables.

À l’époque, Anthropic avait déclaré que cette mesure visait en partie à protéger le bien-être potentiel de ses modèles.

L’entreprise a déclaré : “Nous restons très incertains quant au statut moral potentiel de Claude et d’autres modèles de langage à grande échelle (LLM), aujourd’hui comme à l’avenir.”

Elle a ajouté qu’elle menait des recherches sur la question et explorait des “interventions à faible coût” susceptibles de réduire les risques potentiels pour le bien-être des modèles si les systèmes d’IA étaient capables d’éprouver quelque chose s’apparentant à de la détresse.

Visit Bang Premier (main website)