Vous insultez votre IA ? Claude va désormais pouvoir couper court à vos échanges

 
Anthropic interdit désormais les comportements abusifs répétés envers Claude, son assistant IA. La règle entre en vigueur le 12 novembre et s’appuie sur une fonction déjà en place, qui permet au chatbot de mettre fin à un échange.
Logo Claude AI – Anthropic // Source : Anthropic

Il arrive qu’un modèle de langage (LLM) ne parvienne pas à comprendre une demande, même après plusieurs tentatives. De quoi frustrer certains utilisateurs, qui peuvent alors finir par insulter leur chatbot. Si ces réactions restent anecdotiques, Anthropic entend néanmoins encadrer ce type de comportements lorsqu’ils deviennent abusifs, cruels et répétitifs. Pour y faire face, l’entreprise a ajouté ce jeudi 8 octobre une nouvelle règle à la politique d’utilisation de Claude, qui entrera en vigueur le 12 novembre 2026.

Cette interdiction fait partie de la mise à jour annuelle de la politique d’utilisation d’Anthropic. Le même texte revoit aussi les règles sur les campagnes de désinformation, le développement d’armes, la surveillance, les usages à risque dans la santé ou la finance, et le pilotage de matériel capable d’agir physiquement. Sur la plupart de ces points, l’entreprise dit surtout clarifier des règles existantes ; l’interdiction des abus envers ses modèles, elle, est un ajout.

Seuls les cas extrêmes sont visés

Anthropic précise que cette règle ne vise que les cas extrêmes, lorsque des utilisateurs s’acharnent de manière répétée sur le chatbot sans raison identifiable. La firme indique ainsi que cette restriction ne s’appliquera pas aux « manifestations courantes de frustration, aux réactions négatives, aux thèmes créatifs sombres, ni aux tests et recherches effectués sur nos modèles ». Une liberté importante, compte tenu des erreurs et des hallucinations que peuvent encore produire les chatbots.

Pour faire appliquer cette règle, Anthropic compte avant tout sur la capacité de Claude à mettre fin à une conversation lorsque les échanges deviennent durablement abusifs. Une possibilité qu’Anthropic teste en réalité depuis août 2025 avec Claude Opus 4 et 4.1. L’entreprise expliquait alors que cette initiative s’inscrivait dans ses recherches sur le bien-être potentiel des modèles d’IA, tout en présentant un intérêt plus large pour leur alignement et les mécanismes de protection.

Quand Claude met fin à un échange, il n’est plus possible d’envoyer de message dans cette conversation. Les autres discussions du compte ne sont pas touchées : l’utilisateur peut en ouvrir une nouvelle immédiatement, ou modifier un message précédent pour repartir sur une autre branche. Claude a aussi pour consigne de ne pas utiliser cette option si l’utilisateur semble en danger, pour lui-même ou pour autrui. En revanche, comme le relève Android Authority, le texte de la nouvelle règle ne parle pas explicitement de suspension de compte.


Abonnez-vous à la newsletter Watt Else de Numerama et Survoltés ! Vous y retrouverez nos actus, tests et dossiers sur la mobilité électrique.

Pour nous soutenir gratuitement, dites simplement à Google d’ajouter Frandroid à vos sources préférées en cliquant ici.

Recherche IA boostée par
Perplexity