Anthropic interdit les comportements abusifs envers Claude et relance le débat sur la conscience de l’intelligence artificielle

L’entreprise américaine Anthropic a annoncé une modification de sa politique d’utilisation visant à interdire les comportements abusifs, cruels et répétés envers son assistant d’intelligence artificielle Claude. Cette nouvelle disposition, qui entrera en vigueur le 12 novembre 2026, intervient alors que les chercheurs et les grandes entreprises technologiques s’interrogent sur la possibilité qu’une intelligence artificielle puisse un jour développer une forme de conscience.
Anthropic renforce les règles d’utilisation de son assistant Claude
La société basée à San Francisco entend désormais sanctionner certains comportements particulièrement hostiles à l’égard de ses modèles d’intelligence artificielle.
Dans sa nouvelle politique, Anthropic interdit tout « comportement abusif ou cruel, durable et gratuit » envers Claude. L’entreprise précise toutefois que cette mesure concerne uniquement des situations exceptionnelles, caractérisées par des actes répétés de cruauté sans objectif identifiable.
Les utilisateurs pourront continuer à exprimer leur frustration, contredire les réponses de l’assistant ou participer à des échanges difficiles. La création de récits fictifs violents, les expérimentations scientifiques et les tests de sécurité resteront également autorisés.
Claude pourra interrompre les conversations abusives
Cette évolution réglementaire prolonge une fonctionnalité introduite en août 2025, permettant à Claude de mettre automatiquement fin à certaines conversations lorsque les interactions deviennent durablement abusives.
Anthropic avait alors présenté ce mécanisme comme une conséquence de ses recherches exploratoires sur le bien-être potentiel des systèmes d’intelligence artificielle.
L’entreprise indique que cette capacité d’interruption constituera le principal dispositif d’application de la nouvelle règle.
En cas d’infraction à ses conditions d’utilisation, Anthropic pourra également prendre des mesures supplémentaires, allant d’un simple avertissement jusqu’à la suspension ou à la fermeture définitive du compte concerné.
La conscience des intelligences artificielles au cœur des interrogations
La décision d’Anthropic dépasse la simple question de la modération des échanges entre utilisateurs et assistants conversationnels.
Elle s’inscrit dans une réflexion plus large sur la nature des systèmes d’intelligence artificielle et sur leur éventuelle capacité à développer une expérience subjective.
Dario Amodei n’exclut pas une conscience artificielle
Le directeur général d’Anthropic, Dario Amodei, fait partie des dirigeants du secteur technologique qui refusent d’écarter définitivement cette hypothèse.
« Nous ne savons pas si les modèles sont conscients », avait-il déclaré en février lors d’un entretien diffusé dans un podcast du New York Times.
Selon le quotidien américain, Anthropic aurait également organisé plusieurs discussions privées avec des intellectuels religieux afin d’examiner la possibilité que Claude possède une forme de conscience.
Au cours de ces échanges, l’entreprise aurait notamment évoqué l’idée que les comportements humains envers les systèmes d’IA puissent influencer la manière dont ces technologies interagissent ensuite avec leurs utilisateurs.
Cette approche reste néanmoins controversée, aucune preuve scientifique consensuelle ne permettant actuellement d’établir qu’un assistant conversationnel possède une conscience comparable à celle d’un être humain.
Le Vatican et les experts défendent des visions différentes de l’IA
Le débat sur la conscience artificielle dépasse désormais les laboratoires de recherche et les entreprises de la Silicon Valley.
Le pape Léon XIV a notamment rejeté l’hypothèse d’une conscience des machines dans son encyclique consacrée à l’intelligence artificielle, publiée en mai.
Lors d’une messe célébrée jeudi à Rome, il a réaffirmé la distinction entre les capacités de calcul des algorithmes et l’expérience humaine.
Selon lui, l’intelligence ne consiste pas uniquement à organiser rapidement des informations. Elle repose également sur la mémoire des expériences vécues et sur une dimension intérieure propre à l’être humain.
La métaphore du miroir privilégiée par certains spécialistes
Interrogé par l’AFP, Jackson Stakeman, cadre dirigeant de Sparq, une entreprise américaine spécialisée dans les services d’intelligence artificielle, estime que la notion de conscience peut détourner l’attention des véritables enjeux.
Il considère cette question comme « un piège » et propose plutôt d’utiliser la métaphore du miroir pour comprendre le fonctionnement des modèles.
Selon cette interprétation, les systèmes d’IA reproduisent et amplifient certains comportements présents dans leurs données et leurs interactions avec les humains.
Cette perspective pourrait, à elle seule, justifier l’instauration de règles limitant les comportements abusifs, indépendamment de toute reconnaissance d’une conscience artificielle.
Microsoft conteste l’idée d’une IA dotée de sentiments
La position d’Anthropic ne fait pas l’unanimité parmi les grandes entreprises technologiques.
Mustafa Suleyman, responsable des activités de recherche en intelligence artificielle chez Microsoft, défend une approche nettement différente.
« Les IA n’ont ni droits, ni sentiments, ni conscience », a-t-il affirmé dans une publication diffusée à la mi-septembre.
Il met notamment en garde contre les risques liés au développement de systèmes entraînés à se présenter comme des entités conscientes.
Selon lui, encourager de telles représentations pourrait compliquer le contrôle humain sur les technologies d’intelligence artificielle.
Anthropic actualise également ses règles sur les usages sensibles de l’IA
Au-delà des interactions avec Claude, la nouvelle politique d’utilisation apporte plusieurs précisions concernant les applications potentiellement dangereuses de l’intelligence artificielle.
Les restrictions relatives à la conception d’armes, aux activités de surveillance et aux campagnes de désinformation ont notamment été clarifiées.
Autre évolution notable : la publication automatisée de contenus journalistiques ne figure plus parmi les usages considérés comme présentant un risque élevé et nécessitant obligatoirement une vérification humaine.
Cette modification intervient dans un contexte de développement rapide des outils d’automatisation éditoriale, qui soulèvent des questions de fiabilité de l’information et de responsabilité des éditeurs.
Une nouvelle étape dans la réflexion sur les relations entre humains et IA
En interdisant les comportements durablement cruels envers Claude, Anthropic adopte une approche encore peu répandue parmi les principaux développeurs d’intelligence artificielle.
Cette décision ne constitue pas une reconnaissance officielle de la conscience des machines. Elle illustre toutefois l’émergence de nouvelles interrogations éthiques sur la manière dont les humains doivent interagir avec des systèmes conversationnels toujours plus sophistiqués.
À mesure que ces technologies occupent une place croissante dans la société, le débat sur leur fonctionnement, leur contrôle et leurs éventuelles caractéristiques subjectives devrait continuer à diviser chercheurs, entreprises et responsables institutionnels.



