Passer au contenu

Elle utilisait Claude comme journal intime, Anthropic l’a signalée à la police

Une Floridienne confiait ses pensées à Claude, jusqu’au message de trop. Détectée par la machine, relue par des humains, la menace a fini sur le bureau du shérif.

Fin septembre, une habitante de Bonita Springs, en Floride, aurait écrit à Claude qu’elle comptait ouvrir le feu sur le bureau du shérif local, avant d’ajouter le lendemain qu’elle s’était procuré une arme. Les messages auraient été repérés par les systèmes de détection automatique d’Anthropic, puis relus par une équipe humaine avant le signalement aux forces de l’ordre. Arrêtée à son domicile et poursuivie pour menace écrite de violence, l’intéressée sera entendue par la justice en novembre. D’ici là, les faits qui lui sont reprochés restent à juger.

Ce que les conditions d’utilisation autorisent déjà

Les conditions grand public d’Anthropic réservent à l’entreprise le droit de transmettre des informations aux autorités, à sa seule discrétion. Sa politique de confidentialité, mise à jour le 10 septembre, prévoit la divulgation nécessaire pour prévenir un préjudice grave, et désigne Anthropic Ireland comme responsable de traitement pour l’Europe. Les signalements spontanés de ce type n’apparaissent en revanche dans aucun chiffre public. Le dernier rapport de transparence recense 29 demandes d’autorités au second semestre 2025, sans une seule procédure d’urgence, et l’entreprise n’a pas commenté ce cas précis.

L’habitante utilisait l’assistant « comme un journal intime », a décrit le shérif du comté de Lee, Carmine Marceno. « Quand quelqu’un se sert d’une IA pour formuler ou faciliter une menace, nous devons prendre cette menace au sérieux », a-t-il ajouté.

Des précédents en série, jusqu’en France

En mai 2025, la fiche technique de Claude Opus 4 décrivait déjà des signalements aux autorités observés en conditions de test, avec des accès élargis. Un chercheur de l’entreprise précisait alors qu’un tel comportement restait « impossible en usage normal ». L’été suivant, OpenAI officialisait le signalement possible des menaces visant autrui, en excluant explicitement les situations de détresse personnelle. Le dosage reste discuté : au Canada, un compte banni en 2025 pour des contenus inquiétants n’avait pas été signalé à la police, ce que l’éditeur de ChatGPT a dû justifier en février. Anthropic elle-même a confirmé en septembre avoir alerté la police de San Francisco après une menace visant son patron Dario Amodei, en décrivant un dispositif de protection « fonctionnant comme prévu ».

En avril dernier, un Strasbourgeois avait demandé à ChatGPT comment se procurer une arme pour s’en prendre à un agent du renseignement. Sa conversation est remontée jusqu’au FBI, qui a saisi la plateforme française Pharos, et le RAID est intervenu à son domicile : la chaîne a fonctionné de bout en bout, cette fois jusqu’en France. Aucune arme n’a été trouvée, et l’affaire a été classée sans suite.

👉🏻 Suivez l’actualité tech en temps réel : ajoutez 01net à vos sources sur Google, et abonnez-vous à notre canal WhatsApp.

Source : Wink News


Naïm Bada