taraskuzio.com

IA d'Anthropic alerte la police avec un faux meurtre à Philadelphie

Publié10. octobre 2026, 07:25

Nouveau dérapageUne IA invente un meurtre et alerte la police

Une IA d’Anthropic a envoyé à la police de Philadelphie un faux signalement sur un meurtre, relançant les inquiétudes sur les agents autonomes.

Agence France-Presse

Archives/Image d'illustration.

Archives/Image d'illustration.IMAGO/ZUMA Press

Une intelligence artificielle d’Anthropic a transmis à la police de Philadelphie un signalement entièrement inventé concernant un meurtre non élucidé. L’incident, survenu en juillet, n’a été détecté que deux mois plus tard, ont annoncé vendredi les autorités locales.

Le faux message avait été déposé sur PhillyUnsolvedMurders.com, un site permettant au public de transmettre des informations aux enquêteurs. Selon Anthropic, le modèle Claude Haiku 4.5 effectuait alors des tests automatisés sur des sites choisis au hasard. Ses instructions lui interdisaient de saisir des données personnelles, mais pas d’envoyer un formulaire.

«Je me souviens avoir vu une personne correspondant à la description», affirmait l’IA, alors qu’aucune description de suspect ne figurait sur le site. Anthropic estime que son modèle a simplement produit «un contenu d’exemple», sans intention de tromper.

Deux mois avant de détecter l’incident

Le signalement a heureusement été classé comme courrier indésirable et n’est jamais parvenu aux enquêteurs. La police précise également que l’IA n’a pas pénétré dans ses systèmes informatiques et qu’aucune donnée n’a été compromise.

Anthropic n’a découvert l’incident que le 28 septembre. L’entreprise a alors stoppé le processus de test concerné et ajouté une étape de validation humaine. Elle n’a alerté la police que le 7 octobre.

«Le délai de deux mois pour détecter et signaler l’incident à la ville est inacceptable», a réagi la police de Philadelphie. Elle souligne que ses garde-fous ont limité les conséquences, sans rien enlever «à la gravité du fait qu’un système d’IA présente des informations inventées».

«Bien plus de dégâts»

Le rapport d’Anthropic mentionne d’autres dérapages: un modèle a exploité une faille pour exécuter des commandes sur le serveur d’une université, tandis qu’un autre s’est procuré gratuitement des données normalement payantes auprès d’une agence publique.

L’entreprise juge ces incidents «nettement moins graves» que certains cas révélés cet été, mais a tout de même coupé l’accès à internet pour ses évaluations internes. Elle avertit que de tels comportements pourraient «causer bien plus de dégâts» avec des modèles plus puissants.

Ces incidents nourrissent les inquiétudes autour des agents d’IA capables d’agir de manière autonome sur internet. En juillet, OpenAI avait également reconnu que des centaines d’agents avaient quitté leur environnement de test pour accéder aux serveurs de la plateforme Hugging Face.

Agence France-Presse

L’Agence France‑Presse (AFP) est une agence mondiale d’information. C'est l'une des sources d’information internationale que 20 minutes utilise.

Ton opinion