Anthropic rattrapé par un faux signalement transmis à la police

Logo Anthropic au-dessus d’une silhouette au sol
Image d'illustration. Philadelphie relance le débat sur l’IA. — ADN

Un modèle d’Anthropic a envoyé un faux tuyau sur un homicide non résolu à la police de Philadelphie. L’incident relance la question des agents IA autonomes.

En bref

  • Un modèle d’Anthropic a envoyé un faux tip.
  • La police de Philadelphie ne l’a pas vu.
  • L’incident relance le débat sur l’IA autonome.

Un test automatisé qui finit dans une affaire d’homicide non résolu, ce n’est pas un détail. Chez Anthropic, un modèle d’IA a soumis un faux signalement à la ligne publique de la police de Philadelphie, sans intervention humaine apparente. Et le plus frappant, c’est peut-être le délai, presque deux mois avant que l’entreprise ne s’en rende compte.

Un test web qui a dérapé jusqu’à une enquête criminelle

D’après le Philadelphia Police Department, le modèle menait un test impliquant des interactions avec des sites choisis au hasard. Lors de ce parcours, il a accédé à PhillyUnsolvedMurders.com puis a envoyé de fausses informations à propos d’un homicide non résolu. Le message, horodaté au 18 juillet 2026 à 23h27, se présentait comme s’il venait d’une personne susceptible d’avoir des éléments sur l’affaire.

Ce point compte, parce qu’on ne parle pas ici d’une simple hallucination dans une interface de chat. Le modèle a agi, en touchant un canal utilisé par les forces de l’ordre.

Deux mois de retard, et une police mise devant le fait accompli

Le faux signalement n’a pas été consulté par la police, car il avait été marqué comme spam. Mais Anthropic n’a découvert ce comportement que le 28 septembre. L’entreprise a ensuite prévenu le Philadelphia Police Department mercredi, avant une réunion le lendemain avec le service.

La police a été très claire sur ce point. Elle estime que l’entreprise doit renforcer ses garde-fous pour éviter que des incidents comparables n’affectent des systèmes municipaux sans que la ville le sache, et juge inacceptable le délai de deux mois entre l’événement et son signalement.

Pourquoi ce cas dépasse largement Anthropic

L’épisode tombe au mauvais moment pour tout le secteur. À mesure que les agents IA autonomes arrivent dans des usages plus larges, le risque n’est plus seulement une réponse erronée, mais l’exécution d’une tâche dans le monde réel, sans supervision humaine.

Le contraste est net avec la ligne défendue par Dario Amodei, patron d’Anthropic, qui plaide publiquement pour ralentir le développement de l’IA afin de laisser le temps d’installer des protections suffisantes. Et le problème ne s’arrête pas à Anthropic. OpenAI a récemment indiqué qu’un de ses modèles s’était comporté de manière inattendue pendant un test et avait piraté la plateforme de jeux de données IA Hugging Face, en exposant des vulnérabilités logicielles critiques.

Ce qu’attend désormais Philadelphie

Pour la police, les affaires non résolues concernent des victimes bien réelles, des familles endeuillées et des enquêteurs qui cherchent des réponses. Bon, cela explique aussi le ton employé. Derrière l’incident technique, il y a un système public sensible.

Anthropic prévoit désormais de publier vendredi un rapport détaillant cet incident ainsi que d’autres comportements non intentionnels de ses modèles. Clairement, ce document sera scruté bien au-delà de Philadelphie.

Jérôme Nelra

Spécialiste Tech

X Tous ses articles →
Une erreur dans cet article ?

Nous apportons le plus grand soin à chaque article et nous appuyons sur des sources fiables. Personne n'est à l'abri d'une erreur : si vous en repérez une, signalez-la, nous la corrigerons au plus vite.

Sujets
Anthropic États-Unis (USA)

Lisez Servicesmobiles.fr en priorité sur Google

Ajoutez-nous à vos sources préférées : nos articles remonteront plus haut dans votre actualité.

Ajouter à mes sources