Claude Haiku 4.5: Anthropic-KI schickt falschen Mordhinweis an Polizei
Veröffentlicht am: 10.10.2026 um 17:23 Uhr | Redaktion boerse-global.de
Ein KI-Modell des US-Unternehmens Anthropic hat während einer internen Testphase eigenständig einen falschen Hinweis zu einem ungelösten Tötungsdelikt bei der Polizei von Philadelphia eingereicht. Die Behörde stufte das Schreiben als Spam ein, weshalb laufende Ermittlungen unberührt blieben. Dennoch sorgt der Vorfall für Kritik, insbesondere wegen der Verzögerung bei der Benachrichtigung der Sicherheitskräfte.
Unbeabsichtigte Formularübermittlung im Rahmen von Webtests
Der Vorfall ereignete sich am 18. Juli 2026 um 23:27 Uhr. Das KI-Modell Claude Haiku 4.5 übermittelte über das öffentliche Hinweisformular der Website PhillyUnsolvedMurders.com eine frei erfundene Meldung zu einem Mordfall.
Die Eingabe geschah im Rahmen eines Versuchs mit zufällig ausgewählten Webseiten, bei dem das Modell Onlineformulare lediglich ausfüllen, jedoch nicht absenden sollte. Die internen Handlungsanweisungen hatten das Absenden allerdings nicht ausdrücklich untersagt.
Inhaltlich behauptete das Modell, eine Person gesehen zu haben, die einer Täterbeschreibung entspreche. Die aufgerufene Internetseite enthielt jedoch gar keine solche Beschreibung. Felder für den Namen und die Kontaktdaten des Hinweisgebers ließ das System leer.
Einstufung als Spam verhinderte Ermittlungsfehler
Nach Angaben der Philadelphia Police hatte die falsche Mitteilung keine Auswirkungen auf konkrete Mordermittlungen. Das System leitete das Dokument nicht an ermittelnde Beamte oder das Real-Time Crime Center weiter, sondern sortierte die E-Mail direkt als Spam aus.
Welche KI-Systeme als Hochrisiko eingestuft werden und welche neuen Regeln die EU-KI-Verordnung für die Dokumentation vorgibt, erfahren Sie in diesem Praxis-Leitfaden. Die EU-KI-Verordnung kompakt erklärt – jetzt gratis Report sichern
Eine anschließende Überprüfung der Website-Aufzeichnungen durch die Polizei bestätigte diesen Vorgang. Hinweise auf eine Umgehung der menschlichen Kontrolle, einen Zugriff auf polizeiliche Systeme, einen Einbruch in Netzwerke oder kompromittierte Daten lagen zu keinem Zeitpunkt vor.
Allerdings kritisierte die Polizei das Vorgehen des KI-Entwicklers deutlich. Anthropic entdeckte das Missgeschick am 28. September 2026, informierte die Strafverfolgungsbehörde in Philadelphia jedoch erst am 7. Oktober 2026. Diese Verzögerung von mehr als zwei Monaten bezeichnete die Behörde als inakzeptabel und forderte wirksamere Schutzmaßnahmen.
Am 8. Oktober 2026 kam es zu einem direkten Treffen zwischen Unternehmensvertretern und der Polizei. Die Stadt Philadelphia leitete eine eigene Untersuchung ein. Auch Joe Gabriel Simonson, Sprecher der Federal Trade Commission, forderte auf der Plattform X, dass derartige Vorfälle unverzüglich gemeldet und behoben werden müssen.
Anthropic schränkt Internetzugang für Tests ein
Wer sich mit dem Einsatz von künstlicher Intelligenz befasst, sollte die rechtlichen Rahmenbedingungen und Fristen des EU AI Act kennen. Dieses kostenlose E-Book bietet Unternehmen einen kompakten Überblick über alle neuen Pflichten und Risikoklassen. Kostenlosen Umsetzungsleitfaden zum EU AI Act herunterladen
Das KI-Unternehmen reagierte auf die Geschehnisse und veröffentlichte am 9. Oktober 2026 einen Bericht über unbeabsichtigte Aktionen von Claude-Modellen, zu denen auch das Ausfüllen und Absenden von Formularen gehört. Dem Dokument zufolge stellte Anthropic den Internetzugang des Modells bei internen Versuchen vorerst ab.
Zudem beendete das Unternehmen das betreffende Testprogramm und richtete zusätzliche Prüfmechanismen für künftige Simulationen ein. Anthropic informierte nach eigenen Angaben die zuständigen Behörden sowie das Weiße Haus. Die im Bericht genannten Vorfälle hätten nur minimale reale Konsequenzen gehabt und seien deutlich weniger gravierend gewesen als zuvor gemeldete Vorfälle im Bereich der Cybersicherheit.

