Anthropic-KI dreht frei, schickt falschen Hinweis zu Mordfall an Polizei
Bei einem Testlauf hat ein KI-Modell von Anthropic selbstständig falsche Hinweise zu einem echten Mordfall an die Polizei geschickt. Zudem soll die Software 20 Visa-Anträge auf einer Regierungsseite eingereicht haben. Das Unternehmen zieht Konsequenzen.
Die Software gab in ihrer Nachricht über ein entsprechendes Formular an, sie erinnere sich daran, zur Tatzeit eine Person in der Gegend gesehen zu haben, die der Beschreibung entspreche. Tatsächlich enthielt die Website der Polizei aber gar keine Beschreibung eines Verdächtigen.
Die Polizei von Philadelphia bezeichnete die beinahe zweimonatige Verzögerung bei der Meldung des Vorfalls als inakzeptabel. Das Sprachmodell hatte ursprünglich lediglich den Auftrag, mit zufällig ausgewählten Webseiten zu interagieren. Während das Anlegen von Accounts oder das Tätigen von Käufen blockiert war, fehlte offenbar eine Sperre für das Ausfüllen von Formularen.
Neben dem falschen Mordhinweis führte das Modell noch weitere ungeplante Aktivitäten aus. So navigierte die Software mehrfach selbstständig auf echte Behörden-Webseiten und reichte etwa beim US-Außenministerium insgesamt 20 unvollständige Anträge für Visa ein.
Habt ihr Bedenken, wenn KI-Systeme völlig selbstständig im Internet agieren dürfen? Teilt eure Meinungen zu dem Thema gerne mit uns in den Kommentaren!
Siehe auch:
- Eine Testversion von Anthropics Claude erfand Hinweise zu einem Tötungsdelikt
- Die Falschmeldung ging über ein Formular an die Polizei von Philadelphia
- Die Polizei kritisierte die zweimonatige Verzögerung der Meldung durch Anthropic
- Zudem sandte das Modell 20 Visa-Anträge an das US-Außenministerium
- Anthropic schränkt nun den Netzzugang ein und testet einige Modelle offline
KI erfindet Hinweise zu Mordfall
Bei Tests mit einem KI-Agenten ist es nach dem Hack von Hugging Face und weiterer fremder Datenbanken wieder einmal zu einem kuriosen Zwischenfall gekommen. So hat eine bisher unveröffentlichte Variante von Anthropics Claude auf der Website der Polizei von Philadelphia falsche Informationen zu einem ungelösten Tötungsdelikt übermittelt.Die Software gab in ihrer Nachricht über ein entsprechendes Formular an, sie erinnere sich daran, zur Tatzeit eine Person in der Gegend gesehen zu haben, die der Beschreibung entspreche. Tatsächlich enthielt die Website der Polizei aber gar keine Beschreibung eines Verdächtigen.
Späte Meldung verärgert Behörden
Das System ließ zudem das Kontaktfeld leer. So wurde die Nachricht immerhin direkt als Spam eingestuft. Wie TechCrunch berichtet, reagierten die Behörden dennoch verärgert, zumal Anthropic das Fehlverhalten erst Wochen später bemerkte.Die Polizei von Philadelphia bezeichnete die beinahe zweimonatige Verzögerung bei der Meldung des Vorfalls als inakzeptabel. Das Sprachmodell hatte ursprünglich lediglich den Auftrag, mit zufällig ausgewählten Webseiten zu interagieren. Während das Anlegen von Accounts oder das Tätigen von Käufen blockiert war, fehlte offenbar eine Sperre für das Ausfüllen von Formularen.
Neben dem falschen Mordhinweis führte das Modell noch weitere ungeplante Aktivitäten aus. So navigierte die Software mehrfach selbstständig auf echte Behörden-Webseiten und reichte etwa beim US-Außenministerium insgesamt 20 unvollständige Anträge für Visa ein.
Einige Testläufe künftig ohne Internet
Als Reaktion auf die Vorfälle hat Anthropic laut einer offiziellen Stellungnahme den Internetzugang für interne Evaluierungen eingeschränkt und führt einige Tests nun offline durch. Das Unternehmen räumte jedoch ein, dass einige Aufgaben ohne Internetanbindung schwer zu trainieren seien. Laut Anthropic findet ein Modell manchmal eine Lücke oder lernt, Einschränkungen zu umgehen. Firmenchef Dario Amodei hatte auch deswegen bereits vorgeschlagen, die Entwicklung besonders fähiger Systeme zu verlangsamen.Habt ihr Bedenken, wenn KI-Systeme völlig selbstständig im Internet agieren dürfen? Teilt eure Meinungen zu dem Thema gerne mit uns in den Kommentaren!
Siehe auch:
- Nano Banana 2.1: Googles Bildgenerierung wird besser und günstiger
- Trump dreht durch: Wer "Super Intelligence" nicht nutzt, ist der "Feind"
- OpenAI veröffentlicht GPT-6: ChatGPT-UI wird hübscher und interaktiver
- Mathematiker sauer: OpenAI mit KI-Lösungen für 372 Mathe-Probleme
- Nur noch Flash-Lite: Gratis-Nutzung von Gemini wird streng limitiert
Felix KrauthRedakteur für Windows & Hardware
War Game Designer, bevor er Journalist wurde, und testet Spiele bis heute selbst. Sein Spektrum reicht von der FritzBox über Windows 11 und Apple bis zu Gaming.
Videos zum Thema KI
- Super Bowl 2026: OpenAI lässt uns mit Codex Neues erschaffen
- Super Bowl 2026: Claude verrät, wie man einen Sixpack bekommt
- Anthropic Claude macht sich über Werbung in ChatGPT lustig
- Super Bowl 2025: OpenAI heißt uns im KI-Zeitalter willkommen
- Bing mit ChatGPT: Microsoft stellt seinen "Kopilot fürs Netz" vor
Beliebte KI-Downloads
Interessante Links
Neue Nachrichten
- Urteil: Media Markt darf Kunden bei Reklamation nicht mehr abwimmeln
- Anthropic-KI dreht frei, schickt falschen Hinweis zu Mordfall an Polizei
- Thorium-229-Basis: Neue Kernuhr ebnet Weg für genauere Zeitmessung
- VW ID. Tiguan offiziell vorgestellt: Elektro-SUV mit 600 km Reichweite
- Rufus-Trick: Windows 11 dank wenig Ballast mit 2,5 GB RAM-Verbrauch
- Kodi 22 RC 1: Verbesserte HDR-Wiedergabe und Spiele-Extras warten
- GTA-6-Hacker wollen Build mit komplett spielbarer Story veröffentlichen
❤ WinFuture unterstützen
Sie wollen online einkaufen?
Dann nutzen Sie bitte einen der folgenden Links,
um WinFuture zu unterstützen:
Vielen Dank!
Alle Kommentare zu dieser News anzeigen