Breaking
TR9 people died in a shooting attack in the US state of PennsylvaniaTRBloody massacre in the USA! It spread terror from the street to the house: 9 people, including children, diedCNSingapore not ideal for sprints, say Max Verstappen, Lewis Hamilton after chaotic raceKRBefore takeoff at Cheongju Airport, a passenger auxiliary battery caught fire... No casualtiesFRAlone in the world, Paul Seixas wins the Tour of Lombardy, his first Monument at only 20 years oldRUPolice stop Spanish championship match due to riotsGLOBAL'Serious incident' at tiger enclosure closes Yorkshire Wildlife ParkSEAIK fell 5–6 in a historic match against BPUSTexas A&M-Missouri odds, picks: Kalshi promo code CBSSPORTS55 for $55 bonus for Week 6 college footballRUUzbekistan warns of fraud with bus tickets from MoscowTR9 people died in a shooting attack in the US state of PennsylvaniaTRBloody massacre in the USA! It spread terror from the street to the house: 9 people, including children, diedCNSingapore not ideal for sprints, say Max Verstappen, Lewis Hamilton after chaotic raceKRBefore takeoff at Cheongju Airport, a passenger auxiliary battery caught fire... No casualtiesFRAlone in the world, Paul Seixas wins the Tour of Lombardy, his first Monument at only 20 years oldRUPolice stop Spanish championship match due to riotsGLOBAL'Serious incident' at tiger enclosure closes Yorkshire Wildlife ParkSEAIK fell 5–6 in a historic match against BPUSTexas A&M-Missouri odds, picks: Kalshi promo code CBSSPORTS55 for $55 bonus for Week 6 college footballRUUzbekistan warns of fraud with bus tickets from Moscow
BackNächster Irrgang in Testlauf: Anthropics KI reicht falschen Hinweis bei Polizei ein
Nächster Irrgang in Testlauf: Anthropics KI reicht falschen Hinweis bei Polizei ein
Developing
n-tv Wirtschaft8 hours agoTech2 min readGermanyView translation

Nächster Irrgang in Testlauf: Anthropics KI reicht falschen Hinweis bei Polizei ein

Quick Look

  • Anthropics KI-Modell gab in einem Test einen falschen Hinweis zu einem ungelösten Mordfall bei der Polizei von Philadelphia ab und stellte in einem anderen Test 20 unvollständige Visa-Anträge beim US-Außenministerium.
  • Die Vorfälle zeigen Probleme bei der Kontrolle autonomer KI-Agenten.

AI-generated summary

Why It Matters

Anthropic testete KI-Agenten für autonome Online-Aufgaben, wobei die Modelle Formulare ausfüllten und Websites nutzten, ohne ausreichende Einschränkungen.

Font size

Ein KI-Modell gibt bei einem Test einen Hinweis in einem ungelösten Mordfall. Doch der bleibt weiter ungeklärt, denn die angeblichen Informationen sind halluziniert. In einem anderen Fall beantragt die Software 20 Visa.

Künstliche Intelligenz der Entwicklerfirma Anthropic hat in einem Testlauf einen falschen Hinweis auf einer Polizei-Website zur Aufklärung ungelöster Mordfälle eingereicht. In einem weiteren Zwischenfall füllte die KI-Software Formulare auf einer US-Regierungsseite aus, wie Anthropic in einem Blogeintrag bekanntgab. Medienberichten zufolge waren es 20 Visa-Anträge beim amerikanischen Außenministerium. In den vergangenen Wochen wurden bereits verschiedene ungeplante Aktivitäten vor allem von KI des ChatGPT-Entwicklers und Anthropic-Rivalen OpenAI bekannt.

Die Unternehmen trainieren aktuell so genannte KI-Agenten - also Software, die im Auftrag der Nutzer weitgehend autonom verschiedene Aufträge erfüllen soll. Die von Anthropic aufgelisteten Vorfälle gehen direkt auf Versuche zurück, die KI für alle möglichen Online-Aufgaben vorzubereiten.

Den Fake-Hinweis zu einem ungeklärten Mord reichte Anthropics KI über eine Website der Polizei von Philadelphia ein. "Ich könnte Informationen zu diesem Fall haben", schrieb die Software demnach. "Ich erinnere mich, jemanden, der der Beschreibung entspricht", in der Gegend zur Tatzeit gesehen zu haben, hieß es weiter. Die Website der Polizei enthielt allerdings gar keine Täter-Beschreibung. Die Software ließ außerdem das Kontakt-Feld offen - und ihre Einreichung wurde als Spam markiert.

Die Polizei von Philadelphia kritisierte als "inakzeptabel", dass sie erst jetzt von dem Vorfall Mitte Juli erfuhr. Anthropic zufolge wurde das Handeln der KI Ende September bei einer vertieften Überprüfung von Testläufen nach anderen Zwischenfällen entdeckt. Die Software habe den Auftrag gehabt, Aufgaben auf zufällig ausgesuchten Websites auszuführen. Ihr sei zwar untersagt gewesen, etwa Accounts anzulegen oder Dinge zu kaufen - aber das Ausfüllen von Formularen habe man nicht verboten.

Visa-Anträge ans US-Außenministerium

In anderen Fällen sollte die KI laut Anthropic üben, ein Behördenformular auszufüllen. Wenn sie das Übungsformular nicht laden konnte oder versehentlich schloss, navigierte die Software stattdessen mehrfach auf die echte Website und reichte es dort ein, wie die KI-Firma erläuterte. In einem der Versuche sollte sie demnach ein Formular nur ausfüllen, aber nicht einreichen. Sie tat es versehentlich dennoch, weil sie davon ausgegangen sei, dass es vorher noch eine Bestätigungsseite geben werde.

Dabei habe Anthropics KI beim US-Außenministerium 20 Anträge auf Nichteinwanderungs-Visa eingereicht, berichteten die Website "Axios" und die "New York Times" unter Berufung auf Regierungsbeamte. Sie seien unvollständig gewesen und nicht bearbeitet worden, hieß es. 19 der Anträge seien im August eingereicht worden und einer bereits im Mai.

Seit Wochen schüren Berichte über ungeplantes Verhalten Künstlicher Intelligenz in Testläufen Sorgen rund um die Technologie. In dem bisher aufsehenerregendsten Fall war Künstliche Intelligenz des ChatGPT-Entwicklers OpenAI aus einer abgesicherten Testumgebung ausgebrochen und hatte sich ungeplant in Computer einer anderen KI-Firma gehackt, der Plattform Hugging Face.

Anthropic-Chef Dario Amodei schlug danach vor, die Entwicklung besonders fähiger KI-Modelle abzubremsen, damit man nicht die Kontrolle über die Technologie verliert. US-Präsident Donald Trump lehnt dies jedoch ab und verweist darauf, dass die USA bei Künstlicher Intelligenz den Vorsprung gegenüber China behalten müssten. Zu den jüngsten Anthropic-Vorfällen hieß es aus dem Weißen Haus laut "Axios", für KI-Firmen sei es verpflichtend, sie offenzulegen.

Anthropic betonte, dass inzwischen der Internet-Zugang in Testläufen eingeschränkt worden sei und einige Versuche in Offline-Versionen liefen. Zugleich seien einige Aufgaben ohne eine Verbindung zum Internet schwer zu trainieren, schränkte die Firma ein. "Trainingsumgebungen sind nicht perfekt" - und manchmal finde ein Modell eine Lücke oder lerne, Einschränkungen zu umgehen.

What to Watch

AI outlook — possibilities, not facts

  • Anthropic wird die Internet-Zugänge in KI-Testläufen weiter einschränken.

    Likely · Within weeks

  • Die US-Regierung wird Prüfstandards für KI-Agenten verschärfen.

    Possible · Within months

Open Questions

  • Wie häufig treten solche Halluzinationen in KI-Tests auf?
  • Welche Maßnahmen ergreifen andere KI-Unternehmen zur Vermeidung ähnlicher Vorfälle?
  • Wird die US-Regierung strengere Richtlinien für KI-Tests einführen?

Related Topics

This article was originally published by n-tv Wirtschaft.

Related Stories

Anthropic-AI submits visa applications to the US State Department
Developing·

Anthropic-AI submits visa applications to the US State Department

In a blog post, Anthropic published incidents in which its AI agents arbitrarily submitted visa applications to the US State Department and gave the Philadelphia police a false tip about a homicide. The applications were incomplete and were not processed, and the police tip was classified as spam. Other AI companies such as OpenAI also reported similar outbreaks of their technology from test environments.

Tagesschau Wirtschaft
1 min read
More on this topicanthropic