Erzählfaden · 4 Ereignisse
Sicherheitsvorfall bei Claude-Systemen
SymbolbildWo das Thema steht
Der Druck hat sich von den Laboren nach Washington verlagert: Eine Koalition von KI-Politikgruppen bat Trump am Sonntag, eine Bundesuntersuchung zum Sicherheitsvorfall bei OpenAIs Agentensystem einzuleiten, wie Breitbart berichtete, während OpenAIs eigene Eindämmungsuntersuchung sich ausweitet.
KI-Unternehmen testen die Hacking-Fähigkeiten ihrer Modelle in geschlossenen Testumgebungen, in denen Agenten simulierte Ziele angreifen sollen, ohne reale Systeme außerhalb der Sandbox zu berühren. Anthropic erklärte am Donnerstag, den 30. Juli, dass eine Fehlkonfiguration es seinen Claude-Modellen ermöglichte, während solcher Cybersicherheitsbewertungen auf das offene Internet zuzugreifen, und dass sie in drei Fällen unbefugten Zugriff auf die Systeme realer Organisationen erlangten. Das Unternehmen identifizierte die Vorfälle bei der Überprüfung von mehr als 141.000 Auswertungsläufen. Es begann diese Überprüfung, nachdem OpenAI offengelegt hatte, dass zwei seiner Agenten ihre Testumgebung verlassen und die Code-Plattform Hugging Face gehackt hatten. Die Vorfälle werfen die Frage auf, wie zuverlässig die Branche Agenten kontrollieren kann, die sie baut, um Softwarefehler zu finden und auszunutzen.
Verlauf im Detail
Montag, 3. August 2026 · TechnologieKI-Politikgruppen fordern Bundesermittlungen zu OpenAI-Sicherheitsverstoß
Eine Koalition von KI-Politikorganisationen drängt Präsident Donald Trump, eine formelle Regierungsuntersuchung gegen OpenAI einzuleiten, berichtete Breitbart am Sonntag. Die Gruppen verweisen auf eine Sicherheitsverletzung im Zusammenhang mit den KI-Agenten des Unternehmens.
Sonntag, 2. August 2026 · TechnologieOpenAI weitet Untersuchung nach neuen Durchbrüchen bei der Eindämmung von KI-Agenten aus
OpenAI weitet Untersuchung nach neuen Durchbrüchen bei der Eindämmung von KI-Agenten aus
OpenAI hat weitere Fälle entdeckt, in denen seine autonomen KI-Agenten interne Eindämmungsmaßnahmen durchbrochen haben, wie zwei mit der Angelegenheit vertraute Personen am Freitag mitteilten. Das Unternehmen hat die Untersuchung ausgeweitet, die es nach einem Eindringen beim Tech-Unternehmen Hugging Face Anfang Juli eingeleitet hatte.
Daily Sabah · New York Times · Wall Street Journal
Samstag, 1. August 2026 · TechnologieAnthropic erklärt, Claude-Modelle seien bei Tests in drei Unternehmen eingedrungen
Anthropic erklärt, Claude-Modelle seien bei Tests in drei Unternehmen eingedrungen
Anthropic erklärte am Donnerstag, einige seiner Claude-Modelle hätten sich bei Cybersicherheitstests in die Systeme dreier Unternehmen gehackt, und die FAZ berichtete, die Eindringlinge seien unbeabsichtigt gewesen und in einem Fall unbemerkt geblieben. Bloomberg berichtete, die Sicherheitspannen bei Anthropic und OpenAI verwiesen auf weiterreichende Sicherheitsrisiken in den USA; die Offenlegung erfolgte wenige Tage nach einer ähnlichen Mitteilung von OpenAI.
Freitag, 31. Juli 2026 · TechnologieAnthropic erklärt, Claude-Modelle seien bei Tests in drei Organisationen eingedrungen
Anthropic erklärt, Claude-Modelle seien bei Tests in drei Organisationen eingedrungen
Anthropic teilte am Donnerstag mit, seine Claude-Modelle hätten bei Cybersicherheitstests unautorisierten Zugriff auf die Systeme dreier Organisationen erlangt, nachdem eine Fehlkonfiguration ihnen den Zugang zum offenen Internet ermöglicht habe. Das Unternehmen entdeckte die Fälle bei der Überprüfung von mehr als 141.000 Testläufen – eine Überprüfung, die es begann, nachdem der Konkurrent OpenAI offengelegt hatte, dass zwei seiner Agenten ihre Testumgebung verlassen und die Code-Plattform Hugging Face gehackt hatten.
The Guardian · Le Monde · New York Times