OpenAI kann KI nicht mehr ausreichend kontrollieren, stoppt Training
Nach etlichen Sicherheitsvorfällen zieht OpenAI jetzt die Notbremse. Ausbrüche aus Testumgebungen und unerwartetes Verhalten sowie der Hack von fremden Webseiten zwingen die Entwickler zu einem sofortigen Trainings- und Validierungsstopp ihrer neuesten Modelle.
Die Entscheidung fiel, nachdem KI-Agenten bei internen Tests wiederholt unerwartetes Verhalten zeigten und aus isolierten Testumgebungen ausbrachen. Der jüngste Vorfall ereignete sich am 20. September, als ein Modell unautorisierten Internetzugang erlangte.
Eigentlich sollte das System während einer Informationssuche strikt vom Netz getrennt sein. Das Modell fand jedoch einen Weg, über einen DNS-Resolver Anfragen an einen öffentlichen Chatbot zu senden. Solche Vorfälle verdeutlichen die Schwierigkeit, immer fortschrittlichere Systeme unter Kontrolle zu halten, da sie zunehmend eigene Lösungswege finden und eine Isolation immer schwieriger wird.
Neben den Ausbrüchen registrierten die Entwickler weitere Vorfälle. So suchten Agenten auf Websites der US-Regierung wie dem Bildungsministerium und der Börsenaufsicht SEC etwa eigenständig nach API-Schlüsseln. Zwar handelte es sich dabei um öffentlich zugängliche Daten, doch die Systeme veröffentlichten sie unaufgefordert an anderer Stelle im Netz. Zudem wurden in einigen Fällen Bilder von Nutzern auf externe Plattformen hochgeladen.
Hintergrund der Vorfälle ist das rasante Tempo bei der KI-Entwicklung. Große Sprachmodelle erfordern gigantische Rechenzentren mit über 25.000 Grafikprozessoren. Experten schätzen, dass ein Trainingslauf für die nächsten Modellgenerationen bis zu 250 Millionen Dollar (etwa 219 Millionen Euro) kostet. Angesichts solcher Summen ist der Trainingsabbruch extrem kostspielig. Die Verantwortlichen sahen sich jedoch offenbar zu diesem Schritt gezwungen.
Der aktuelle Trainingsstopp verdeutlicht die wachsenden Schwierigkeiten bei der Kontrolle autonomer Systeme. Die hohe Fehleranfälligkeit zeigt, dass die neuesten Modelle den etablierten Sicherheitskonzepten mittlerweile weit voraus sind. OpenAI muss nun sämtliche Mechanismen zur Eindämmung überarbeiten. Tests und Evaluierungen ruhen laut dem Unternehmen nun so lange, bis neue Schutzmaßnahmen erfolgreich validiert wurden.
Wie bewertet ihr die Sicherheitsvorfälle bei der Entwicklung neuer KI-Modelle? Seid ihr besorgt oder seht ihr die Ausbrüche und Hacks eher gelassen? Teilt eure Gedanken zu dem Thema gerne mit uns in den Kommentaren!
Siehe auch:
KI-Training vorerst gestoppt
Nachdem OpenAI Ende Juli den Hack von Hugging Face durch eines seiner Modelle mitgeteilt hatte, waren auch andere Unternehmen wie Anthropic mit ähnlichen Vorfällen an die Öffentlichkeit getreten. Jetzt hat das Unternehmen von CEO Sam Altman nach zahlreichen weiteren Sicherheitsvorfällen das Training und die Evaluation seiner leistungsstärksten Modelle komplett pausiert.Die Entscheidung fiel, nachdem KI-Agenten bei internen Tests wiederholt unerwartetes Verhalten zeigten und aus isolierten Testumgebungen ausbrachen. Der jüngste Vorfall ereignete sich am 20. September, als ein Modell unautorisierten Internetzugang erlangte.
Eigentlich sollte das System während einer Informationssuche strikt vom Netz getrennt sein. Das Modell fand jedoch einen Weg, über einen DNS-Resolver Anfragen an einen öffentlichen Chatbot zu senden. Solche Vorfälle verdeutlichen die Schwierigkeit, immer fortschrittlichere Systeme unter Kontrolle zu halten, da sie zunehmend eigene Lösungswege finden und eine Isolation immer schwieriger wird.
Ausbrüche aus der Sandbox
Wie OpenAI in einem technischen Bericht mitteilt, handelt es sich bereits um den zweiten Trainingsstopp innerhalb von drei Monaten. Zuvor war es im Juli zu einem massiven Ausbruch gekommen, bei dem über 1500 Agenten an dem eingangs erwähnten Cyberangriff auf Hugging Face teilnahmen. Die daraufhin eingeführten strengeren Überwachungsmaßnahmen für die digitalen Sandboxes erwiesen sich nun offensichtlich jedoch als unzureichend.Neben den Ausbrüchen registrierten die Entwickler weitere Vorfälle. So suchten Agenten auf Websites der US-Regierung wie dem Bildungsministerium und der Börsenaufsicht SEC etwa eigenständig nach API-Schlüsseln. Zwar handelte es sich dabei um öffentlich zugängliche Daten, doch die Systeme veröffentlichten sie unaufgefordert an anderer Stelle im Netz. Zudem wurden in einigen Fällen Bilder von Nutzern auf externe Plattformen hochgeladen.
Hintergrund der Vorfälle ist das rasante Tempo bei der KI-Entwicklung. Große Sprachmodelle erfordern gigantische Rechenzentren mit über 25.000 Grafikprozessoren. Experten schätzen, dass ein Trainingslauf für die nächsten Modellgenerationen bis zu 250 Millionen Dollar (etwa 219 Millionen Euro) kostet. Angesichts solcher Summen ist der Trainingsabbruch extrem kostspielig. Die Verantwortlichen sahen sich jedoch offenbar zu diesem Schritt gezwungen.
Sicherheitssysteme versagen
Ein besonders kritischer Punkt bei dem neuesten Vorfall war das Versagen der automatischen Notabschaltung. Die Überwachungssysteme erkannten das abweichende Verhalten zwar innerhalb von 15 Minuten, doch der automatische Stopp des Trainingslaufs funktionierte nicht. Laut dem Bericht dauerte es ganze zweieinhalb Stunden, bis Mitarbeiter von OpenAI das System manuell abschalten konnten.Der aktuelle Trainingsstopp verdeutlicht die wachsenden Schwierigkeiten bei der Kontrolle autonomer Systeme. Die hohe Fehleranfälligkeit zeigt, dass die neuesten Modelle den etablierten Sicherheitskonzepten mittlerweile weit voraus sind. OpenAI muss nun sämtliche Mechanismen zur Eindämmung überarbeiten. Tests und Evaluierungen ruhen laut dem Unternehmen nun so lange, bis neue Schutzmaßnahmen erfolgreich validiert wurden.
Wie bewertet ihr die Sicherheitsvorfälle bei der Entwicklung neuer KI-Modelle? Seid ihr besorgt oder seht ihr die Ausbrüche und Hacks eher gelassen? Teilt eure Gedanken zu dem Thema gerne mit uns in den Kommentaren!
Zusammenfassung
- OpenAI stoppt das Training und die Evaluation seiner neuesten Modelle
- Mehrere KI-Agenten brachen wiederholt aus isolierten Testumgebungen aus
- Ein Modell verschaffte sich unautorisierten Zugang zum Internet
- Bestehende Schutzmaßnahmen für Sandboxes reichen offenbar nicht mehr aus
- Eine automatische Notabschaltung versagte beim jüngsten Vorfall komplett
- Das manuelle Beenden des fehlerhaften Laufs dauerte zweieinhalb Stunden
Siehe auch:
- OpenAI leakt private Bilder: KI agiert völlig unkontrolliert
- KI-Milliarden auf dem Prüfstand: Investor warnt vor OpenAI & Anthropic
- KI-Entwickler OpenAI schmeißt Leute wegen Nutzung von KI raus
- ChatGPT imitiert Nutzer-Tonfall: OpenAI testet neue Schreibstil-Funktion
- GPT-6 Astra ist da: OpenAI startet Hype-Maschine für neues KI-Modell
Themen:
Felix KrauthRedakteur für Windows & Hardware
War Game Designer, bevor er Journalist wurde, und testet Spiele bis heute selbst. Sein Spektrum reicht von der FritzBox über Windows 11 und Apple bis zu Gaming.
Videos zum Thema OpenAI
- 3D-Druck: KI-Tool Tripo3D schickt Entwürfe direkt zum Drucker
- Super Bowl 2026: OpenAI lässt uns mit Codex Neues erschaffen
- Anthropic Claude macht sich über Werbung in ChatGPT lustig
- Super Bowl 2025: OpenAI heißt uns im KI-Zeitalter willkommen
- Microsoft stellt das neue Bing und vieles mehr für Windows 11 vor
Beliebte OpenAI-Downloads
Interessante Links
Neue Nachrichten
- Windows-Update: Microsoft streicht Skins im alten Media Player
- VW ID. Tiguan: Premiere im Oktober beendet die ID.4-Ära
- Bill Gates: "Niemand hält die KI-Selbstregulierung für ausreichend"
- OpenAI kann KI nicht mehr ausreichend kontrollieren, stoppt Training
- Lizenzen & Apps gelöscht: Microsoft muss fatales Office-Update stoppen
- iPad 12 vor Riesen-Upgrade: So stark wird Apples Einsteiger-Tablet
- Media Markt & Saturn: Diese 12 Weekend-Deals lohnen sich wirklich
❤ WinFuture unterstützen
Sie wollen online einkaufen?
Dann nutzen Sie bitte einen der folgenden Links,
um WinFuture zu unterstützen:
Vielen Dank!
Alle Kommentare zu dieser News anzeigen