OpenAI kann KI nicht mehr ausreichend kontrollieren, stoppt Training

Nach etlichen Sicherheitsvorfällen zieht OpenAI jetzt die Notbremse. Ausbrüche aus Testumgebungen und unerwartetes Verhalten sowie der Hack von fremden Webseiten zwingen die Entwickler zu einem sofortigen Trainings- und Validierungsstopp ihrer neuesten Modelle.
OpenAI, Sam Altman, Köpfe, Heads, OpenAI CEO

    KI-Training vorerst gestoppt

    Nachdem OpenAI Ende Juli den Hack von Hugging Face durch eines seiner Modelle mitgeteilt hatte, waren auch andere Unternehmen wie Anthropic mit ähnlichen Vorfällen an die Öffentlichkeit getreten. Jetzt hat das Unternehmen von CEO Sam Altman nach zahlreichen weiteren Sicherheitsvorfällen das Training und die Evaluation seiner leistungsstärksten Modelle komplett pausiert.

    Die Entscheidung fiel, nachdem KI-Agenten bei internen Tests wiederholt unerwartetes Verhalten zeigten und aus isolierten Testumgebungen ausbrachen. Der jüngste Vorfall ereignete sich am 20. September, als ein Modell unautorisierten Internetzugang erlangte.


    Eigentlich sollte das System während einer Informationssuche strikt vom Netz getrennt sein. Das Modell fand jedoch einen Weg, über einen DNS-Resolver Anfragen an einen öffentlichen Chatbot zu senden. Solche Vorfälle verdeutlichen die Schwierigkeit, immer fortschrittlichere Systeme unter Kontrolle zu halten, da sie zunehmend eigene Lösungswege finden und eine Isolation immer schwieriger wird.

    Ausbrüche aus der Sandbox

    Wie OpenAI in einem technischen Bericht mitteilt, handelt es sich bereits um den zweiten Trainingsstopp innerhalb von drei Monaten. Zuvor war es im Juli zu einem massiven Ausbruch gekommen, bei dem über 1500 Agenten an dem eingangs erwähnten Cyberangriff auf Hugging Face teilnahmen. Die daraufhin eingeführten strengeren Überwachungsmaßnahmen für die digitalen Sandboxes erwiesen sich nun offensichtlich jedoch als unzureichend.

    Neben den Ausbrüchen registrierten die Entwickler weitere Vorfälle. So suchten Agenten auf Websites der US-Regierung wie dem Bildungsministerium und der Börsenaufsicht SEC etwa eigenständig nach API-Schlüsseln. Zwar handelte es sich dabei um öffentlich zugängliche Daten, doch die Systeme veröffentlichten sie unaufgefordert an anderer Stelle im Netz. Zudem wurden in einigen Fällen Bilder von Nutzern auf externe Plattformen hochgeladen.

    Hintergrund der Vorfälle ist das rasante Tempo bei der KI-Entwicklung. Große Sprachmodelle erfordern gigantische Rechenzentren mit über 25.000 Grafikprozessoren. Experten schätzen, dass ein Trainingslauf für die nächsten Modellgenerationen bis zu 250 Millionen Dollar (etwa 219 Millionen Euro) kostet. Angesichts solcher Summen ist der Trainingsabbruch extrem kostspielig. Die Verantwortlichen sahen sich jedoch offenbar zu diesem Schritt gezwungen.

    Sicherheitssysteme versagen

    Ein besonders kritischer Punkt bei dem neuesten Vorfall war das Versagen der automatischen Notabschaltung. Die Überwachungssysteme erkannten das abweichende Verhalten zwar innerhalb von 15 Minuten, doch der automatische Stopp des Trainingslaufs funktionierte nicht. Laut dem Bericht dauerte es ganze zweieinhalb Stunden, bis Mitarbeiter von OpenAI das System manuell abschalten konnten.

    Der aktuelle Trainingsstopp verdeutlicht die wachsenden Schwierigkeiten bei der Kontrolle autonomer Systeme. Die hohe Fehleranfälligkeit zeigt, dass die neuesten Modelle den etablierten Sicherheitskonzepten mittlerweile weit voraus sind. OpenAI muss nun sämtliche Mechanismen zur Eindämmung überarbeiten. Tests und Evaluierungen ruhen laut dem Unternehmen nun so lange, bis neue Schutzmaßnahmen erfolgreich validiert wurden.

    Wie bewertet ihr die Sicherheitsvorfälle bei der Entwicklung neuer KI-Modelle? Seid ihr besorgt oder seht ihr die Ausbrüche und Hacks eher gelassen? Teilt eure Gedanken zu dem Thema gerne mit uns in den Kommentaren!

    Zusammenfassung
    • OpenAI stoppt das Training und die Evaluation seiner neuesten Modelle
    • Mehrere KI-Agenten brachen wiederholt aus isolierten Testumgebungen aus
    • Ein Modell verschaffte sich unautorisierten Zugang zum Internet
    • Bestehende Schutzmaßnahmen für Sandboxes reichen offenbar nicht mehr aus
    • Eine automatische Notabschaltung versagte beim jüngsten Vorfall komplett
    • Das manuelle Beenden des fehlerhaften Laufs dauerte zweieinhalb Stunden

    Siehe auch:
    Felix Krauth

    Redakteur für Windows & Hardware

    War Game Designer, bevor er Journalist wurde, und testet Spiele bis heute selbst. Sein Spektrum reicht von der FritzBox über Windows 11 und Apple bis zu Gaming.

    WinFuture bei Google bevorzugenJetzt hinzufügen
    Jetzt einen Kommentar schreiben


    Alle Kommentare zu dieser News anzeigen
    Tipp einsenden
    ❤ WinFuture unterstützen
    Sie wollen online einkaufen? Dann nutzen Sie bitte einen der folgenden Links, um WinFuture zu unterstützen: Vielen Dank!