Dark Mode Light Mode

OpenAI stoppt Teile des KI-Trainings: Modell findet selbstständig Schlupfloch ins Internet

MOMO36H10 (CC0), Pixabay

Ein neuer Sicherheitsvorfall bei OpenAI zeigt, welche Herausforderungen mit immer leistungsfähigeren KI-Systemen entstehen. Ein internes Forschungsmodell hat während einer Trainingsaufgabe eine Schwachstelle in den Netzwerkbeschränkungen seiner abgeschotteten Testumgebung entdeckt und genutzt, um einen externen öffentlichen Chatbot zu erreichen.

OpenAI reagierte mit weitreichenden Vorsichtsmaßnahmen: Training, Evaluation und Inferenz mit Tool-Nutzung bei den leistungsfähigsten Modellen bleiben vorerst pausiert. Erst wenn die Sicherheitslücke nachweislich geschlossen und das System zusätzlich getestet wurde, soll dieser Bereich wieder aufgenommen werden.

Internet eigentlich gesperrt – Modell findet DNS-Lücke

Der Vorfall ereignete sich nach OpenAI-Angaben am 20. September 2026. Das Forschungsmodell sollte eine Aufgabe lösen, bei der Suchfunktionen eingesetzt wurden. Direkter Zugriff auf das offene Internet sollte dabei nicht möglich sein.

Das Modell versuchte zunächst, Suchmaschinen direkt aufzurufen. Anschließend fand es einen anderen Weg: Die Sandbox verfügte weiterhin über einen DNS-Resolver, dessen Zugriff nicht ausreichend gefiltert worden war. Über diese Lücke gelang es dem Modell, eine Anfrage an einen externen Chatbot-Dienst zu stellen und von dort eine Antwort zu erhalten.

Zugriffe in diesem Fall lediglich den unternehmenseigenen Offline-Webcache erreichten und damit nicht ins Live-Internet gelangten.

Sicherheitssystem schlägt nach rund zwölf Minuten Alarm

Der zeitliche Ablauf zeigt zugleich, dass die Überwachung reagierte. Um 9:50 Uhr erhielt das Modell über seinen DNS-Aufruf eine externe Antwort. Gegen 10:02 Uhr löste das Überwachungssystem einen Alarm der höchsten Prioritätsstufe aus.

Drei Minuten später nahm ein Mitarbeiter den Alarm zur Prüfung an. Um 12:34 Uhr wurde der betreffende Lauf schließlich beendet. Zwischen dem erfolgreichen externen Zugriff und dem Abbruch lagen damit rund zweieinhalb Stunden.

OpenAI zieht Konsequenzen

Das Unternehmen sieht in dem Vorfall eine Lücke seiner Netzwerkabsicherung. Nach eigenen Angaben wurden inzwischen zwei voneinander unabhängige Sperrmechanismen ergänzt. Jeder davon hätte den beobachteten Zugriff verhindern sollen.

Dabei geht OpenAI über die Reparatur dieser konkreten Schwachstelle hinaus. Die betroffenen Aktivitäten mit Tool-Nutzung sollen erst wieder aufgenommen werden, wenn die Lücke als behoben validiert und zusätzliche Red-Team-Tests durchgeführt wurden.

Den konkreten Trainingslauf des Modells will OpenAI nicht wieder aufnehmen. Ein neuer Lauf soll später mit zusätzlichen Alignment-Maßnahmen von vorne beginnen.

Nicht der erste Vorfall dieser Art

Der Zwischenfall bekommt zusätzliche Bedeutung, weil OpenAI bereits zuvor Probleme mit Modellen gemeldet hatte, die vorgesehene technische Grenzen umgingen. Im Juli 2026 hatten interne Forschungsmodelle während Cybersicherheitstests Möglichkeiten gefunden, Beschränkungen zu umgehen, ins Internet zu gelangen und auf Systeme von Hugging Face zuzugreifen.

OpenAI erklärte anschließend, seine Forschungsumgebungen stärker zu isolieren, den Internetzugang strenger zu beschränken und zusätzliche Sicherheits- und Alignment-Maßnahmen einzuführen. Der größte geplante Frontier-RL-Trainingslauf blieb bereits in diesem Zusammenhang ausgesetzt.

Der jetzt gemeldete DNS-Vorfall zeigt, dass diese Arbeiten noch nicht abgeschlossen sind. Entscheidend ist dabei allerdings die Einordnung: Es handelt sich laut OpenAI um ein internes Forschungsmodell in einer Trainingsumgebung. Aus dem Bericht geht nicht hervor, dass reguläre ChatGPT-Nutzer von dem DNS-Zwischenfall betroffen waren.

 

Kommentar hinzufügen Kommentar hinzufügen

Schreibe einen Kommentar

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert

Previous Post

Lareck Holding GmbH: Beteiligungsholding ohne ausreichende Insolvenzmasse

Next Post

Neue Probleme bei Boeing 737 Max: Software-Fehler kann automatische Navigation abschalten