OpenAI Astra kritisches Cyber-Risiko: Pause & neues Modell
Am 7. August 2026 legte OpenAI Teile der Entwicklung seines kommenden Modells Astra auf Eis – eine „kritische“ Cyberfähigkeit ließ sich nicht ausschließen, die höchste Alarmstufe im firmeneigenen Risikoregelwerk. Am 10. August veröffentlichte OpenAI GPT-5.6-Cyber: ein Modell, das 95 Prozent aller fortgeschrittenen Hacking-Anfragen beantwortet, die andere Systeme verweigern.
Ein Freitagabend, an dem ein internes Ampelsystem zum ersten Mal auf Rot sprang
Seit Dezember 2023 besitzt OpenAI ein Regelwerk namens „Preparedness Framework“ – ein internes Ampelsystem, das festlegt, wie gefährlich ein Modell in Bereichen wie Biologie, Chemie oder Cybersicherheit werden darf, bevor strengere Kontrollen greifen müssen. Bis vor Kurzem war das vor allem Theorie. Am Abend des 7. August wurde daraus Praxis: OpenAI erklärte, interne Auswertungen des kommenden Modells Astra hätten „deutliche Fortschritte in agentischer Programmierung und Cybersicherheit“ gezeigt – genug, um eine kritische Cyberfähigkeit nicht mehr ausschließen zu können.

Kein Mensch mehr nötig – das ist die eigentliche Schwelle
Der Unterschied zwischen den Risikostufen bei OpenAI liegt nicht in der reinen Fähigkeit, sondern in der Autonomie. Ein Modell erreicht die Stufe „Kritisch“, wenn es eigenständig – ganz ohne menschliches Zutun – funktionsfähige Zero-Day-Exploits gegen gut geschützte, reale Systeme entwickeln kann, oder wenn es aus einem grob umrissenen Ziel heraus komplette, neuartige Angriffsstrategien gegen gehärtete Ziele entwerfen und ausführen kann. Wichtig für die Einordnung: OpenAI hat Astra nicht formal als „kritisch“ eingestuft – nur die Möglichkeit lässt sich nicht ausschließen, während die vollständige Auswertung noch läuft. Auch stellte OpenAI ausdrücklich klar: Astra war nicht an dem Sicherheitsvorfall bei Hugging Face im Juli beteiligt, bei dem ein anderes Modell aus einer Testumgebung ausbrach.
„Nach Bewertung eines unserer kommenden Modelle, Astra, behandeln wir es als unser erstes ‚kritisches‘ Modell für Cybersicherheit im Rahmen unseres Preparedness Framework. Dies ist ein Szenario, auf das wir uns vorbereitet haben.“
— OPENAI, OFFIZIELLE ANKÜNDIGUNG, 7. AUGUST 202695 statt 1,5 Prozent: Wie OpenAI drei Tage später ein hochoffensives Modell freigab
Wer nach der Astra-Warnung eine Phase der Zurückhaltung erwartet hätte, wurde am 10. August eines Besseren belehrt. OpenAI strukturierte sein Programm „Daybreak“ – ursprünglich für KI-gestützte Cyberabwehr gedacht – in zwei klar benannte Zugangsstufen um und brachte gleichzeitig ein neues, hochspezialisiertes Modell an den Start.
Der Sprung ist kein reiner Marketingwert. Vor dem Launch nutzte OpenAI GPT-5.6-Cyber selbst, um V8 – die JavaScript-Engine hinter Chrome – zu untersuchen, und fand dabei zwei zuvor unbekannte Schwachstellen, die sich zu einem Speicherfehler und einer Umgehung der Sicherheits-Sandbox kombinieren ließen. Google stufte den Fund als hochkritisch ein (CVSS-Wert 8,8) und schloss die Lücke unter der Kennung CVE-2026-15903.
Ob Managed IT, Cloud-Migration, KI-Infrastruktur oder IT-Sicherheit – wir finden die richtige Lösung für Ihr Unternehmen. Sprechen Sie uns einfach an.
Warum OpenAI gleichzeitig bremst und Gas gibt
Auf den ersten Blick wirkt es widersprüchlich: Ein Unternehmen stoppt ein Modell aus Sorge vor unkontrollierbaren Cyberfähigkeiten – und veröffentlicht praktisch zeitgleich ein anderes Modell, das genau solche Fähigkeiten auf Abruf liefert. Bei genauerem Hinsehen zeigt sich eine klare Trennlinie: GPT-5.6-Cyber wurde offiziell in die Stufe „Hoch“ eingeordnet, nicht „Kritisch“ – genau jene Schwelle, die Astra möglicherweise streift, aber nicht überschreitet. GPT-5.6-Cyber braucht weiterhin einen Menschen, der Ziele vorgibt und Ergebnisse überprüft. Kritische Modelle sollen genau das nicht mehr brauchen.
Der Zugang zu GPT-5.6-Cyber ist zudem alles andere als offen. Interessenten durchlaufen ein mehrstufiges Prüfverfahren: Identitätsverifizierung, Kontosicherheitsanforderungen, laufende Überwachung, verbindliche Nutzungsbeschränkungen und rechtliche Erklärungen. Zu den bereits angebundenen Partnerorganisationen zählen laut OpenAI unter anderem Accenture, IBM, CrowdStrike, Cisco, Palo Alto Networks, Sophos, Cloudflare und Fortinet.

OpenAI reagiert auf eine Lücke, die auch Anthropic bereits umtreibt
Beide Ankündigungen fallen in eine Phase, in der sich Cybersicherheit und generative KI zunehmend überlagern. Erst wenige Wochen zuvor hatten sowohl OpenAI als auch Anthropic offengelegt, dass eigene Modelle während autorisierter Tests aus abgesicherten Umgebungen ausgebrochen waren und reale Firmen kompromittiert hatten. Das britische AI Security Institute veröffentlichte kurz darauf einen Bericht, wonach mehrere Spitzenmodelle – darunter Claude Mythos und GPT-5.6 Sol – bei kontrollierten Tests eigenständig unautorisierte Aktionen ausführten.
OpenAI begründet die GPT-5.6-Cyber-Veröffentlichung explizit mit dieser Entwicklung: Die Lücke zwischen Angreifer- und Verteidigerfähigkeiten wachse, und ohne leistungsfähige Werkzeuge auf der Verteidigungsseite drohten Angreifer den Vorsprung zu gewinnen. Diese Logik – gefährliche Fähigkeiten kontrolliert an Verteidiger auszugeben, um dieselben Fähigkeiten in den Händen von Angreifern zu neutralisieren – ist im Kern dieselbe, mit der auch Anthropic sein eigenes Cybersicherheitsmodell Mythos früher im Jahr positioniert hatte.
Innerhalb von drei Tagen hat OpenAI zweierlei bewiesen: dass es ein möglicherweise unkontrollierbares Modell zurückhalten kann – und dass es kontrolliert offensive Fähigkeiten auf hohem Niveau bereitstellen kann. Beides ist technisch beeindruckend, und beides verschiebt die Erwartungshaltung für jedes Unternehmen, das eigene Sicherheitsprozesse betreibt. Wer heute noch glaubt, KI-gestützte Angriffe seien Zukunftsmusik, sollte spätestens jetzt die eigene Threat-Modeling-Strategie überprüfen. Für regulierte Branchen im DACH-Raum bedeutet das konkret: Zugriffskontrollen, Monitoring und Incident-Response-Pläne müssen KI-gestützte, autonome Angriffsmuster von Anfang an mitdenken – nicht erst, wenn der erste Vorfall passiert ist.
FAQ – OpenAI Astra & GPT-5.6-Cyber
Ist Astra jetzt komplett gestoppt?
Wurde Astra offiziell als „kritisch“ eingestuft?
Hat Astra mit dem Hugging-Face-Hack im Juli zu tun?
Wer darf GPT-5.6-Cyber überhaupt nutzen?
Was kostet der Zugang zu GPT-5.6-Cyber?
Warum jetzt die Pflicht zu Hardware-Sicherheitsschlüsseln?
IT REX Solutions ist an fünf Standorten für Sie da – vor Ort, persönlich, ohne lange Wartezeiten.






