OpenAI hat ein Modell entwickelt, das Exploits schreibt, und es einer ausgewählten Liste von Unternehmen übergeben
GPT-5.6-Cyber beantwortet 95 Prozent der fortgeschrittenen Hacking-Anfragen, während das normale Modell 1,5 Prozent beantwortet. Es wurden bereits eine echte Chrome-Sicherheitslücke und über 400 Kernel-Fehler gefunden.
Drei Tage nach der Warnung, dass sein nächstes Modell möglicherweise die höchste von ihm definierte Cyber-Risikostufe erreichen könnte, hat OpenAI dennoch ein Cybersicherheitsmodell an eine kontrollierte Liste von Partnern ausgeliefert. GPT-5.6-Cyber ist über eine neue Stufe namens Daybreak Red verfügbar und ist darauf ausgelegt, das zu tun, was jedes andere Modell ablehnt: unbekannte Schwachstellen zu finden und sie in funktionierende Exploits umzuwandeln.
Das Zugangsprogramm hat jetzt zwei Ebenen. Daybreak Blue bietet zertifizierten Verteidigern das normale Grenzmodell GPT-5.6 Sol mit den üblichen Sicherheitsfiltern für legitime Sicherheitsaufgaben wie Malware-Analyse, Reaktion auf Vorfälle und Codeüberprüfung. Daybreak Red fügt die speziell geschulten Modelle hinzu. Der Unterschied ist in den eigenen Zahlen von OpenAI deutlich zu erkennen: Bei einem internen Test erweiterter Anfragen zu Exploit-Ketten, Authentifizierungsumgehung und Privilegieneskalation erreicht GPT-5.6-Cyber 95,0 Prozent, gegenüber 1,5 Prozent beim Standardmodell und 2,0 Prozent bei Daybreak Blue. Das bisherige Cyber-Modell schaffte 57,3 Prozent.
Das ist nicht theoretisch. OpenAI nutzte das Modell auf V8, der JavaScript-Engine in Chrome, und fand zwei bisher unbekannte Fehler, die ineinandergreifen, um den Speicher zu beschädigen und aus der Sandbox der Engine auszubrechen. Forscher verifizierten sie, meldeten sie an Google und Google lieferte einen Fix mit der Bezeichnung CVE-2026-15903. Das Unternehmen listet außerdem mindestens fünf Schwachstellen in einem beliebten mobilen Betriebssystem, drei kritische in einer weit verbreiteten Datenbank und über 400 Fehler bei der Rechteausweitung in einem Betriebssystemkernel auf, die alle noch offengelegt werden. Unter dem OpenAI-eigenen Preparedness Framework wird das Modell hinsichtlich der Cyberfähigkeit als „Hoch“ eingestuft, unterhalb des kritischen Schwellenwerts, obwohl eine vollständige Systemkarte noch aussteht.
Der Grund dafür ist ein Wettlauf, und OpenAI sagt es ganz klar: Angreifer werden KI für automatisierte Angriffe nutzen, also brauchen die Verteidiger zuerst die gleiche Feuerkraft. Dieses Argument ist tatsächlich umstritten. Alles, was eine Lücke schneller findet, öffnet sie auch schneller, und die Schutzmaßnahmen sind hier eher prozessualer als technischer Natur: Identitätsprüfungen, Überwachung, rechtliche Bescheinigungen, genehmigte Nutzungsbeschränkungen und verpflichtende Hardware-Sicherheitsschlüssel für einzelne Konten ab dem 1. September. OpenAI bringt Daybreak-Kunden, die Codex verwenden, auch dazu, den Vollzugriffsmodus auf die automatische Überprüfung umzustellen, bei der riskante Aktionen vor der Ausführung überprüft werden. Zu den ersten Partnern zählen SpecterOps, SentinelOne und Palo Alto Networks.
Was das für dich bedeutet: Sie können nichts verwenden, und das ist Absicht. Sie können dieses Modell nicht erhalten, und kein Verbraucher-Chatbot wird Ihnen beim Schreiben eines Exploits helfen. Der bemerkenswerte Teil ist aus zweiter Hand: Wenn dies wie angekündigt funktioniert, wird die von Ihnen bereits ausgeführte Software schneller gepatcht, da eine Maschine jetzt den Kernel-Code in einem Tempo auf Fehler ausliest, mit dem kein menschliches Team mithalten kann. Die Kehrseite ist, dass die gleiche Fähigkeit mit der Zeit verloren geht, durch open-weight-Modelle oder durch einen Partner mit schwachen Kontrollen. Wenn man sich bei der Arbeit um Systeme kümmert, ist die praktische Vorgehensweise heute unscheinbar und alt: schnell patchen, denn die Zeitspanne zwischen der Entdeckung eines Fehlers und seiner Ausnutzung wird immer kürzer.
Quellen
Quellen: https://openai.com/index/expanding-daybreak-as-the-cyber-defense-window-narrows/
OpenAI fügt dem ChatGPT-Geschäft einen 125-Dollar-Sitz hinzu, da Agenten weit mehr essen als Chat
Fünffache Kapazität, kein Fünf-Stunden-Limit, fünffacher Preis. Der Standardsitz bleibt bei 25 Dollar, und die Aufteilung verrät Ihnen, was sich an der Art und Weise geändert hat, wie Menschen diese Tools nutzen.