
| 0 | 0 |
OpenAI tritt bei seinem kommenden KI-Modell Astra zumindest teilweise auf die Bremse. Der Grund ist bemerkenswert: Interne Tests deuten darauf hin, dass das Modell im Bereich Cybersicherheit Fähigkeiten erreicht haben könnte, die OpenAI selbst als „kritisch“ einstuft. Deshalb werden bestimmte Entwicklungsarbeiten vorerst pausiert und die Sicherheitsmaßnahmen deutlich verschärft.
Astra könnte selbstständig Zero-Day-Lücken finden
OpenAI spricht davon, dass die bisherigen Ergebnisse eine Einstufung auf der höchsten Stufe des eigenen Preparedness Frameworks zumindest nicht mehr ausschließen lassen. Als „kritisch“ gilt ein KI-Modell dort unter anderem dann, wenn es selbstständig funktionierende Zero-Day-Exploits für besonders gut geschützte Systeme entwickeln oder komplexe Cyberangriffe von Anfang bis Ende mit nur sehr allgemeinen Vorgaben durchführen kann. Astra zeigt laut OpenAI deutliche Fortschritte bei agentischem Programmieren und Cybersecurity-Aufgaben.
Damit würde Astra deutlich über die bisher veröffentlichten OpenAI-Modelle hinausgehen. OpenAI nennt beispielsweise GPT-5.6 Sol, das bei entsprechenden Tests bislang lediglich die niedrigere Risikostufe „High“ erreicht habe.
OpenAI verschärft die Sicherheitsmaßnahmen
Für Astra gelten deshalb ab sofort strengere Regeln. Dazu gehören isolierte Testumgebungen, eingeschränkter Netzwerk- und Tool-Zugriff, zusätzliche Verschlüsselung und ein stärkerer Schutz der Modellgewichte. Außerdem werden sämtliche agentischen Anwendungen von Astra überwacht, um riskantes oder unerwartetes Verhalten möglichst früh zu erkennen.
OpenAI will das Modell außerdem gemeinsam mit Behörden und ausgewählten Organisationen aus dem Bereich KI-Sicherheit weiter testen. Einen konkreten Veröffentlichungstermin für Astra nennt das Unternehmen derzeit nicht.
Der Vorgang zeigt ziemlich deutlich, wie schnell sich die Fähigkeiten aktueller KI-Systeme entwickeln. Während stärkere Cybersecurity-Fähigkeiten beispielsweise dabei helfen könnten, Sicherheitslücken schneller aufzuspüren, könnten dieselben Fähigkeiten in falschen Händen eben auch ziemlich hässlich werden.
Quelle: OpenAI – Responding to the next frontier of critical cyber capabilities
