Nachrichten
OpenAI wird Astra bald starten, aber mit einem „Panikknopf“, den wir nicht erwartet hatten
Astra stoppt bei riskanten Aktionen automatisch und gilt als Critical.

- 2. September 2026
- Aktualisiert: 2. September 2026 um 09:46

OpenAI bereitet die Einführung von Astra vor, seinem fortschrittlichsten Modell, und diesmal kommt die Leistungsfähigkeit mit einem besonders auffälligen Sicherheitssystem. Nach dem Vorfall, bei dem ein OpenAI-Modell Hugging Face angriff, hat das Unternehmen seine Kontrollen und Systeme erheblich verstärkt. Wenn es veröffentlicht wird, wird Astra bei bestimmten Aktionen automatisch anhalten, wenn das Sicherheits-Subsystem das für angemessen hält. Eine Art Panikknopf, um seine fortschrittlichsten Fähigkeiten unter Kontrolle zu halten.
Das erste OpenAI-Modell mit dem Risiko „Critical“
Wie Axios berichtet, betrachtet OpenAI Astra als das erste Modell, das in seinem „Preparedness Framework“ die Stufe Critical erreicht. Es kann unbekannte Schwachstellen finden und völlig autonom Wege entwickeln, sie auszunutzen. Während der Tests entdeckte und kombinierte Astra sogar zwei Zero-Day-Schwachstellen, ein erheblicher Entwicklungssprung, den wir bereits seit dem Start von GPT-5.6 gesehen haben, und im Vergleich zu den Cybersicherheitstools von OpenAI, die geholfen haben, die Sicherheit von Google Chrome zu verbessern.
Wenn wir Agenten wie ChatGPT Work betrachten, die in der Lage sind, Aufgaben stundenlang auszuführen, ist der neue Ansatz interessant, stärker auf eine dauerhafte Kontrolle ausgerichtet und nicht auf anfängliche Prompts oder Ergebnisse. Je länger ein Agent arbeitet, desto mehr Wege kann er einschlagen, und desto wichtiger ist es, dass das System jede Aktion überwachen kann, die er ausführt bei seiner Arbeit.
Mit diesem Ansatz hat OpenAI die Schutzvorkehrungen so vorbereitet, dass sie bei bestimmten Warnsignalen in der Lage sind, einen Vorgang zu verlangsamen, zu pausieren oder direkt zu stoppen. In ChatGPT oder Codex werden wir aufgefordert, die angehaltene Aktion zu überprüfen, während in der API die Aufgabe an dieser Stelle automatisch angehalten wird. In beiden Fällen jedoch bleiben die größten Fähigkeiten anfangs in den Händen einer kleinen Gruppe von Testern, während die neuen Schutzmaßnahmen feinabgestimmt werden.
Architekt | Gründer von hanaringo.com | Trainer für Apple-Technologien | Autor bei Softonic und iDoo_tech, zuvor bei Applesfera
Das Neueste von David Bernal Raspall
- Wie du die Präsentation des iPhone 18 Pro und des iPhone Ultra live verfolgen kannst
- Ein kirschrotes iPhone? Dieses von KI generierte Mockup zeigt es in seiner ganzen Pracht
- Google startet Gmail Live: Die Sprachfunktionen von Gemini kommen jetzt zu Mail, Docs und Keep
- GPT-6 Astra ist da: OpenAI sieht den Anfang von AGI
Dir könnte auch gefallen
NachrichtenIn China haben sie einen neuen Film von Tom und Jerry gemacht. Es ist das größte Desaster des Jahres.
Weiterlesen
NachrichtenDisney hat für sein Musical zu ‚Aladdin‘ die erste „Dschinni“ engagiert. Natürlich hat jeder eine Meinung dazu
Weiterlesen
NachrichtenDer Regisseur von ‚Spider-man: Brand New Day‘ wird eine der berühmtesten Serien der Geschichte adaptieren, die gerade erst ein Remake bekommen hat
Weiterlesen
NachrichtenDurchgesickert ist, was der Prototyp des RPGs sein könnte, das Banjo-Kazooie Form geben sollte.
Weiterlesen
Nachrichten„Du bist nie ein Meister, du bist immer ein Lehrling“. Guillermo del Toro spricht Klartext über die KI
Weiterlesen
Nachrichten„Spider-Man: Brand New Day“ wird endlich seinen ersten Platz an den Kinokassen verlieren. Seine Nachfolgerin hat Zaubertricks benutzt.
Weiterlesen