OpenAI deelt details over “kritiek” Astra-cybersecurity-AI-model voor de releasedatum


OpenAI heeft officieel een aantal belangrijke details uiteengezet over zijn aankomende cybersecurity-AI-model Astra. In een uitgebreide blogpost die gisteren is gedeeld, bevestigde het AI-bedrijf dat Astra officieel de drempel voor kritieke cybersecuritycapaciteiten heeft bereikt. Het model kan naar verluidt onbekende beveiligingslekken ontdekken en exploitketens bouwen op geharde systemen zonder voortdurende menselijke begeleiding.

Astra is nu OpenAI’s krachtigste cybermodel

Dit is niet zomaar een benchmarksprong voor OpenAI. Het bedrijf zegt dat Astra voorheen onbekende kwetsbaarheden kan vinden en kan omzetten in werkende exploitketens. In een interne test met 20 recente kwetsbaarheden met een hoge ernst behaalde Astra veel hogere code-executiepercentages dan GPT-5.6 Sol. Het zou tijdens het testen ook twee zero-daykwetsbaarheden hebben ontdekt.

OpenAI zegt dat experts zagen hoe Astra een geharde browser compromitteerde en uit zijn sandbox ontsnapte. Het model koppelde ook kwetsbaarheden in het besturingssysteem aan elkaar om van een account zonder privileges naar root te gaan. Daarom heeft OpenAI Astra op het kritieke niveau geclassificeerd. Het is het eerste model van het bedrijf dat die aanduiding krijgt. De timing is interessant, gezien het recente incident bij Hugging Face.

OpenAI merkt verder op dat het delen van Astra’s ontwikkeling heeft gepauzeerd terwijl het de trainingsinfrastructuur, netwerkisolatie, monitoring en alignmentcontroles versterkte. Het bedrijf hervatte op 28 augustus een grote frontier reinforcement-learningrun. Sommige kleinere experimentele trainingsruns blijven tijdelijk gepauzeerd.

OpenAI plaatst Astra achter zwaardere beveiligingsmaatregelen

OpenAI zegt dat Astra 91,5% van de cyberjailbreakverzoeken weigert, vergeleken met 59% voor GPT-5.6 Sol. Het bedrijf heeft ook strengere monitoring voor ongeautoriseerde acties toegevoegd. In een gesimuleerde honeypottest probeerde GPT-5.6 Sol in 56% van de gevallen toegang te krijgen tot omliggende doelen.

Astra deed onder die testomstandigheden geen dergelijke pogingen. OpenAI zegt dat het model ook nooit probeerde de automatische beoordeling te omzeilen na een afwijzing. De beveiligingsmaatregelen kunnen echter hoofdpijn opleveren voor legitieme beveiligingsonderzoekers. Sommige defensieve taken kunnen worden vertraagd, gepauzeerd of gestopt wanneer systemen mogelijk misbruik detecteren.

De release van Astra begint met beperkte toegang

OpenAI zegt dat Astra “binnenkort beschikbaar” is, maar de sterkste cybersecuritycapaciteiten zullen in eerste instantie bij een kleine groep alfatesters terechtkomen. Toegang via Daybreak Blue volgt daarna, waardoor defensief cybersecuritygebruik wordt uitgebreid terwijl OpenAI de beveiligingen blijft afstemmen. Nu we het toch over cybersecuritymodellen hebben, heeft Anthropic ook Fable 5.1 en Mythos 5.1 gelanceerd.

Lezers helpen Windows Report te ondersteunen. Wanneer u een aankoop doet via links op onze site, kunnen we een affiliate commissie verdienen. Tooltip Icon

Lees de pagina met affiliate onthullingen om erachter te komen hoe u Windows Report moeiteloos en zonder geld uit te geven kunt helpen. Read more

User forum

0 messages