OpenAI detaljerer "kritisk" Astra-cybersikkerheds-AI-model forud for udgivelsesdatoen


OpenAI har officielt fremlagt nogle vigtige detaljer om sin kommende cybersikkerhedsmodel Astra AI. I et detaljeret blogindlæg, der blev delt i går, bekræftede AI-virksomheden, at Astra officielt nåede tærsklen for kritisk cybersikkerhedskapacitet. Modellen kan angiveligt finde ukendte sårbarheder og bygge exploit-kæder på tværs af hærdede systemer uden konstant menneskelig vejledning.

Astra er nu OpenAIs mest kapable cybermodel

Dette er ikke bare endnu et benchmark-spring for OpenAI. Virksomheden siger, at Astra kan finde tidligere ukendte sårbarheder og omsætte dem til fungerende exploit-kæder. I en intern test med 20 nylige sårbarheder med høj alvorlighedsgrad opnåede Astra langt højere kodeudførelsesrater end GPT-5.6 Sol. Den fandt også angiveligt to zero-day-sårbarheder under testen.

OpenAI siger, at eksperter så Astra kompromittere en hærdet browser og bryde ud af dens sandbox. Modellen kædede også sårbarheder i operativsystemet sammen for at bevæge sig fra en konto uden privilegier til root. Det er grunden til, at OpenAI har klassificeret Astra på det kritiske niveau. Det er den første model fra virksomheden, der får den betegnelse. Tidspunktet er interessant i betragtning af den seneste Hugging Face-hændelse.

OpenAI bemærker desuden, at det satte dele af Astras udvikling på pause, mens virksomheden styrkede træningsinfrastruktur, netværksisolering, overvågning og alignment-kontroller. Den 28. august genstartede virksomheden et stort træningsforløb med frontier reinforcement learning. Nogle mindre eksperimentelle træningskørsler forbliver midlertidigt sat på pause.

OpenAI placerer Astra bag tungere beskyttelsesforanstaltninger

OpenAI siger, at Astra afviser 91,5 % af cyber-jailbreak-anmodninger sammenlignet med 59 % for GPT-5.6 Sol. Virksomheden har også tilføjet stærkere overvågning af uautoriserede handlinger. I en simuleret honeypot-test forsøgte GPT-5.6 Sol at få adgang til omkringliggende mål 56 % af tiden.

Astra foretog ingen sådanne forsøg under disse testbetingelser. OpenAI siger, at modellen heller aldrig forsøgte at omgå auto-review efter at have modtaget en afvisning. Beskyttelsesforanstaltningerne kan dog skabe problemer for legitime sikkerhedsforskere. Nogle defensive opgaver kan blive forsinket, sat på pause eller stoppet, når systemer registrerer muligt misbrug.

Astras udgivelse starter med begrænset adgang

OpenAI siger, at Astra »kommer snart«, men modellens stærkeste cybersikkerhedsfunktioner vil først nå en lille gruppe alfatestere. Adgang via Daybreak Blue følger derefter og udvider den defensive brug inden for cybersikkerhed, mens OpenAI fortsætter med at finjustere sine beskyttelser. Apropos cybersikkerhedsmodeller har Anthropic også lanceret Fable 5.1 og Mythos 5.1.

Læsere hjælper med at støtte Windows Report. Når du foretager et køb ved at bruge links på vores site, kan vi tjene en affiliate-kommission. Tooltip Icon

Læs siden med affiliate offentliggørelse for at finde ud af, hvordan du kan hjælpe Windows Report ubesværet og uden at bruge nogen penge. Read more

User forum

0 messages