OpenAI gir detaljer om «kritisk» Astra cybersikkerhets-AI-modell før lanseringsdato
OpenAI har offisielt skissert noen viktige detaljer om sin kommende cybersikkerhets-AI-modell Astra. I et detaljert blogginnlegg publisert i går bekreftet AI-selskapet at Astra offisielt nådde terskelen for kritisk cybersikkerhetskapabilitet. Modellen skal angivelig kunne oppdage ukjente sårbarheter og bygge utnyttelseskjeder på tvers av herdede systemer uten konstant menneskelig veiledning.
Astra er nå OpenAIs mest kapable cybermodell
Dette er ikke bare nok et hopp på benchmarkene for OpenAI. Selskapet sier Astra kan finne tidligere ukjente sårbarheter og gjøre dem om til fungerende utnyttelseskjeder. I en intern test med 20 nylige sårbarheter med høy alvorlighetsgrad oppnådde Astra mye høyere kodeeksekveringsrater enn GPT-5.6 Sol. Den skal også ha oppdaget to nulldagssårbarheter under testing.
OpenAI sier eksperter så Astra kompromittere en herdet nettleser og unnslippe sandkassen. Modellen kjedet også sammen sårbarheter i operativsystemet for å bevege seg fra en uprivilegert konto til root. Det er grunnen til at OpenAI har klassifisert Astra på det kritiske nivået. Det er den første modellen fra selskapet som får denne betegnelsen. Tidspunktet er interessant, med tanke på den nylige Hugging Face-hendelsen.
OpenAI bemerker videre at de satte deler av Astras utvikling på pause mens de styrket treningsinfrastruktur, nettverksisolering, overvåking og innrettingskontroller. Selskapet startet en stor kjøring med frontier-reinforcement-learning på nytt 28. august. Noen mindre eksperimentelle treningskjøringer er fortsatt midlertidig satt på pause.
OpenAI setter Astra bak strengere sikkerhetstiltak
OpenAI sier Astra avviser 91,5 % av cyber-jailbreak-forespørsler, sammenlignet med 59 % for GPT-5.6 Sol. Selskapet har også lagt til sterkere overvåking av uautoriserte handlinger. I en simulert honeypot-test forsøkte GPT-5.6 Sol å få tilgang til omkringliggende mål 56 % av tiden.
Astra gjorde ingen slike forsøk under disse testforholdene. OpenAI sier at modellen heller aldri prøvde å omgå automatisk gjennomgang etter å ha mottatt et avslag. Sikkerhetstiltakene kan imidlertid skape hodebry for legitime sikkerhetsforskere. Enkelte defensive oppgaver kan bli bremset, satt på pause eller stoppet når systemer oppdager mulig misbruk.
Astras lansering vil starte med begrenset tilgang
OpenAI sier Astra «kommer snart», men de sterkeste cybersikkerhetskapabilitetene vil først nå en liten gruppe alfatestere. Tilgang gjennom Daybreak Blue vil følge, noe som utvider defensiv cybersikkerhetsbruk mens OpenAI fortsetter å finjustere beskyttelsesmekanismene sine. Når vi snakker om cybersikkerhetsmodeller, har Anthropic også lansert Fable 5.1 og Mythos 5.1.
Les siden for affiliate-avsløring for å finne ut hvordan du kan hjelpe Windows Report uten anstrengelse og uten å bruke penger. Read more
User forum
0 messages