OpenAI detaljerar "kritisk" Astra cybersäkerhets-AI-modell inför releasedatum
OpenAI har officiellt redogjort för några viktiga detaljer om sin kommande cybersäkerhetsmodell Astra AI. I ett detaljerat blogginlägg som publicerades i går bekräftade AI-företaget att Astra officiellt nådde sin kritiska tröskelnivå för cybersäkerhetskapacitet. Modellen kan enligt uppgift upptäcka okända sårbarheter och bygga exploitkedjor över härdade system utan ständig mänsklig vägledning.
Astra är nu OpenAIs mest kapabla cybermodell
Det här är inte bara ännu ett benchmarksprång för OpenAI. Företaget säger att Astra kan hitta tidigare okända sårbarheter och omvandla dem till fungerande exploitkedjor. I ett internt test med 20 färska sårbarheter med hög allvarlighetsgrad uppnådde Astra betydligt högre andel kodexekveringar än GPT-5.6 Sol. Den ska också ha upptäckt två zero-day-sårbarheter under testerna.
OpenAI säger att experter såg Astra kompromettera en härdad webbläsare och ta sig ur dess sandlåda. Modellen kedjade också ihop sårbarheter i operativsystemet för att ta sig från ett konto utan privilegier till root. Det är därför OpenAI har klassificerat Astra på den kritiska nivån. Det är den första modellen från företaget som får den beteckningen. Tidpunkten är intressant med tanke på den senaste Hugging Face-incidenten.
OpenAI noterar vidare att företaget pausade delar av Astras utveckling samtidigt som man stärkte träningsinfrastruktur, nätverksisolering, övervakning och anpassningskontroller. Företaget återstartade en stor körning för frontier-förstärkningsinlärning den 28 augusti. Några mindre experimentella träningskörningar är fortfarande tillfälligt pausade.
OpenAI placerar Astra bakom starkare skyddsåtgärder
OpenAI säger att Astra avvisar 91,5 procent av cyber-jailbreak-förfrågningar, jämfört med 59 procent för GPT-5.6 Sol. Företaget har också lagt till starkare övervakning av obehöriga åtgärder. I ett simulerat honeypot-test försökte GPT-5.6 Sol få åtkomst till omgivande mål 56 procent av tiden.
Astra gjorde inga sådana försök under dessa testförhållanden. OpenAI säger att modellen inte heller försökte kringgå automatisk granskning efter att ha fått ett avslag. Skyddsåtgärderna kan dock skapa huvudbry för legitima säkerhetsforskare. Vissa defensiva uppgifter kan fördröjas, pausas eller stoppas när system upptäcker möjligt missbruk.
Astras lansering inleds med begränsad åtkomst
OpenAI säger att Astra ”kommer snart”, men dess starkaste cybersäkerhetsfunktioner kommer inledningsvis att nå en liten grupp alfatestare. Åtkomst via Daybreak Blue följer sedan, vilket utökar den defensiva cybersäkerhetsanvändningen medan OpenAI fortsätter att finjustera sina skydd. På tal om cybersäkerhetsmodeller har Anthropic också lanserat Fable 5.1 och Mythos 5.1.
Läs sidan för affiliate avslöjande för att ta reda på hur du kan hjälpa Windows Report utan ansträngning och utan att spendera några pengar. Read more
User forum
0 messages