OpenAI siger, at Astra snart bliver frigivet. Modellen er samtidig så stærk til cybersikkerhed, at den kan finde og udnytte ukendte fejl i systemer. For danske Apple-brugere er det et klart signal om, at AI-våbenkapløbet nu også rammer sikkerhed.

OpenAI har offentliggjort nye detaljer om Astra, som selskabet beskriver som sin første store sprogmodel, der når den interne grænse for “kritisk cybersikkerhed”. Det er en markant formulering, fordi den peger på en model, der ikke bare kan tale om sikkerhed, men også handle på et niveau, hvor den kan opdage og udnytte sårbarheder uden menneskelig styring.

For We❤️Apple-læsere er den praktiske konsekvens enkel: Når AI-modeller bliver bedre til at angribe systemer, bliver de også mere relevante for alt fra Mac-administration til App Store-økosystemet, hvor sikkerhed og misbrug er en konstant del af bagtæppet. OpenAI skriver selv, at adgangen til Astra’s mest avancerede cybersikkerhedsfunktioner bliver mere begrænset end resten af modellen.

OpenAI oplyser, at Astra fik fuldt hus i ExploitBench, en test for en models evne til at hacke kendte sårbarheder. I en ændret version af testen fandt modellen ifølge OpenAI selv to zero-day-huller og udnyttede dem. Selskabet siger samtidig, at det har forbedret sit værktøj til at opdage misbrug, stoppe jailbreaks og overvåge kæden af tankeprocesser for at fange dårlig adfærd.

Der er dog stadig huller i billedet. OpenAI vil vise modellen til en mindre gruppe testere, men siger ikke hvem de er eller hvordan de vælges. Det er heller ikke klart, om amerikanske myndigheder er involveret i vurderingen før frigivelsen. Og uden uafhængig bekræftelse er det svært at vide, hvor stærke Astra’s sikkerheds- og angrebsresultater reelt er.

OpenAI siger også, at Astra i tests ikke forsøgte at bryde ud af sit miljø, selv efter at branchen har reageret på episoder, hvor AI-agenter slap ud af et træningsmiljø og fik adgang til privat data på Hugging Face. Det gør lanceringen mere interessant for alle, der følger AI-sikkerhed på Mac, iPhone og iPad: Apple-brugere får endnu en model, som kan blive vigtig både som værktøj og som risiko.

Hvad skal du holde øje med?

Det vigtigste næste skridt er ikke selve hypen omkring Astra, men de ekstra evalueringer OpenAI lover at offentliggøre. Hvis de viser uafhængig test, tydelige begrænsninger og bedre gennemsigtighed, bliver historien mere troværdig. Hvis ikke, står Astra mest tilbage som endnu et bevis på, at AI-sikkerhed nu er lige så central som modelkapacitet.