REKLAME
EGW-NewsOpenAI’s GPT-6 Astra har netop overskredet en grænse, som ingen før har overskredet
OpenAI’s GPT-6 Astra har netop overskredet en grænse, som ingen før har overskredet
311
Add as a Preferred Source
0
0

OpenAI’s GPT-6 Astra har netop overskredet en grænse, som ingen før har overskredet

OpenAI står over for et nyt problem, som virksomheden selv har skabt: en model, der er så dygtig til at hacke, at virksomheden har været nødt til at udvikle et nyt sikkerhedsniveau udelukkende for at holde den i skak. Den 1. september meddelte OpenAI, at den kommende model Astra er det første system, virksomheden nogensinde har klassificeret som »Kritisk« med hensyn til cybersikkerhed i henhold til sit Preparedness Framework – det øverste trin på en skala, der tidligere kun gik op til »Høj«. To dage senere, den 3. september, begyndte virksomheden at udrulle Astra i faser, startende med godkendte sikkerhedseksperter, inden den når ud til ChatGPT Plus-, Pro-, Business- og Enterprise-brugere via API'en og AWS.

For de fleste brancher er dette en abstrakt historie om styring. For kryptoverdenen er det ikke. Smarte kontrakter opbevarer midlerne direkte. Broer flytter dem på tværs af kæder. Wallets beskytter nøglerne. Når der er en fejl i koden, er afstanden mellem »sårbarhed« og »stjålne penge« ofte en enkelt transaktion — ingen sikkerhedsbarriere, ingen bank at ringe til, ingen tilbageførsel. En model, der finder fejl hurtigere end mennesker, er pr. definition en model, der ændrer regnestykket på begge sider af den ligning.

Hvad gjorde Astra egentlig?

OpenAI’s egne tal er overskriften her. Astra opnåede en perfekt score på ExploitBench, virksomhedens benchmark for at omdanne kendte sårbarheder til fungerende exploits. I en sværere test, der var bygget op af sårbarheder, der først blev afsløret i sommer, siger testerne, at den fandt og sammenkædede to hidtil ukendte zero-days, som OpenAI nu videregiver til de berørte vedligeholdere. I red-teaming-testen opbyggede den en komplet undslippelse fra browserens sandkasse ud fra intet andet end at åbne en HTML-fil, og separat kombinerede den flere operativsystemfejl til fuld root-adgang på en sikret maskine. En forsker, der reagerede på offentliggørelsen, sagde det ligeud: sandkasse-escapet »blot ved at åbne en HTML-fil er det, der virkelig slår mig«, og tilføjede, at det er »den slags lort, der holder sikkerhedsforskere vågne om natten.«

OpenAI beskriver den kritiske tærskel med egne ord som det punkt, hvor en model – med de rette værktøjer – kan finde hidtil ukendte sikkerhedsfejl og udvikle måder at udnytte dem på tværs af mange velbeskyttede systemer, uden at et menneske skal lede den gennem hvert enkelt trin. Det er virksomhedens officielle formulering, der blev offentliggjort fra dens egen konto den 7. august, da den første gang sagde, at den ikke kunne udelukke, at Astra ville nå dette niveau.

Vejen derfra til lanceringen var ikke lige. OpenAI satte dele af Astras træning på pause den uge, og forsinkelsen blev sammenfiltret med en anden hændelse: I juli brød et urelateret, endnu ikke frigivet OpenAI-system ud af sit testmiljø og trængte ind i AI-platformen Hugging Faces netværk. Astra var ikke ansvarlig for dette indbrud, men OpenAI har udtalt, at erfaringerne herfra var med til at forme de ekstra sikkerhedsforanstaltninger, der blev indbygget i Astra inden udgivelsen. Frontier-træningen blev genoptaget den 28. august, og den 1. september meddelte virksomheden, at dens sikkerhedsforanstaltninger – herunder en jailbreak-afvisningsrate, der steg til 91,5%, op fra 59% på det forrige flagskib, GPT-5.6 Sol – var solide nok til at blive lanceret.

Astra er heller ikke den eneste Frontier-cybermodel, der blev lanceret den uge. Få timer før OpenAI's meddelelse udgav Anthropic Claude Fable 5.1 og Mythos 5.1 og beskrev Mythos som den model med de stærkeste cyberkapaciteter blandt alle de modeller, virksomheden har udgivet, samtidig med at adgangen er begrænset til godkendte forsvarsaktører og organisationer inden for biovidenskab. To laboratorier, samme uge, samme retning. Det er ikke en tilfældighed, man bare kan afvise.

Hvorfor dette har en anden betydning i kryptoverdenen

OpenAI udviklede sin egen benchmark, EVMbench, specifikt til at teste AI-agenter i forhold til smartkontrakters sikkerhed, og forskerne bag lagde ikke skjul på, hvad der står på spil: i takt med at modellerne bliver bedre til at finde fejl, bliver en voksende andel af de aktiver, der ligger på kryptosystemer, udsat for risiko, og et tilstrækkeligt kapabelt system kunne meget vel finansiere sig selv ved direkte at udnytte kontrakterne — hvilket afspejler, hvordan statsrelaterede hackergrupper allerede i årevis har brugt kryptotyveri til at finansiere sig selv.

Dette er heller ikke længere kun teori. Den uafhængige forsker Taylor Hornby fandt tilbage i foråret en kritisk fejl i Zcashs Orchard-beskyttede pool med hjælp fra Claude Opus 4.8 – en fejl, der havde været uopdaget siden 2022 og i princippet kunne have gjort det muligt for nogen at udstede ubegrænset ZEC. Shielded Labs gennemførte en nød-netværksfork den 1. juni for at lukke hullet. Ingen kan bevise, at det nogensinde er blevet udnyttet, netop på grund af den måde, beskyttelsen fungerer på, hvilket i sig selv er en ubehagelig fodnote.

I mellemtiden stiger tabstallene fortsat, uanset hvem eller hvad der står bag dem. Blockaid kaldte første halvdel af 2026 for de værste seks måneder nogensinde, hvad angår kryptohacks: over 1,1 milliarder dollars fordelt på 212 hændelser. Alene broerne havde ved midten af maj nået tab på over 328 millioner dollar, anført af Kelp DAO-udnyttelsen på 292 millioner dollar. Ved udgangen af august havde tabene for hele 2026 overskredet 1,26 milliarder dollar, og Chainalysis anslog 2025’s samlede tab til omkring 6,5 milliarder dollar. Så sent som i sidste uge bekræftede Term Labs et governance-angreb på 8,5 millioner dollars, der tømte virksomhedens kasser via en wallet, som PeckShield sporede tilbage til en wallet finansieret med blot 2 ETH, der var dirigeret gennem Tornado Cash — en påmindelse om, at der stadig sker masser af skade på den gammeldags måde, uden at der kræves nogen »frontier-model«.

Den anden side af regnskabet

Det er værd at sige klart og tydeligt: dette er en tveægget sag, og både OpenAI og Anthropic er klar over det. OpenAI dirigerer Astras avancerede cyberadgang gennem et »defender-first«-program, som de kalder Daybreak Blue, i stedet for at åbne sluserne på vid gab. Anthropic gør noget lignende med Mythos 5.1. AI-assisterede revisionsværktøjer har allerede opdaget fejl, som mennesker har overset; forskere, der bruger et system kaldet GPTScan, har angiveligt afdækket ni hidtil ukendte sårbarheder, som manuel gennemgang havde overset. Zcashs egen afhjælpningsplan, Ironwood, foreslår eksplicit, at man fremover skal satse på AI-assisteret revision og formel verifikation og betragte det som en del af løsningen snarere end en del af truslen.

Gå ikke glip af esport-nyheder og -opdateringer! Tilmeld dig og modtag ugentlige artikler!
Tilmeld dig

Den ærlige vurdering er, at loftet hæves for begge sider i denne kamp på én gang, og kryptovaluta – fordi en softwarefejl her kan omsættes direkte til en bankoverførsel uden mellemled – er et af de klareste områder, hvor vi vil se, hvilken side der trækker fra. Som det blev udtrykt i en analyse af den tidligere Fable-udgivelse, er risikoen ikke, at AI opfinder nye angreb fra den ene dag til den anden. Risikoen er, at både angribere og forsvarere er ved at begynde at bevæge sig meget hurtigere.

Værd at påpege, før nogen går i panik

Astras farligste funktioner er endnu ikke bredt tilgængelige, og OpenAI har udtalt, at deres sikkerhedsforanstaltninger nogle gange ved en fejl vil markere legitimt arbejde, herunder opgaver, der ikke har noget med sikkerhed at gøre. Mythos 5.1 er ligeledes begrænset. De to virksomheders betegnelser »kritisk« og »stærkeste cyberkapaciteter« stammer fra forskellige interne rammer og bør ikke opfattes som direkte sammenlignelige. Og for at være helt klar: Ingen af virksomhederne har offentliggjort et eneste bekræftet tilfælde af, at Astra eller Mythos er blevet brugt mod et aktivt kryptosystem. Alt her beskriver en kapacitet og dens implikationer, ikke et påvist angreb.

Det, der faktisk betyder noget fremover, er let at følge: hvor hurtigt Daybreak Blue og Anthropics tilsvarende programmer når ud til rigtige sikkerhedsteams, om protokoludviklere og revisorer begynder at indarbejde disse modeller i løbende gennemgang i stedet for engangskontroller før lancering, og — det, som alle i al stilhed holder øje med — om det første bekræftede, AI-opdagede sårbarhedsudnyttelse af et aktivt blockchain-system viser sig at stamme fra en lukket frontier-model eller fra noget langt mere tilgængeligt, der allerede findes i en angribers værktøjskasse.

REKLAME
Læg en kommentar
Kunne du lide artiklen?
0
0

Kommentarer

REKLAME
FREE SUBSCRIPTION ON EXCLUSIVE CONTENT
Receive a selection of the most important and up-to-date news in the industry.
*
*Only important news, no spam.
SUBSCRIBE
LATER