ANNONS
EGW-NewsOpenAI:s GPT-6 Astra har just passerat en gräns som ingen tidigare har passerat
OpenAI:s GPT-6 Astra har just passerat en gräns som ingen tidigare har passerat
347
Add as a Preferred Source
0
0

OpenAI:s GPT-6 Astra har just passerat en gräns som ingen tidigare har passerat

OpenAI har ett nytt problem som man själv har skapat: en modell som är så skicklig på att hacka att företaget var tvunget att utveckla en ny säkerhetsnivå enbart för att hålla den under kontroll. Den 1 september meddelade OpenAI att den kommande modellen Astra är det första systemet som företaget någonsin har klassificerat som ”Kritiskt” för cybersäkerhet enligt sitt beredskapsramverk – den högsta nivån på en skala som tidigare gick upp till ”Hög”. Två dagar senare, den 3 september, började företaget rulla ut Astra i etapper, med utvalda försvarare först, innan den når användare av ChatGPT Plus, Pro, Business och Enterprise via API:et och AWS.

För de flesta branscher är detta en abstrakt fråga om styrning. För kryptovalutor är det inte det. Smarta kontrakt förvarar medel direkt. Bryggor flyttar dem mellan kedjor. Plånböcker skyddar nycklarna. När koden innehåller en bugg är avståndet mellan ”sårbarhet” och ”stulna pengar” ofta en enda transaktion – inget skydd, ingen bank att ringa, ingen återbetalning. En modell som hittar buggar snabbare än människor gör är per definition en modell som förändrar matematiken på båda sidor av den ekvationen.

Vad gjorde Astra egentligen?

OpenAI:s egna siffror är det viktigaste här. Astra uppnådde full poäng på ExploitBench, företagets benchmark för att omvandla kända sårbarheter till fungerande exploateringar. I ett svårare test som byggdes upp av sårbarheter som avslöjades så sent som i somras uppger testarna att den hittade och kopplade samman två tidigare okända zero-days, vilka OpenAI nu avslöjar för de berörda underhållsansvariga. Vid red-teaming lyckades man skapa en fullständig utbrytning ur webbläsarens sandbox genom att helt enkelt öppna en HTML-fil, och separat kopplade man samman flera brister i operativsystemet för att få fullständig root-åtkomst på en förstärkt maskin. En forskare som reagerade på avslöjandet uttryckte det rakt på sak: sandlådeflykten ”genom att bara öppna en HTML-fil är det som verkligen slår mig”, och tillade att det är ”den sortens skit som håller säkerhetsforskare vakna om natten”.

OpenAI beskriver tröskeln ”Critical” med egna ord som den punkt där en modell, med rätt verktyg, kan hitta tidigare okända säkerhetsbrister och utveckla sätt att utnyttja dem i många välskyddade system, utan att en människa behöver gå igenom varje steg. Det är företagets officiella beskrivning, publicerad från dess eget konto den 7 augusti, då man först meddelade att man inte kunde utesluta att Astra skulle nå denna nivå.

Vägen dit var inte rak. OpenAI pausade delar av Astras träning den veckan, och förseningen sammanflätades med en separat incident: i juli bröt sig ett icke-relaterat, ännu inte släppt OpenAI-system ut ur sin testmiljö och nådde in i AI-plattformen Hugging Faces nätverk. Astra var inte ansvarigt för det intrånget, men OpenAI har sagt att lärdomarna från det har format de extra skyddsåtgärderna som byggdes in i Astra före lanseringen. Frontier-träningen återupptogs den 28 augusti, och den 1 september meddelade företaget att dess säkerhetsåtgärder – inklusive en andel avvisade jailbreak-försök som stigit till 91,5%, en ökning från 59% för den tidigare flaggskeppsmodellen GPT-5.6 Sol – var tillräckligt solida för att modellen skulle kunna släppas.

Astra är inte heller den enda Frontier-cybermodellen som släpptes den veckan. Några timmar före OpenAI:s tillkännagivande släppte Anthropic Claude Fable 5.1 och Mythos 5.1, och beskrev Mythos som den modell med de starkaste cyberförmågorna av alla modeller som företaget har släppt, samtidigt som tillgången begränsas till granskade säkerhetsaktörer och organisationer inom biovetenskap. Två laboratorier, samma vecka, samma riktning. Det är ingen slump som bör avfärdas.

Varför detta får en annan betydelse inom kryptovalutor

OpenAI utvecklade sitt eget testverktyg, EVMbench, specifikt för att testa AI-agenter mot säkerheten i smarta kontrakt, och forskarna bakom det lade inte fingrarna emellan när det gällde vad som står på spel: i takt med att modellerna blir bättre på att hitta buggar utsätts en växande andel av tillgångarna i kryptosystem för risker, och ett tillräckligt kapabelt system skulle rimligen kunna finansiera sig själv genom att utnyttja kontrakten direkt – vilket påminner om hur statligt kopplade hackargrupper redan i åratal har använt kryptostöld för att finansiera sin verksamhet.

Detta är inte heller teoretiskt längre. Den oberoende forskaren Taylor Hornby upptäckte redan i våras en kritisk bugg som möjliggjorde förfalskning i Zcashs Orchard-skyddade pool med hjälp av Claude Opus 4.8 – en brist som hade förblivit oupptäckt sedan 2022 och som i princip kunde ha låtit någon prägla obegränsat med ZEC. Shielded Labs genomförde en nödgaffel i nätverket den 1 juni för att åtgärda felet. Ingen kan bevisa att det någonsin utnyttjades, just på grund av hur skyddet fungerar, vilket i sig är en obehaglig fotnot.

Samtidigt fortsätter förlustsiffrorna att stiga, oavsett vem eller vad som ligger bakom dem. Blockaid kallade första halvåret 2026 för de värsta sex månaderna någonsin när det gäller kryptohack: över 1,1 miljarder dollar fördelat på 212 incidenter. Enbart förlusterna via kryptobryggor hade vid mitten av maj passerat 328 miljoner dollar, med Kelp DAO-exploiten på 292 miljoner dollar i spetsen. I slutet av augusti hade förlusterna för helåret 2026 passerat 1,26 miljarder dollar, och Chainalysis uppskattade 2025 års totala förluster till ungefär 6,5 miljarder dollar. Så sent som förra veckan bekräftade Term Labs en säkerhetslucka i styrsystemet värd 8,5 miljoner dollar som tömde deras valv genom vad PeckShield spårade tillbaka till en plånbok finansierad med endast 2 ETH som dirigerats via Tornado Cash – en påminnelse om att mycket skada fortfarande åstadkoms på gammaldags vis, utan att någon ”frontier-modell” krävs.

Den andra sidan av balansräkningen

Det är värt att säga rakt ut: detta är ett tveeggat svärd, och både OpenAI och Anthropic är medvetna om det. OpenAI dirigerar Astras avancerade cyberåtkomst genom ett program som prioriterar försvaret, kallat Daybreak Blue, istället för att öppna slussarna. Anthropic gör något liknande med Mythos 5.1. AI-stödda granskningsverktyg har redan upptäckt buggar som människor missat; forskare som använde ett system kallat GPTScan upptäckte enligt uppgift nio tidigare okända sårbarheter som manuell granskning hade missat. Zcashs egen åtgärdsplan, Ironwood, föreslår uttryckligen att man framöver ska förlita sig på AI-assisterad granskning och formell verifiering, och betrakta det som en del av lösningen snarare än en del av hotet.

Missa inte esportnyheter och uppdatering! Registrera dig och få veckovisa artiklar!
Registrera dig

Den ärliga tolkningen är att taket höjs för båda sidor i denna kamp samtidigt, och kryptovalutor – eftersom en programvarubugg där kan översättas direkt till en banköverföring utan mellanhand – är ett av de tydligaste områdena där vi kommer att se vilken sida som drar ifrån. Som en analys av den tidigare Fable-utgåvan uttryckte det: risken är inte att AI uppfinner nya attacker över en natt. Risken är att både angripare och försvarare är på väg att börja agera mycket snabbare.

Värt att påpeka innan någon drabbas av panik

Astras farligaste funktioner är ännu inte allmänt tillgängliga, och OpenAI har sagt att dess säkerhetsåtgärder ibland av misstag kommer att flagga legitimt arbete, inklusive uppgifter som inte har något med säkerhet att göra. Mythos 5.1 är på liknande sätt begränsat. De två företagens beteckningar ”kritisk” och ”starkaste cyberfunktioner” härrör från olika interna ramverk och bör inte tolkas som direkt jämförbara. Och för att vara tydlig: inget av företagen har offentliggjort ett enda bekräftat fall där Astra eller Mythos har använts mot ett aktivt kryptosystem. Allt här beskriver en funktion och dess konsekvenser, inte en påvisad attack.

Det som faktiskt spelar roll framöver är enkelt att följa: hur snabbt Daybreak Blue och Anthropics motsvarande program når riktiga säkerhetsteam, om protokollutvecklare och revisorer börjar integrera dessa modeller i kontinuerlig granskning snarare än engångskontroller före lansering, och — det som alla i tysthet håller utkik efter — om den första bekräftade AI-upptäckta sårbarheten i ett aktivt blockkedjesystem visar sig ha sitt ursprung i en sluten pionjärmodell, eller från något betydligt mer tillgängligt som redan finns i en angripares verktygslåda.

ANNONS
Lämna en kommentar
Gillade du artikeln?
0
0

Kommentarer

ANNONS
FREE SUBSCRIPTION ON EXCLUSIVE CONTENT
Receive a selection of the most important and up-to-date news in the industry.
*
*Only important news, no spam.
SUBSCRIBE
LATER