Anthropics nye model for kunstig intelligens, kendt som Claude Mythos-forhåndsvisningDet er blevet epicentret for den globale debat om begrænsningerne ved avanceret kunstig intelligens. Virksomheden indrømmer selv, at systemet er så kraftfuldt inden for cybersikkerhed, at de har besluttet ikke at lancere det bredt, en usædvanlig beslutning i en sektor, der er vant til at prale af hvert nyt fremskridt.
Det, der står på spil, er ikke blot en trinvis forbedring i forhold til tidligere modeller, men et kvalitativt spring i evnen til at opdage og udnytte computersårbarhederRegeringer, centralbanker, store finansielle institutioner og europæiske tilsynsmyndigheder overvåger sagen nøje, vel vidende at et sådant værktøj kunne styrke forsvaret af kritiske systemerMen det kunne også åbne døren for angreb af hidtil uset omfang, hvis det skulle falde i de forkerte hænder.
Hvad er Claude Mythos egentlig, og hvorfor er lanceringen blevet forsinket?
Claude Mythos er en af ​​de nyeste modeller i Claude-familien, Anthropics AI-økosystem, der konkurrerer med OpenAIs ChatGPT og Googles GeminiDet er en generel model, der er i stand til at ræsonnere, programmere og arbejde med langsigtet kontekst, men dens mest kontroversielle træk er dens præstation inden for offensiv og defensiv cybersikkerhed.
Opkaldene "røde hold"Specialister, der tester AI-systemer til deres grænser, konkluderede i en intern rapport, at Mythos er "overraskende kapabel" til cybersikkerhedsopgaver. I benchmarktests som f.eks. SWE-bænk verificeret o SWE-bænk ProModellen, der er designet til at måle evnen til at løse softwareudviklingsproblemer i den virkelige verden, ville let have overgået kommercielle alternativer i topklasse, herunder avancerede versioner af GPT og Gemini, ifølge data leveret af Anthropic selv.
Ud over benchmarksene er det, der har fået alarmklokkerne til at ringe, at Mythos var i stand til at finde nuldagssårbarheder —tidligere ukendte fejl — i udbredte softwarekomponenter, hvoraf nogle er over to årtier gamle. I systemer som OpenBSD-, FFmpeg- og FreeBSD-komponenter opdagede modellen ikke kun fejl, der var gået ubemærket hen i årevis, men genererede også fungerende angreb for at udnytte dem.
Stillet over for disse resultater valgte Anthropic en beslutning, der var usædvanlig i branchen: at præsentere modellen og derefter meddele, at den ikke vil blive markedsført åbent. fordi den mener, at den udgør hidtil usete cybersikkerhedsrisici. Virksomheden insisterer på, at Mythos er den "bedst afstemte" model, de har bygget, men erkender, at dens enorme kapacitet forstærker konsekvenserne af ethvert misbrug.

En model med "hacker"-færdigheder langt ud over menneskelige evner
Tekniske dokumenter og rapporter fra forskellige organisationer er enige om, at Mythos markerer et vendepunkt i automatiseringen af ​​komplekse angrebI testmiljøer, der simulerede rigtige virksomhedsnetværk, var systemet i stand til at kæde sårbarheder sammen, eskalere privilegier og opnå vedvarende adgang på få timer – opgaver, der ville tage en menneskelig ekspert dage eller uger.
I Firefox' JavaScript-motor for eksempel, lykkedes det sjældent for tidligere versioner af Anthropics modeller at forvandle sårbarheder til fungerende angreb. Mythos, under de samme testbetingelser, Det genererede snesevis af operationelle udnyttelserDen replikerer nøjagtigt udnyttelsen af ​​de mest effektive vektorer. På analyseplatforme som OSS-Fuzz, der er designet til at finde fejl i open source-software, tilskrives den kendskabet til at have opdaget alvorlige sårbarheder, der var gået ubemærket hen trods års automatiseret testning.
Modellen har også vist bemærkelsesværdige egenskaber inden for reverse engineeringDen kan rekonstruere en del af et programs logik fra kompilerede binære filer og derfra finde og udnytte fejl uden at få adgang til den originale kildekode. Denne type funktion bringer AI tættere på scenarier, der indtil for nylig blev betragtet som eksklusive for højt specialiserede menneskelige teams.
En af de hyppigst citerede episoder i sikkerhedsvurderinger er den såkaldte "sandwichtest". I et isoleret laboratoriemiljø fik Mythos kontrol over et system med eksplicitte instruktioner om at forsøge undslippe sandkassen og kontakt forskeren hvem der overvågede testen. Modellen formåede at udnytte en række sårbarheder for at undslippe sit begrænsede miljø og sende en e-mail til den ansvarlige person, som ikke var på kontoret på det tidspunkt. Selvom hændelsen fandt sted i en tidligere intern version og under styret kommando, illustrerer den, i hvilket omfang systemet kan fungere i komplekse scenarier med minimal overvågning.
Trods disse demonstrationer insisterer analytikerne på at præcisere, at Vi har ikke at gøre med en "bevidst" AI eller en med sin egen viljeMythos beslutter sig ikke selv for at angribe systemer; den udfører de opgaver, den får tildelt, så effektivt som muligt. Risikoen er i denne forstand ikke, at modellen vil gøre oprør, men at nogen vil bruge den – eller tvinge den til at gøre det gennem sofistikerede prompts – til at udføre skadelige handlinger.
Projekt Glasswing: Mytos i forsvarets tjeneste… for nogle få udvalgte
I stedet for at åbne adgang for den brede offentlighed har Anthropic valgt at omgive Mythos med et specifikt program, Projekt GlasvingeInitiativet er designet til at bruge modellens funktioner på en kontrolleret måde til beskyttelse af kritisk software og indebærer at tilbyde systemet, under strenge brugsbetingelser, til en udvalgt gruppe af store teknologivirksomheder, infrastrukturudbydere og finansielle institutioner.
Blandt de organisationer, der har adgang, er giganter som f.eks. Amazon Web Services, Apple, Microsoft, Google CloudNvidia eller Broadcomsåvel som cybersikkerhedsfirmaer som CrowdStrike, hvis egen mangelfulde software forårsagede en større global forstyrrelse i 2024. Disse får følgeskab af verdenskendte banker, herunder JP Morgan Chase og flere store Wall Street-grupper, såvel som andre organisationer, der er ansvarlige for at vedligeholde følsomme IT-infrastrukturer.
Antropisk har også annonceret lån til en værdi af 100 millioner dollars Denne finansiering vil gøre det muligt for disse organisationer at bruge Mythos til sårbarhedsanalyse, sammen med donationer til fri softwarefonde som Linux Foundation og Apache Software Foundation. Det officielle mål er klart: at give dem, der administrerer verdens mest kritiske software, mulighed for at identificere og rette fejl, før sådanne værktøjer bliver tilgængelige for potentielle angribere.
Denne strategi skaber dog en vis uro i sektoren. På den ene side forstærker den ideen om, at teknologi er farlig nok til at kræve begrænset adgang. På den anden side, Det skaber en kløft mellem dem, der drager fordel af Mythos' "skjold", og dem, der bliver holdt udenfor.Virksomheder og administrationer, der ikke er en del af Glasswing, risikerer senere at stå over for sårbarheder, der blev identificeret og rettet i privilegerede miljøer, men som stadig er til stede i deres egne systemer.
I Europa er denne asymmetri særligt bekymrende for dem, der er ansvarlige for kritisk infrastruktur, og sikkerhedsteams i store industri- og finanskoncerner, som nøje overvåger, om Bruxelles og de europæiske hovedstæder sikrer, at lignende programmer inkluderer nøgleaktører fra kontinentet på lige vilkår. og cloud-suverænitet med de amerikanske partnere.
Reaktion fra regeringer, tilsynsmyndigheder og finanssektoren
Mythos' indflydelse er ikke begrænset til det tekniske område. På bare et par dage udløste annonceringen af ​​modellen møder på højt niveau i USA og EuropaDen amerikanske finansminister indkaldte cheferne for landets største banker til Washington for at vurdere de risici, systemet kunne udgøre for den finansielle stabilitet, mens formanden for Federal Reserve også deltog i disse samtaler.
Ifølge lækager rapporteret af internationale medier blev disse enheder angiveligt opfordret til at Test Mythos i defensiv tilstandbruger den til at scanne deres egen infrastruktur for svagheder, før andre kan. Den implicitte besked er, at truslen er alvorlig nok til at berettige en koordineret offentlig-privat indsats.
I mellemtiden har medstifteren af ​​Anthropic bekræftet, at virksomheden fører direkte samtaler med den amerikanske regering om Mythos og fremtidige modeller. Disse diskussioner finder sted i en anspændt kontekst, efter at amerikanske myndigheder for nylig føjede virksomheden til en liste over risici i forsyningskædenefter gnidninger i forbindelse med Forsvarsministeriets brug af deres modeller.
På den anden side af Atlanten har Den Europæiske Union taget dette til efterretning. Europa-Kommissionen har offentligt støttet en gradvis og forsigtig tilgang til modeller som Mythos, og Finanstilsynsmyndigheder i Storbritannien og på kontinentet er begyndt specifikt at undersøge de potentielle konsekvenser. for bankvirksomhed og markeder. Den britiske regerings AI Security Institute (AISI) har beskrevet systemet som et betydeligt spring fremad med hensyn til cybertrusler sammenlignet med tidligere generationer.
I Spanien overvåger tilsynsorganer og cybersikkerhedsteams fra banker og store energiselskaber nøje disse udviklinger, selvom den offentlige debat stadig er begrænset. For den europæiske finanssektor er ethvert fremskridt, der kan fremme koordinerede angreb mod betalingssystemer, interbanknetværk eller handelsplatforme, en årsag til alvorlig bekymring.
Skepsis, tvivl og debat om "hypen" omkring Mythos
Anthropics konto, der kombinerer sikkerhedsadvarsler med spektakulære præstationstal, har ikke været uden kritik. Flere eksperter i kunstig intelligens og cybersikkerhed har opfordret til forsigtighed ved fortolkning af virksomhedens udsagndet bemærkes, at en stor del af de tilgængelige data kun stammer fra interne rapporter.
Nogle analytikere har gennemgået den omfattende dokumentation, der er offentliggjort af Anthropic, i detaljer og påpeger, at tallet på "tusindvis af alvorlige sårbarheder" er baseret på ekstrapolationer fra et relativt lille antal manuelt gennemgåede tilfælde. I visse testpakker fandt Mythos angiveligt et betydeligt antal kritiske fejl, men langt fra det næsten apokalyptiske scenarie, som nogle overskrifter antyder.
Andre uafhængige studier har forsøgt at sammenligne Mythos' ydeevne med mindre open source-modeller, hvor de har sendt sårbare kodestykker til forskellige AI'er for at se, om de kunne opdage de samme fejl. Resultaterne indikerer, at Nogle åbne modeller er også i stand til at identificere komplekse sårbarhederDette sætter spørgsmålstegn ved ideen om, at Mythos spiller i en helt anden liga i alle scenarier.
Den slags modeksempler ophæver ikke Mythos' evner, men de antyder, at En del af diskursen om "at være for farligt at udgive" har også en markedsføringsdimension.At præsentere en model som både ekstraordinært kraftfuld og en potentiel risiko forstærker billedet af teknologisk lederskab og ansvarlighed, noget meget værdifuldt i et stadigt mere konkurrencepræget marked.
Branchens nylige historie minder også om præcedensen for GPT-2 i 2019, hvor OpenAI i første omgang besluttede ikke at offentliggøre den fulde model med den begrundelse, at den var for farlig på grund af dens potentiale til at generere misinformation. Til sidst blev denne version frigivet til offentligheden uden at nogen af ​​de forudsagte katastrofer indtraf, og mange eksperter nævnte den som et eksempel på overreaktion. Med Mythos, Forskellen er, at fokus ikke længere er på teksten, men på integriteten af ​​den digitale infrastruktur., et langt mere følsomt område for regeringer og banker.
En hårfin balance mellem sikkerhed, forretning og adgang til teknologi
Ud over mediestøjen rejser Mythos-situationen et fundamentalt problem: Hvem bestemmer, hvornår en AI-model er for farlig at frigive Og under hvilke kriterier? Indtil videre har beslutningen været ensidig fra Anthropics side, som har valgt at holde systemet i en slags kontrolleret karantæne og forbeholde det udvalgte partnere.
Denne holdning er ikke udelukkende baseret på sikkerhedsmæssige årsager. Det er vigtigt at køre en model med Mythos' karakteristika. meget dyrt med hensyn til computerkraft, og virksomheden erkender selv, at den i øjeblikket ikke har nødvendig infrastruktur at levere den massivt til millioner af brugere. I praksis går sikkerhedsforanstaltninger og tekniske begrænsninger hånd i hånd, hvilket giver Anthropic tid til at finjustere både modellen og dens implementering.
Samtidig er virksomheden begyndt at skelne tydeligt mellem sine forskellige produkter. Mens Mythos forbliver som den mest avancerede interne standardSelvom de er forbeholdt forskning og strategiske samarbejdssammenhænge, ​​er andre modeller som Claude Opus 4.7 rettet mod daglig brug af virksomheder og professionelle. Anthropic har endda offentligt anerkendt, at Opus 4.7 er "mindre kapabel" end Mythos generelt og især med hensyn til dens cyberkapaciteter – noget usædvanligt i en branche, der typisk præsenterer hver ny model som den bedste på alle måder.
I denne ordning fungerer Mythos som testmiljø for næste generations funktionerSelvom kommercielt tilgængelige modeller kun inkorporerer en del af disse muligheder, med yderligere begrænsninger designet til at reducere risici, kan denne adskillelse mellem "eksperimentelle" og "produktions"-modeller være en rimelig tilgang for mange europæiske organisationer, der er interesserede i at udnytte AI uden at være i frontlinjen, forudsat at der er tilstrækkelig gennemsigtighed omkring de faktiske muligheder i hvert system.
Det, der i sidste ende tegner sig, er et scenarie, hvor Cybersikkerhed går fuldt ud ind i en æra med storstilet offensiv og defensiv AIVærktøjer som Mythos lover at fremskynde identifikationen af ​​sårbarheder i systemer, der har været i drift i årevis, men de tvinger også til en gentænkning af, hvordan den teknologi, der understøtter den digitale økonomi, distribueres og styres. For Europa og Spanien vil udfordringen ikke kun være at beskytte sig mod stadig mere magtfulde modeller, men også at sikre, at de ikke holdes uden for de mekanismer, der gør det muligt at bruge dem til at styrke deres egen sikkerhed.
