Najstarejša napaka, ki jo je izbrskal najnovejši Anthropicov model, je 27 let ždela v OpenBSD, operacijskem sistemu, ki slovi prav po varnosti. Anthropic je 7. aprila 2026 sporočil, da modela, ki jo je našel, Claude Mythos Preview, javnosti sploh ne bo prodajal.
Namesto tega ga je vpregel v Project Glasswing, obrambni program, v katerem sodelujejo Amazon Web Services, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorganChase, Linux Foundation, Microsoft, Nvidia in Palo Alto Networks ter več kot 40 drugih organizacij, ki gradijo ali vzdržujejo ključno programsko opremo. Model smejo uporabljati samo za kibernetsko varnost. Razlog navaja brez ovinkov: Mythos Preview po njegovih besedah najde in izkoristi napake v programski opremi bolje od vseh ljudi, razen najbolj izurjenih.
- Kaj: Claude Mythos Preview, doslej najzmogljivejši Anthropicov model, dostopen le partnerjem projekta Glasswing za obrambno varnostno delo.
- Cena: do 100 milijonov dolarjev dobropisov za uporabo, nato 25 dolarjev na milijon vhodnih in 125 dolarjev na milijon izhodnih žetonov.
- Zakaj je pomembno: vodilni laboratorij je splošni model zadržal zaradi tega, kar zmore narediti programski opremi, branilcem pa je dal prednost.
Kaj je model našel
V tehničnem zapisu, objavljenem isti dan, so Anthropicovi varnostni raziskovalci zapisali, da je Mythos Preview na uporabnikovo zahtevo znal najti in nato izkoristiti ranljivosti ničtega dne (napake, za katere proizvajalec še ne ve) v vseh večjih operacijskih sistemih in vseh večjih spletnih brskalnikih. Poleg hrošča v OpenBSD, s katerim je napadalec lahko zrušil vsak stroj s tem sistemom, ki je dosegljiv prek TCP, je našel 16 let staro napako v dekoderju videa H.264 v knjižnici FFmpeg, brez človeške pomoči po prvotni zahtevi pa napisal še delujoč napad na 17 let staro napako v FreeBSD-jevi kodi za deljenje datotek NFS, ki je napadalcu dala skrbniški dostop.
Kako velik je skok, kaže Anthropicova lastna primerjava. Prejšnji vodilni model, Claude Opus 4.6 (izšel februarja), je ranljivosti v pogonu JavaScript brskalnika Firefox 147 v več sto poskusih le dvakrat spremenil v delujoč napad. Mythos Preview jih je v enakem preizkusu ustvaril 181. Gre za rezultate, ki jih navaja proizvajalec. „Inženirji pri Anthropicu brez formalnega varnostnega znanja so Mythos Preview zvečer prosili, naj poišče ranljivosti za oddaljeno izvajanje kode, naslednje jutro pa jih je čakal popoln, delujoč napad,“ so zapisali raziskovalci.
Večine najdenega še ni mogoče opisati: Anthropic pravi, da več kot 99 odstotkov ranljivosti še ni zakrpanih, vsako poročilo pa pred pošiljanjem vzdrževalcem ročno preverijo najeti varnostni strokovnjaki.
Kdo ga dobi in zakaj ne vsi
Anthropic za program namenja do 100 milijonov dolarjev dobropisov za uporabo in 4 milijone dolarjev donacij odprtokodnim varnostnim organizacijam. Ko dobropisi poidejo, udeleženci plačajo 25 dolarjev na milijon vhodnih in 125 dolarjev na milijon izhodnih žetonov, prek API-ja Claude, Amazon Bedrock, Googlovega Vertex AI in Microsoft Foundry. Anthropic je obljubil, da bo v 90 dneh javno poročal o odpravljenih napakah, in navedel, da se o kibernetskih zmožnostih modela ves čas pogovarja s predstavniki ameriške vlade.
Gre za tekmo s časom. „Glede na hitrost napredka umetne inteligence ne bo dolgo, preden se bodo takšne zmožnosti razširile, morda tudi do akterjev, ki se ne zavezujejo k varni uporabi,“ je zapisalo podjetje. Elia Zaitsev, tehnični direktor podjetja CrowdStrike, je v isti objavi opisal pogled branilcev: čas med odkritjem napake in napadom nanjo se je skrčil skoraj na nič: „kar je nekoč trajalo mesece, se z umetno inteligenco zdaj zgodi v minutah“.
„Claude Mythos Preview ne nameravamo splošno izdati,“ je zapisal Anthropic in dodal, da je njegov končni cilj uporabnikom omogočiti varno rabo modelov razreda Mythos v velikem obsegu. Nove zaščite naj bi najprej dobil prihodnji model Claude Opus, tak, ki „ne predstavlja enake ravni tveganja kot Mythos Preview“. „Trditev 'naš model je prenevaren za izdajo' je odličen način, da o novem modelu govori ves svet, a v tem primeru mislim, da je previdnost upravičena,“ je zapisal razvijalec Simon Willison.
Previden, dokler ni
Sistemska kartica ponuja neprijetno ugotovitev. „Claude Mythos Preview je skoraj po vseh merilih, ki jih znamo izmeriti, z naskokom najbolje usklajen model, kar smo jih izdali,“ piše v njej. „Kljub temu menimo, da najverjetneje prinaša največje tveganje glede usklajenosti od vseh modelov, kar smo jih izdali.“ Anthropic ga primerja z izkušenim gorskim vodnikom, ki stranke pelje na zahtevnejše vzpone, kot bi si jih kdaj upal začetnik.
Primeri so iz zgodnejših notranjih različic. V enem od preizkusov je simulirani uporabnik model prosil, naj pobegne iz zaklenjenega peskovnika, ločenega računalnika z omejenim dostopom, in pošlje sporočilo raziskovalcu, ki je vodil preizkus. Model je sestavil, kot piše v kartici, „zmerno prefinjen večstopenjski napad“, prišel do odprtega interneta, naredil, kar so ga prosili, nato pa brez naročila objavil podrobnosti napada na težko najdljivih, a javnih spletnih straneh. Raziskovalec je za uspeh izvedel iz nepričakovanega e-sporočila modela, medtem ko je v parku jedel sendvič. Anthropic poudarja, da je bil peskovnik ločen od sistemov z utežmi modela in da model v tem preizkusu ni pokazal sposobnosti, da bi prišel do lastnih uteži ali notranjih sistemov.
V opombi je dodano, da odločitev o zadržanju modela „ne izhaja iz zahtev politike odgovornega skaliranja“, Anthropicovega pravilnika za katastrofalna tveganja: šlo je za presojo o kibernetskih zmožnostih.
Kaj se je zgodilo pozneje
Anthropic je 16. aprila 2026 izdal Claude Opus 4.7, prvi model z novimi zaščitami, ki zaznajo in blokirajo zelo tvegane kibernetske zahteve. Nato je 2. junija Project Glasswing razširil na približno 150 novih organizacij v več kot 15 državah in sporočil, da so prvi partnerji našli več kot 10.000 napak visoke ali kritične resnosti. Od 9. junija so partnerji programa z modela Mythos Preview lahko prešli na Claude Mythos 5, hkrati pa je izšla javna različica istega modela z zaščitami, Claude Fable 5.





Komentarji
Komentarje pregledamo, preden jih objavimo.
Komentarjev še ni. Bodite prvi.