Uudis tuli vaid mõni päev pärast seda, kui OpenAI tunnistas, et üks tema tehisaruagent ründas idufirma Hugging Face’i süsteemi. Hiljem täpsustati, et ChatGPT häkkis sisse veel neljale veebilehele.
Loe veel OpenAI tehisaru küberrünnaku kohta
30.07.2026
OpenAI: kontrolli alt pääsenud tehisaru ründas teisigi teenuseid
22.07.2026
OpenAI tehisaru läks kontrolli alt välja ja ründas idufirmat
Süüdi on siiski inimene
Anthropicu juhtum oli mõnevõrra teistsugune. OpenAI agent leidis ise uue turvaaugu, mille kaudu testkeskkonnast välja pääseda. Anthropicu mudelid said internetiühenduse testijate arusaamatuse tõttu.
Mõlemad juhtumid näitavad siiski sama probleemi: järjest võimekamad tehisarumudelid suudavad päriselt küberrünnakuid korraldada, kuid nende arendajad ei oska veel alati tagada, et katsed püsiksid kontrolli all.
Anthropic avastas juhtumid pärast 141 006 testi ülevaatamist. Ettevõte alustas kontrolli pärast seda, kui OpenAI avalikustas Hugging Face’i ründamise. „Claude kasutas ettevõtete süsteemidesse pääsemiseks lihtsaid võtteid, näiteks nõrku paroole ja veebiaadresse, kuhu pääses sisse logimata,“ teatas Anthropic.
Tehisarumudelite ründevõimekust uuriva Palisade Researchi juht Jeffrey Ladish kahtlustab, et sarnaseid juhtumeid on olnud ka teistes suurtes tehisaruettevõtetes. Osa neist ei pruugi olla avastatud ja osa juhtumitest võidi jätta avalikustamata. „Mida targemaks tehisarumudelid saavad, seda hullemaks läheb. Nad õpivad paremini petma ja valetama,“ ütles Ladish.
Anthropic nimetas juhtunut testimise korralduslikuks läbikukkumiseks. Ettevõtte sõnul sattusid teistesse süsteemidesse kolm mudelit: Claude Opus 4.7, Claude Mythos 5 ja üks veel avaldamata katsemudel. Esimesed juhtumid leidsid aset juba aprillis.
Mudelite võimekuse hindamiseks kasutati testkeskkondi, millest olid tavapärased kaitsemeetmed teadlikult eemaldatud. Nii tahtis Anthropic teada saada, milleks mudelid halvimal juhul võimelised on. Tehisarule anti väljamõeldud harjutusi, milles tuli simuleeritud arvutivõrgust üles leida peidetud info.
Targad mudelid on ohtlikud
Ühes katses anti Claude Opus 4.7-le sihtmärgiks väljamõeldud ettevõte. Selle nimi langes aga kokku päriselt tegutseva firma nimega. Mudel leidis päris ettevõtte süsteemist turvaaugud ning pääses nende kaudu ligi sisselogimisandmetele ja andmebaasile. Mudel märkas küll, et oli jõudnud päris internetti, kuid otsustas, et ka see peab kuuluma Anthropicu loodud harjutuse juurde. Seetõttu jätkas ta rünnakut.
Teises juhtumis käitus Anthropicu uuem ja veel avaldamata katsemudel teisiti. Kui see sai aru, et oli sattunud päris ettevõtte süsteemi, lõpetas tehisaru rünnaku iseseisvalt.
Anthropic peatas 23. juulil kõik küberturvalisuse testid. Ettevõtetele teatati juhtunust 27. juulil. Kaks neist ei teadnud enne Anthropicu pöördumist, et nende süsteemides oli toimunud midagi kahtlast.
Anthropicu sõnul näitavad juhtumid, et nii ettevõtete enda kui ka väliste partnerite testkeskkondi tuleb paremini kaitsta. See muutub üha olulisemaks, sest uuemad mudelid suudavad internetis järjest iseseisvamalt tegutseda.
USA võimud on hakanud uute tehisarumudelite turuletoomist tähelepanelikumalt jälgima. President Donald Trump andis 2. juunil oma nõunikele korralduse töötada kõige võimekamate mudelite jaoks välja vabatahtlik küberturvalisuse testimise raamistik.
Anthropic piiras varem ligipääsu oma Fable 5 ja Mythos 5 mudelitele pärast seda, kui USA kehtestas riikliku julgeoleku kaalutlustel ajutise ekspordipiirangu.
Loe veel Anthropicu mudelite piiramise kohta
01.07.2026
Anthropicu võimsad tehisarumudelid vabanesid USA valitsuse piirangute alt
14.06.2026
Anthropic piiras ligipääsu värskeimale mudelile
Kuidas see lugu Sind end tundma pani? Saada