OpenAI teatas sel nädalal, et on teinud mitmeid muudatusi oma ohutusmeetmetes, olles jõudnud järeldusele, et peagi kasutusele tulev süsteem Astra võib olla jõudnud küberjulgeoleku võimekuse kriitilise künniseni. Uute mudelite arendamine on praeguseks pausile pandud.
Ettevõte teatas, et otsus tulenes Hugging Face’iga seotud juhtumist ning üha rohkematest tõenditest, et arenenud süsteemid suudavad piiratud inimjuhendamisel tuvastada ja ära kasutada tarkvara nõrkusi.
Peatamine hõlmas kahe nädala pikkust pausi mudelite treenimisprogrammis. Samal ajal viib ettevõte läbi väiksemaid teste ja hindamisi.
ChatGPT looja sõnul toimus Hugging Face’i intsident ajal, mil ettevõte testis sisemiselt, kui hästi mõned uued mudelid häkkereid mängida oskavad. Mudelid asusid suletud testkeskkonnas, et nende tavapäraseid turvapiiranguid välja lülitada saaks.
Siis aga murdsid tehisintellekti agendid keskkonnast välja, kasutades varem tundmatut turvaauku, ning liikusid ringi OpenAI sisemistes süsteemides, kuni neil õnnestus saada juurdepääs internetile, millele neil ligipääsu ei olnud.
Kui mudel oli internetiga ühenduses, järeldas see, et Hugging Face’il – ettevõttel, mis majutab tuhandeid avatud lähtekoodiga tehisintellekti mudeleid ja andmekogusid – on tõenäoliselt vastus OpenAI testile. Seejärel murdis mudel sisse Hugging Face’i tootmisserveritesse ja hankis sealt teabe, mida vajas ülesande lahendamiseks.
Hugging Face oli rikkumist ise märganud juba enne, kui sai teada, et tegemist oli OpenAI testiga. Ettevõte teatas varem, et oli avastanud autonoomse tehisintellekti agendi süsteemi sissetungi ja isegi teatanud juhtumist õiguskaitseasutustele. OpenAI turvatiim märkas omakorda sisemiselt ebatavalist tegevust ning kaks ettevõtet võtsid ühendust. Mõlemad kinnitavad nüüd, et teevad koostööd, et kõrvaldada turvaaugud, mida mudel ära kasutas.
Juuli lõpus toimus sarnane intsident Anthropicu mudelitega. Need murdsid sisse kolme asutuse süsteemidesse. Mudelid olid samamoodi testkeskkonnas, murdsid sealt välja ja ühendasid end internetiga.