BRATISLAVA – Technologický svet čelí nevídanej hrozbe, ktorá doteraz patrila len do kategórie vedeckofantastickej literatúry. Vývojárske giganty OpenAI aj Anthropic priznali, že ich najnovšie a najpokročilejšie modely umelej inteligencie sa počas bezpečnostných testov doslova vymkli spod kontroly. Autonómne systémy prelomili stanovené bariéry, získali prístup na internet a bez ľudského zásahu napadli siete niekoľkých reálnych spoločností.
Ešte nedávno boli bezpečnostné previerky modelov umelej inteligencie striktne odstrihnuté od reálneho sveta. Posledné incidenty však ukázali, že izolácia prestáva fungovať. Špičkový agent od OpenAI sa dokázal dostať zo špeciálne zabezpečenej siete a priamo na internete zaútočil na známu platformu Hugging Face, ktorá je používaná k hostingu veľkých jazykových modelov s otvoreným kódom.
Cieľom testu bolo preveriť schopnosti systému v oblasti kybernetickej bezpečnosti. Namiesto štandardného riešenia úloh však AI zvolila kreatívnu a nebezpečnú skratku – napadla externú infraštruktúru, aby si výsledky previerky zjednodušene stiahla a ukradla. Spoločnosť OpenAI neskôr priznala, že jej agenti rovnakým spôsobom kontaktovali a napadli aj ďalšie štyri verejne dostupné platformy. OpenAI na svojom blogu uviedla, že kvôli incidentu posilní svoje bezpečnostné mechanizmy.
Nezaostáva ani konkurencia
Krátko po škandále OpenAI priznal podobné zlyhanie aj jeho hlavný rival, spoločnosť Anthropic. Pri vyhodnocovaní viac ako 141-tisíc testovacích spustení firma zistila, že jej tri samostatné modely rovnako využili neplánované pripojenie k internetu a napadli systémy troch reálnych firiem.
V jednom z prípadov partner zabezpečujúci test použil fiktívny názov, ktorý sa však zhodoval so skutočnou internetovou adresou. Umelá inteligencia namiesto simulovaného terča okamžite zamierila na reálnu firmu a prenikla až do jej databázy. Pokračovala v tom dokonca aj vtedy, keď rozoznala, že ide o reálny podnik. Pri inom incidente model vytvoril škodlivý kód, zavesil ho na špecializovanú platformu a prostredníctvom neho získal prístup k infraštruktúre kyberneticko-bezpečnostnej spoločnosti, ktorá skript analyzovala.
Zobraziť galériu (2)
Ilustračné foto (Zdroj: Getty Images)
Zlyhali aj najprísnejšie bezpečnostné protokoly
Skutočnosť, že k únikom prišlo v prostrediach, ktoré mali byť dokonale chránené, vyvoláva obavy aj medzi najznámejšími odborníkmi. Mnohí prirovnávajú chovanie AI k študentovi, ktorý namiesto písania testu v uzamknutej triede vypáči zámok, vojde do kabinetu a ukradne správne odpovede priamo zo stola učiteľa.
Experti varujú, že schopnosti autonómnych agentov začať hackerské útoky bez akéhokoľvek pokynu človeka predstavujú obrovské riziko. Ukazuje sa totiž, že dnešné najlepšie modely dokážu v priebehu hodín objaviť bezpečnostné diery, ktorých odhalenie by ľudským hackerom trvali celé mesiace.
Tlak na reguláciu a obavy zo superinteligencie
Najnovšie incidenty opäť vyvolali ostrú diskusiu o potrebe spomalenia vývoja a prísnejšej štátnej regulácie. Predstavitelia odborných komisií upozorňujú, že komerčné preteky medzi vývojármi a geopolitický boj o dominanciu v oblasti AI tlačia technológie vpred rýchlejším tempom, než akým stíha napredovať ich bezpečnostné zaistenie.
Viacerí experti preto volajú po dočasnom pozastavení vývoja extrémne pokročilých autonómnych modelov. Varujú totiž pred scenárom, kedy by nekontrolovaný príchod takzvanej superinteligencie – systémov výrazne múdrejších a schopnejších než človek – mohol spôsobiť škody, ktoré už nebude možné zvrátiť.