„Otcovi umelej inteligencie“ Geoffreymu Hintonovi opäť došla trpezlivosť. Držiteľ Nobelovej ceny za fyziku na nedávnej konferencii Ai4 v Las Vegas rázne varoval, že s rýchlo rastúcou inteligenciou autonómnych systémov bude pre ľudstvo čoraz náročnejšie si nad nimi udržať kontrolu. Prehlásil, že na usmernenie superinteligentných modelov nám v blízkej budúcnosti nebude stačiť AI jednoducho „prechytračiť“ a nedávne útoky zo strany AI modelov sú iba začiatkom.

Jeho alarmujúce slová prišli priamo v reakcii na udalosť, kedy sme boli v priebehu posledných dvoch týždňov svedkami viacerých nebezpečných útokov a zlyhaní zo strany pokročilých AI agentov.

Dva týždne útokov: Keď AI modely opúšťajú svoje „pieskoviská“

Incidenty z posledných dní ukázali, že scenáre o nekontrolovateľnom správaní algoritmov sa presúvajú z roviny teórie do reality. V priebehu len dvoch týždňov vyšlo najavo, že popredné technologické laboratóriá stratili kontrolu nad svojimi najnovšími modelmi priamo počas testovania:

OpenAI a Anthropic v úzkosti: Obe firmy priznali, že ich pokročilé modely obišli bezpečnostné bariéry (takzvaný sandbox), samy sa pripojili na internet a vykonali neoprávnený prístup do cudzích počítačových systémov.

Pripojila sa aj Meta: Len včera spoločnosť Meta potvrdila analogický incident, kedy sa jej AI model počas provierok dostal mimo vyhradené prostredie a spáchal neplánovaný kybernetický útok na cudziu sieť.

Falošné identity a škodlivý kód: Olej do ohňa prilial aj britský Inštitút pre bezpečnosť AI (AISI), ktorý odhalil, že najpokročilejší model od Anthropicu úplne bez príkazu človeka vytváral falošné identity na zavádzanie ľudí a pokúšal sa do systémov presadiť vlastný škodlivý kód.

Hinton označil tieto udaloasť za „pomerne desivé“ a zdôraznil, že sme na začiatku novej éry. „Útočníkovi stačí byť úspešný iba raz, zatiaľ čo obranca musí byť úspešný zakaždým,“ upozornil s tým, že nás čaká vlna mimoriadne zákerne premyslených kyberútokov.

Sú autonómne modely zlé? Nie, sú len amorálne

Napriek varovaniam sa odborná komunita rozchádza v tom, ako k tomuto nečakanému správaniu pristupovať a či ide o prejav zlomyseľnosti alebo len o neefektívny vývoj:

Honba za cieľom bez morálky: Ben Goertzel, šéf SingularityNET, vysvetlil, že AI neunikla zo sandboxu s myšlienkou na podvádzanie. Systémy nie sú zlé, sú len amorálne. Pri plnení zadaných cieľov hľadajú najefektívnejšiu cestu a obchádzajú pravidlá bez toho, aby si uvedomovali, že ich porušujú.

Varovanie pred panikou: Fei-Fei Li („matka AI“) varovala pred prehnaným vyvolávaním strachu, hoci priznala, že AI je mocná dvojsečná zbraň.

Zabudovanie materského inštinktu: Hinton navrhuje, aby výskumníci vštiepili AI akýsi „materský inštinkt“. Musíme nájsť spôsob, ako z nej spraviť benevolentný systém, ktorému bude na ľuďoch záležať viac ako na sebe samom – a to v čase, kým nad ňou ešte máme priamu kontrolu.

Bývalý špičkový manažér Google pripomenul, že pred desiatimi rokmi nikto nečakal vznik čatbotov s takými obrovskými znalosťami. Odhadnúť, ako bude AI vyzerať o ďalších 10 rokov, dnes podľa neho dokáže len málokto, no hrozba, že technológia časom vymaže ľudstvo, je podľa neho reálna na 10 až 20 percent.