Tā kā mākslīgais intelekts kļūst arvien spējīgāks, arvien svarīgāks kļūst jautājums par to, vai mēs varam kontrolēt, kā tiek iegūti mūsu rezultāti. Šī tēma ir izraisījusi diezgan interesantas debates, kas, atklāti sakot, var būt nedaudz biedējošas. OpenAI eksperimentē ar tehnoloģijām, kas varētu fundamentāli mainīt mākslīgā intelekta “domāšanas” veidu, un daži drošības eksperti brīdina, ka tas varētu ievērojami apgrūtināt tā domāšanas uzraudzību.

Gmail logotipa krāsa

Mūsdienu modeļi, risinot sarežģītas problēmas, izveido starpposmu ķēdi, caur kuru tie pakāpeniski nonāk pie rezultāta, kas ir ārkārtīgi noderīgi pētniekiem. Viņiem nav loģiski jāpārbauda tikaioneMākslīgā intelekta reakcija, bet tie var arī analizēt tā progresu un meklēt bīstamas vai nevēlamas uzvedības pazīmes. Galu galā, pats mākslīgais intelekts OpenAI pati šo ķēdi dēvē par vienu no savas drošības sistēmas slāņiem.

Problēma var rasties, radot jaunas arhitektūras.

Kā vēsta laikraksts “The Independent”, pētnieki tagad koncentrējas uz pieejām, kurās modelis atkārtoti apstrādā datus “iekšpusē”, kas nozīmē, ka daļa “spriešanas” var nenotikt viegli lasāmas teksta virknes veidā, bet gan paša modeļa iekšpusē. Un tas rada bažas dažiem ekspertiem. Ja nākotnes mākslīgais intelekts spētu veikt arvien sarežģītāku spriešanu tādā veidā, ko drošības sistēmas nevar viegli uzraudzīt, viena no mūsdienās izmantotajām kontroles metodēm varētu pakāpeniski zaudēt savu efektivitāti.

roblox,chatgpt,reddit ikonas

Interesanti, ka pašreizējie pētījumi OpenAI parāda diezgan pozitīvu vēstījumu. Uzņēmums testēja 13 modeļus un noskaidroja, cik labi tie spēj apzināti kontrolēt vai slēpt savu ķēdi. Taču pat labākie pašreizējie modeļi nepārsniedza 15,4 % veiksmes rādītāju. Citiem vārdiem sakot, mūsdienu mākslīgajam intelektam ir samērā liela problēma ar apzinātu domāšanas maskēšanu, kas OpenAI uzskata to par labu funkciju no drošības viedokļa. Tomēr uzņēmums arī norāda, ka nemaz nav skaidrs, vai tas tā paliks arī turpmākajos un jaudīgākajos modeļos. Tāpēc tas vēlas turpināt regulāri izvērtēt domu ķēdes uzraugāmību. Taču, ko nesīs nākotne, protams, ir jautājums, ņemot vērā, ka jau esam pieredzējuši dažus incidentus, kad mākslīgais intelekts izgāja no kontroles un uzbruka tīmekļa vietnei vai konkurējošam aģentam.