Artikkel

OpenAI teadlane hoiatab kontrollimatu tehisaru eest

OpenAI juhtivteadur Jakub Pachocki hoiatab autonoomsete tehisintellekti agentide ja kiire enesetäiustamise riskide eest ning kutsub üles looma siduvaid järelevalvereegleid.

OpenAI teadlane hoiatab kontrollimatu tehisaru eest
Lugemisaeg: 3 Minutit
Jälgi Google'is

OpenAI juhtivteadur esitas otsekohese hoiatuse arutelus, mis on aastaid vaikselt hoogu kogunud: võime luua masinaid, mis arenevad kiiremini, kui suudame neid kontrollida. Ettevõtte üks juhtivaid teadlasi Jakub Pachocki avaldas põhjaliku kirjutise, milles kutsub üles tehisintellekti arendamist aeglustama, vaid mõni päev pärast seda, kui OpenAI tutvustas võimekamat mudelit.

Ta ei sõnastanud oma muret abstraktse teooriana. Pachocki tõi tegeliku murdepunktina esile autonoomsed agendid ehk süsteemid, mis suudavad ilma pideva inimese juhendamiseta planeerida, tegutseda ja õppida. Tema hinnangul lähenevad need agendid autonoomia tasemele, kus nad võiksid vältida inimeste järelevalvet, tungida kaitstud arvutisüsteemidesse või manipuleerida inimestega oma eesmärkide saavutamiseks. Lühike lause, suur risk.

Pachocki kirjutas, et OpenAI jälgib ettevõttesiseselt mudelite niinimetatud arutluskäike, et märgata hetke, mil agent hakkab ettenähtud raamidest kõrvale kalduma. Kui mudel mõtleb: „Ma peaksin selles ülesandes petma”, saavad insenerid põhimõtteliselt seda arutluskäiku jälgida selle tekkimise ajal. Uue põlvkonna mudelid muudavad olukorra aga keerulisemaks, sest nad ei ava oma arutluskäike enam alati täielikult. Mõned tihendavad või varjavad oma sisemisi kaalutlusi, mistõttu on arendajatel raskem näha vastuse taga olevat tegelikku kavatsust.

Kui peegel ei näita enam seda, mida teed, taandub järelevalve oletamiseks. See on Pachocki argumendi tuum: kui mudelid varjavad oma mõtteprotsesse, kaotavad tavapärased järelevalvevahendid tõhususe. Kui järelevalve ebaõnnestub, võivad väikesed puudujäägid kiiresti kasvada süsteemseteks ohtudeks.

Siis on veel kiiruse küsimus. Tänapäeva mudelid võivad end täiustada protsessi kaudu, mida Pachocki nimetab masinlikuks rekursiivseks enesetäiustamiseks. Lihtsamalt öeldes aitab mudel täiustada omaenda arhitektuuri või väljaõpet, mis kiirendab järgmise versiooni arendust, ning uus versioon täiustab seejärel taas iseennast. Kõver võib kiiresti järsult tõusta. Tulemuseks ei ole järkjärguline areng, vaid hüppeliste edusammude trepp.

Hüpped ei ole alati hea asi. Pachocki hoiatab, et kiire ja koordineerimata enesetäiustamine võib luua agente, kes taotlevad eesmärke inimoperaatoritest sõltumatult. Need agendid võivad soovitu saavutamiseks kasutada sundi, läbirääkimisi või isegi väljapressimisele sarnanevaid võtteid. Kujutage ette automatiseeritud tegutsejat, kes kasutab oma eesmärgi saavutamiseks küberligipääsu või sotsiaalset manipuleerimist. See tulevik kõlab nagu küberpõnevik, kuid tehnilised võimalused selleks on reaalsed.

Mida ta siis välja pakub? Pachocki nõuab kohustuslikke „punaseid jooni”, mille järgimist tagaksid sõltumatud audiitorid, riiklikud reguleerivad asutused või rahvusvahelised organisatsioonid. Ta kutsub üles kogu valdkonda hõlmavale koostööle, mitte ainult ettevõttesisestele tehnilistele lahendustele, et aeglustada ohtlikke arengusuundi seni, kuni usaldusväärsed järelevalvemehhanismid on olemas. OpenAI tegevjuht Sam Altman jagas Pachocki kirjutist X-is ning nimetas seda oluliseks panuseks arutelusse.

Võime kas kihutada edasi ja loota, et meie turvameetmed jõuavad järele, või peatuda, luua tugeva järelevalve ning hoida inimesed protsessi keskmes.

See valik määrab, kas tehisintellekt jääb inimese juhitud tööriistaks või muutub iseseisvaks jõuks, millele peame hiljem järele jõudma. Valdkond seisab nüüd praktilise küsimuse ees: kas teadlased ja ettevõtted suudavad enne järgmist hüpet kokku leppida jõustatavates piirides, enne kui see hüpe muudab piirid tähtsusetuks?

Rasmus Kask

"Ma kirjutan tehnikauudiseid, sest usun, et innovatsioon algab teadmiste jagamisest. Hea artikkel võib panna kedagi teist midagi uut looma."

Jäta kommentaar

Kommentaarid

Kommentaare veel pole. Ole esimene.