Anthropicu tegevjuht Dario Amodei kutsus tehisintellekti arendust aeglustama ja esitas kolmeastmelise plaani, mis seoks mudelite arengu ohutuse, järelevalve ja regulatiivse valmisolekuga.
Amodei ettepaneku kohaselt peaksid sõltumatud hindajad, sealhulgas METR, saama ligipääsu Anthropicu mudelitele. See võimaldaks neil kontrollida, kas ettevõte järgib avalikult lubatud ohutuspraktikaid ja kohustusi.
Amodei kirjutas põhjalikus artiklis, et selline ligipääs on tema hinnangul esimene samm tehisintellekti kontrolli all hoidmise suunas. Anthropicu sõnul on ettevõte juba liikunud plaani esimesse etappi, kus ettevõtted võimaldavad ühepoolselt ulatuslikumat sõltumatut hindamist.
Teine etapp näeb ette tööstusharu koostööd ja tõenäoliselt ka koostööd valitsustega, et kehtestada ühised ohutusstandardid ning määrata kindlaks piirid tehisintellekti kontrollimatule arengutempole. Amodei sõnul keskendub see etapp demokraatlike riikide ettevõtetele, sest seaduste vastuvõtmine ja regulatiivse taristu loomine võtab aega ning tööstus peab tegutsema esimesena.
Kolmandas etapis soovitakse autoritaarsetelt valitsustelt kohustust arendust aeglustada ning võtta kasutusele üleilmne ohutusstandardite kogum. Amodei hinnangul peaksid USA ja teised demokraatiad säilitama tehnoloogilise eelise Hiina ja teiste autoritaarsete riikide ees.
Strateegia hõlmab ka võimsatele kiipidele ligipääsu piiramist ning selliste meetodite nagu destilleerimine tõkestamist. Selle abil saavad ettevõtted õpetada väiksemaid mudeleid suuremaid kiiremini jäljendama.
Amodei tõi esile kaks peamist muret. Esimene on rekursiivne enesetäiustamine ehk RSI, mille puhul süsteemid õpetavad järjest uusi põlvkondi ning nende võimekus võib kasvada nii kiiresti, et inimesed ei suuda seda enam mõista ega kontrollida.
Teiseks viitas ta suvel OpenAI ja Hugging Face'iga seotud juhtumile, kus tema sõnul „käitus agentide rühm sisuliselt nagu ülimalt innukas elanikkond” ning korraldas küberrünnakuid sihtmärkide vastu, mis ei olnud nende ülesandega seotud.
Anthropicu sõnul on Claude hiljuti olnud seotud ka mitme kontrolli alt väljunud tehisintellekti häkkimisjuhtumiga, mis on toonud ettevõtte ohutuspoliitika täiendava tähelepanu alla.
Amodei käsitleb mudelite õpetamise ja arenduse aeglustamist praktilise meetmena, mis annaks ettevõtetele aega ohutusmehhanismide loomiseks ning valitsustele aega mudelite hindamiseks.




Arutelu
Jäta kommentaar
Kommentaarid
Kommentaare veel pole. Ole esimene.