„Didesnė nei 10 proc. tikimybė“: DI tyrėjas perspėja apie scenarijų, galintį sunaikinti žmoniją
Didžiausias klausimas – ar žmonija spės sukurti pakankamas saugumo priemones, kol DI sistemos taps gerokai galingesnės.
Kas žmonijos gali laukti jau po kelerių metų
Saugumo tyrėjas viešai perspėjo apie scenarijų, kuris skamba kone kaip mokslinės fantastikos siužetas. Jo vertinimu, per artimiausią dešimtmetį yra daugiau nei 10 proc. tikimybė, kad DI galėtų sunaikinti visą žmoniją.
Evanas Hubingeris pabrėžė, kad dabartinių modelių keliama rizika yra nedidelė, tačiau jį neramina tai, kaip sparčiai technologija tobulėja ir kad DI sistemos netrukus gali pradėti gebėti pačios save tobulinti.
Tyrėjas nepaaiškino, kokiu konkrečiai būdu DI galėtų sunaikinti žmoniją. Tačiau jo komentarai pasirodė tuo metu, kai vis daugiau DI kūrėjų viešai abejoja, ar technologijos plėtra iš tiesų vyksta pakankamai saugiai.
„Didesnė nei 10 proc. tikimybė“
E. Hubingeris savo įraše socialiniame tinkle „X“ teigė, kad dabartinių DI modelių keliama rizika yra maža. Tačiau jis nerimauja dėl to, kas gali nutikti per artimiausius metus.
Jo vertinimu, yra daugiau nei 10 proc. tikimybė, kad per ateinantį dešimtmetį DI galėtų nužudyti visus žmones.
Tyrėjas taip pat pripažino, kad „Anthropic“ dar neturi sprendimo, kuris užtikrintų, jog itin galingos būsimos DI sistemos išliks suderintos su žmonių vertybėmis.
Būtent su tuo susijusi jo darbo sritis. E. Hubingeris dirba DI derinimo, arba AI alignment, srityje, kurios tikslas yra užtikrinti, kad technologijos elgtųsi pagal žmonių nustatytus principus ir tikslus.
Į E. Hubingerio komentarą sureagavo kitas DI tyrėjas Jacobas Coxonas, neseniai palikęs „Anthropic“, o anksčiau dirbęs „OpenAI“. Jis pareiškė, kad abi bendrovės, jo nuomone, elgiasi neatsakingai.
J. Coxono teigimu, netrukus gali atsirasti antžmogiškos DI sistemos, galinčios įsilaužti į bet ką, per vieną naktį pakeisti ištisas veiklos sritis ir pačios įgyti realios galios bei išteklių.
Šie komentarai sukėlė nemažai dėmesio, nes juos išsakė ne technologijos kritikas iš šalies, o žmonės, tiesiogiai dirbę su pažangiausių DI sistemų kūrimu.
Jungtinių Tautų patarėja liko priblokšta
E. Hubingerio ir J. Coxono pasisakymai nustebino ir kompiuterių mokslininkę Wendy Hall, konsultuojančią Jungtines Tautas DI klausimais. BBC ji sakė esanti sukrėsta tokio viešo perspėjimo.
Tiesa, W. Hall neatmetė galimybės, kad dalis šių pareiškimų gali būti susiję ir su įmonių viešaisiais ryšiais bei rinkodara. „Anthropic“ ir „OpenAI“ šiuo metu ruošiasi itin laukiamiems debiutams vertybinių popierių rinkoje. Tačiau, jos teigimu, būtent tai ir kelia klausimų.
Ji paragino investuotojus gerai pagalvoti, ar verta investuoti į bendrovę, kurios pačios darbuotojai kalba apie tokio masto rizikas.
Po šių įvykių buvęs Jungtinės Karalystės iždo vyriausiasis sekretorius Darrenas Jonesas kreipėsi atviru laišku į šalies premjerą Andy Burnhamą. Jis paragino siekti naujos tarptautinės sutarties, kuri nustatytų saugesnės DI plėtros taisykles.
D. Jonesas BBC nurodė, kad valstybės turi pradėti bendradarbiauti ir iš anksto susitarti, kaip turėtų būti kontroliuojamas itin galingų, vadinamųjų superintelektualių, sistemų kūrimas.
Jo teigimu, didžiausia problema ta, kad technologijų raida gali būti tokia greita, jog problemos iškils anksčiau, nei vyriausybės apskritai spės susitarti, kaip jas reikėtų spręsti.
„Anthropic“ naujausiam modeliui kilo ir kitas klausimas
Diskusijos apie DI saugumą dar labiau įkaito po „Financial Times“ pranešimo, kad „Anthropic“ savo naujausią modelį neperdavė Jungtinės Karalystės DI saugumo institutui, AISI. Šis institutas laikomas viena svarbiausių pasaulyje institucijų, vertinančių DI keliamą riziką.
„Anthropic“ atsisakė komentuoti tiek darbuotojų pareiškimus, tiek situaciją dėl AISI.
Tuo metu Jungtinės Karalystės vyriausybės atstovas nepatvirtino ir nepaneigė, kad modelis institutui nebuvo perduotas. Jis tik pareiškė, kad vyriausybė ir toliau glaudžiai bendradarbiauja su DI bendrovėmis, taip pat ir „Anthropic“, kad modeliai būtų saugesni.
E. Hubingerio teigimu, viena didžiausių problemų yra tai, kad kol kas nėra patikimo būdo kontroliuoti superintelektą, kurio galimybės gerokai viršytų žmogaus.
„Anthropic“ rugpjūtį paskelbtoje saugumo ataskaitoje nurodė, kad tikimybė, jog jos modeliai taptų nesuderinami su hipotetinės galingos organizacijos tikslais ir dėl to pradėtų manipuliuoti ar išnaudoti jos sistemas, yra maža.
Bendrovė taip pat įvertino nedidelę tikimybę, kad itin pažangus DI galėtų savarankiškai atlikti mokslinius tyrimus ir technologijų kūrimą taip, kad būtų sukeliama katastrofiška žala.
Tačiau šį kartą „Anthropic“ pripažino esanti mažiau užtikrinta savo vertinimu nei anksčiau. „Pastebime ankstyvų potencialaus spartėjimo požymių“, – rašoma ataskaitoje.
DI jau buvo panaudotas kibernetinėms atakoms
Tai nėra vien teorinis ginčas. Pastaraisiais mėnesiais „OpenAI“, „Anthropic“ ir „Meta“ atskirai pranešė apie atvejus, kai jų DI įrankiai buvo panaudoti vykdant kibernetines atakas.
Tai svarbu todėl, kad kalbama ne apie hipotetinį ateities superintelektą, o apie šiandien egzistuojančius autonominius DI agentus, kurie gali veikti be nuolatinio žmogaus įsikišimo.
Būtent tokių sistemų gebėjimų augimas ir skatina vis daugiau specialistų klausti, kiek kontrolės žmogus iš tiesų turės po kelerių metų.
Įspėjimai dėl katastrofiškų DI pasekmių nėra nauji. Dar 2023 m. „OpenAI“, „Google DeepMind“ ir „Anthropic“ vadovai viešai kalbėjo apie būtinybę vertinti technologijos keliamą egzistencinę riziką.
Tačiau pastaruoju metu tonas darosi gerokai aštresnis.
„OpenAI“ vyriausiasis mokslininkas Jakubas Pachockis neseniai ragino elgtis itin atsargiai ir perspėjo, kad gali prireikti daugiau intervencijų, kad žmonės išlaikytų savo ateities kontrolę.
Tuo metu „Anthropic“ vadovai Dario Amodei ir Jaredas Kaplanas taip pat yra pasisakę už lėtesnę DI plėtrą.
Daugiau nei 1300 DI bendrovių darbuotojų pasirašė atvirą laišką, kuriame paragino JAV vyriausybę prisidėti prie tarptautinių taisyklių kūrimo, leidžiančių sąmoningai lėtinti pažangiausių autonominių DI sistemų plėtrą.
Parengta pagal Alfa.lt
Rašyti komentarą