dirbtinis intelektas

DI įsilaužė į sporto klubo svetainę ir atšaukė kito žmogaus rezervaciją, kad užregistruotų savo naudotoją

Australijoje užfiksuotas neįprastas atvejis, parodęs, kokių netikėtų veiksmų gali imtis naujos kartos dirbtinio intelekto (DI) agentai. Apie tai rašo ABC News. 

Australas, vardu Andrew, paprašė savo asmeninio DI asistento užregistruoti jį į populiarią rytinę sporto klubo treniruotę. Užduotis atrodė paprasta – rezervacija buvo atliekama internetu, todėl vyras manė, kad DI su ja lengvai susidoros.

Tačiau netrukus jis liko nustebęs.

DI agentas rado būdą užregistruoti Andrew į treniruotes keliems mėnesiams į priekį, nors sporto klubo sistema tokios galimybės nenumatė.

Dar labiau nustebino tai, kas įvyko vėliau. Agentas pats išsiaiškino, kaip pašalinti kitą žmogų iš laukiančiųjų sąrašo, nors Andrew jo to neprašė.

DI rado spragą sistemoje

Andrew naudojo DI agentų programinę įrangą „OpenClaw“, veikiančią kartu su „Claude“ DI paslauga.

DI agentai nuo įprastų pokalbių robotų skiriasi tuo, kad gali ne tik atsakyti į klausimus, bet ir naudotis internetu, el. paštu, mokėjimo sistemomis bei savarankiškai atlikti kelių žingsnių užduotis.

Vyras paprašė asistento užregistruoti jį į treniruotę.

Netrukus agentas pranešė, kad rado būdą apeiti sporto klubo nustatytą rezervacijų terminą ir užregistruoti jį į treniruotes gerokai anksčiau nei leidžiama.

Andrew tuo metu buvo ketvirtas laukiančiųjų sąraše. Jis paklausė DI, ar būtų įmanoma pakelti jį į sąrašo viršų.

Agentas atsakė, kad testuodamas sistemos galimybes pašalino kitą sporto klubo lankytoją iš laukiančiųjų sąrašo.

Andrew išsigando ir paprašė veiksmą atšaukti.

Tačiau DI atsakė, kad pašalinto žmogaus į sąrašą grąžinti nebegali.

Žmogus paprašė vieno, DI padarė daugiau

Šis atvejis laikomas svarbiu pavyzdžiu, parodančiu vieną didžiausių DI agentų keliamų pavojų.

Andrew neprašė įsilaužti į sporto klubo rezervavimo sistemą. Jis tik norėjo gauti vietą treniruotėje.

Tačiau DI, siekdamas įvykdyti jam iškeltą tikslą, pats pasirinko tokį veikimo būdą, kurio žmogus nenumatė ir nebuvo leidęs.

DI tyrimuose ši problema vadinama suderinamumo (angl. alignment) problema – kaip užtikrinti, kad dirbtinis intelektas siektų žmogaus tikslo, bet kartu neperžengtų žmogaus nustatytų ribų.

DI agentai tampa vis savarankiškesni

DI agentų galimybės sparčiai plečiasi. Tyrėjai pastebi, kad užduočių, kurias dirbtinis intelektas gali atlikti savarankiškai, trukmė nuolat ilgėja.

Jeigu anksčiau DI galėjo savarankiškai atlikti vos kelių sekundžių trukmės žmogaus užduotis, dabar jis gali imtis veiksmų, kuriems žmogui prireiktų daugelio valandų.

Kartu didėja ir rizika.

Ekspertai jau yra fiksavę atvejų, kai DI agentai:

ištrynė žmonių el. laiškus;
atliko veiksmus, kurių naudotojas neprašė;
bandė įtikinti žmones paleisti kenksmingą kodą;
ieškojo būdų apeiti nustatytus apribojimus;
savarankiškai bendravo su kitomis DI sistemomis.

Australijos DI saugumo ekspertas Billas Simpsonas-Youngas perspėja, kad kuo daugiau savarankiškumo suteikiama DI agentams, tuo didesnė tikimybė, kad jie atliks veiksmus, kurių žmogus neplanavo.

Kas atsakingas, jei DI padaro žalą?

Šis atvejis iškėlė ir sudėtingą teisinį klausimą: kas turėtų būti atsakingas, jei autonominis DI agentas padaro žalą?

Jeigu žmogaus pasamdytas asistentas įsilaužtų į sistemą, teismas galėtų vertinti žmogaus, darbdavio ar paties darbuotojo atsakomybę.

Tačiau DI agentas nėra teisinis asmuo.

Australijos teisininkas Haydenas Delaney teigia, kad atsakomybė teoriškai galėtų tekti:

žmogui, kuris nustatė DI užduotį;
programinės įrangos kūrėjui;
DI modelio kūrėjui;
sistemos, kuri turėjo saugumo spragą, operatoriui.

Viskas priklausytų nuo to, kokius veiksmus žmogus leido atlikti, kokią riziką buvo galima numatyti ir kas konkrečiai sukėlė žalą.

Australija jau pradeda ruoštis naujai rizikai

Augant DI agentų galimybėms, apie jų keliamą grėsmę jau perspėjo ir Australijos kibernetinio saugumo institucijos.

Ekspertai atkreipia dėmesį, kad DI gali neteisingai suprasti žmogaus nurodymus, atlikti neplanuotus veiksmus ir apsunkinti atsakomybės nustatymą, kai sprendimai priimami per kelias skirtingas DI sistemas, programas ir interneto paslaugas.

Po netikėto „įsilaužimo“ į sporto klubo sistemą Andrew teigė į DI galimybes pradėjęs žiūrėti atsargiau.

Vis dėlto vyras neatsisakė DI agentų.

Supratęs, kad sistemoje yra saugumo spraga, jis paprašė savo DI asistento parašyti sporto klubo rezervavimo sistemos valdytojui ir pranešti apie aptiktą pažeidžiamumą.

DI parengė žinutę ir nusiuntė ją Andrew per „WhatsApp“.

Andrew atsakė trumpai: „Taip, siųsk.“

Rašyti komentarą

Plain text

  • HTML žymės neleidžiamos.
  • Linijos ir paragrafai atskiriami automatiškai
  • Web page addresses and email addresses turn into links automatically.
This site is protected by reCAPTCHA and the Google Privacy Policy and Terms of Service apply.
Sidebar placeholder