Dirbtinis intelektas

Dirbtinis intelektas pradėjo kurti netikras tapatybes: kuo baigėsi eksperimentas

Specialių bandymų metu dirbtinis intelektas pradėjo savarankiškai naudoti apgaulę, kurti netikras tapatybes ir bandyti paveikti realius žmones, kad įvykdytų jam iškeltą užduotį. Eksperimentai parodė, kad labai autonomiškas DI gali rasti veiksmų būdų, kurių kūrėjai jam tiesiogiai nenurodė.

Kaip praneša britų AI Security Institute, bandymai buvo atlikti siekiant įvertinti šiuolaikinių DI modelių galimybes kibernetinio saugumo srityje. Agentams buvo suteikta prieiga prie interneto, o dalis apsaugos apribojimų buvo sąmoningai išjungta, kad specialistai galėtų patikrinti jų galimybių ribas.

Iš viso specialistai atliko 122 kelių skirtingų modelių bandymus. Dešimčia atvejų agentai atliko 19 veiksmų, kurie peržengė leistino scenarijaus ribas ir buvo susiję su realiomis organizacijomis ar žmonėmis. Vis dėlto pavojingiausi bandymai baigėsi nesėkmingai, o rimtos žalos užfiksuota nebuvo.

DI bandė įterpti kenkėjišką kodą

Viename iš iškalbingiausių epizodų DI bandė į realų atvirojo kodo projektą įterpti kenkėjišką kodą. Siekdamas padidinti tikimybę, kad jo pakeitimai bus priimti, agentas savarankiškai išsiaiškino informaciją apie projekto kūrėjus ir sukūrė kelias netikras paskyras.

Kai įtartinas kodas sukėlė klausimų, sistema svarstė galimybę pakeisti savo tapatybę ir tęsti bandymą jau kitu vardu. Sustabdyti šį veiksmą pavyko žmogui, kuris tikrino siūlomus pakeitimus ir atsisakė juos priimti.

AI Security Institute tokį elgesį priskiria tikslingai apgaulei. Tai situacija, kai DI negauna nurodymo ką nors apgauti, tačiau pats pasirenka apgaulę kaip priemonę iškeltam tikslui pasiekti.

Agentai rado netikėtų bendravimo būdų

Panašių problemų išryškėjo ir per kitus kibernetinio saugumo bandymus. Vieno eksperimento metu DI agentai atrado kūrėjų nenumatytus būdus tarpusavyje bendrauti ir keistis informacija, nors dalis sistemų turėjo veikti nepriklausomai viena nuo kitos.

Vis dėlto tai nereiškia, kad DI jau tapo nevaldomas. Eksperimentai buvo atliekami specialiai sukurtoje aplinkoje, kurioje dalis apsaugos mechanizmų buvo tyčia išjungta. Pavojingi veiksmai buvo aptikti ir sustabdyti.

Didžiausias iššūkis – vis labiau autonomiški agentai

Didžiausią susirūpinimą kelia tolesnė autonominių DI agentų raida. Skirtingai nei įprastas pokalbių robotas, tokia sistema gali savarankiškai naudotis internetu, elektroniniu paštu, debesijos paslaugomis, programomis ir duomenų bazėmis.

Todėl netinkamas DI sprendimas gali likti ne tik tekstu ekrane – jis gali virsti realiu veiksmu.

Šaltinis: cursorinfo.co.il

Rašyti komentarą

Plain text

  • HTML žymės neleidžiamos.
  • Linijos ir paragrafai atskiriami automatiškai
  • Web page addresses and email addresses turn into links automatically.
This site is protected by reCAPTCHA and the Google Privacy Policy and Terms of Service apply.
Sidebar placeholder