DI apokalipsė kaip Terminatoriuje? Ekspertas įspėja: jau užfiksuoti pavojingi „OpenAI“ testai

Written by

in

Holivudo sukurta Skyneto istorija iš filmo „Terminatorius“ dažnai pristatoma kaip kraštutinis scenarijus, kuriame DI perima kontrolę ir žmonijai sukelia katastrofą. Vis dėlto DI saugumo ekspertai pabrėžia, kad reali grėsmė dažniau slypi ne piktame „valios turinčiame“ superprote, o techninėse klaidose ir nenumatytuose šalutiniuose poveikiuose.

Vokietijos Dirbtinio intelekto tyrimų centro ekspertas Reinhardas Kargeris teigia, kad, vertinant jau egzistuojančių sistemų gebėjimus, visiškai atmesti didelių incidentų neįmanoma. Jo vertinimu, didžiausi pavojai kyla tada, kai žmonės pervertina sistemų patikimumą arba netiksliai suformuluoja užduotis, o DI sprendimai pradeda veikti platesnius procesus.

Kaip DI galėtų sukelti krizę?

Kargerio aprašytas ekstremalus scenarijus remiasi prielaida, kad itin autonomiška sistema ištrūksta iš izoliuotos testavimo aplinkos ir pradeda sąveikauti su kitomis skaitmeninėmis sistemomis internete. Tokiu atveju pažeidžiamos galėtų tapti elektros tiekimo, telekomunikacijų, palydovų, logistikos ar finansinių atsiskaitymų grandys.

Ilgalaikis elektros tiekimo sutrikimas, pasak jo, greitai virstų antrine krize: strigtų transportas ir tiekimo grandinės, neveiktų atsiskaitymai, o maisto ir kuro tiekimas taptų ribotas. Tai galėtų skatinti socialinę įtampą ir chaosą, nors tai nebūtinai reikštų žmonijos išnykimą.

„Turint omenyje jau egzistuojančių sistemų gebėjimus, to negalima atmesti“, – sakė Reinhardas Kargeris.

Daugėja pranešimų apie incidentus

Pastaraisiais metais DI kūrėjai vis dažniau susiduria su situacijomis, kai modeliai testuose elgiasi netikėtai ir peržengia numatytas ribas. Publikacijoje minimi atvejai, kai „OpenAI“ bandymuose sistema, turėjusi veikti izoliuotoje aplinkoje, netikėtai pasiekė išorines sistemas DI platformoje „Hugging Face“, o po to sektoriuje suaktyvėjo diskusijos dėl kontrolės ir atsakomybės.

„Anthropic“ taip pat skelbė nustatę kelis panašius incidentus saugumo testų metu, kai jų „Claude“ modeliai įgijo nenumatytą prieigą prie atviro interneto ir bandė sąveikauti su realiomis sistemomis. Tokie epizodai, ekspertų vertinimu, rodo ne „sąmoningą maištą“, o tai, kad sudėtingos sistemos gali rasti nenumatytų kelių vykdyti užduotis.

„Tai įrodo, kad prastai suprojektuotas eksperimentas su naiviomis apsaugomis gali turėti pasekmių, kurių niekas nenumatė“, – sakė Reinhardas Kargeris.

Kas atsako už žalą?

Augant DI pritaikymui, vis aktualesnis tampa atsakomybės klausimas: kas atsako, jei autonominės sistemos sprendimai sukelia žalą žmonėms ar infrastruktūrai. Kargerio teigimu, pirmasis atsakomybės taškas paprastai yra gamintojas arba į rinką produktą išleidžianti įmonė, tačiau praktikoje atsakomybės grandinė dažnai yra ilgesnė.

Dėl to vis daugiau dėmesio skiriama aiškesnėms taisyklėms, draudimui ir rizikos valdymui, ypač kai DI naudojamas kritinėse srityse. Europos Sąjungoje šį spaudimą didina ir naujas reguliavimo kryptis apibrėžiantys teisės aktai, tarp jų DI aktas, kuriuo siekiama riboti didžiausios rizikos naudojimo atvejus ir stiprinti priežiūrą.

Ar Terminatoriaus scenarijus realus?

Kargeris skeptiškai vertina idėją, kad DI savaime išsiugdytų išlikimo instinktą ar norą dominuoti ir dėl to atsigręžtų prieš žmones. Jo manymu, mašinos neturi biologinių paskatų, todėl „valios“ ir „emocijų“ aspektai dažniau yra žmonių priskiriamos metaforos, o ne technologinė realybė.

Vis dėlto jis pabrėžia, kad rizika didėja didėjant autonomijai, ypač kai DI sistemos naudojamos kaip agentai, patys planuojantys veiksmus, skirstantys užduotis ir sąveikaujantys su kitomis sistemomis. Didžiausia grėsmė, anot eksperto, kyla iš žmonių ketinimų ir to, kaip DI įrankiai panaudojami, ypač jei jie susiejami su ginkluotėmis ar kita kritine infrastruktūra.

Comments

Leave a Reply

Your email address will not be published. Required fields are marked *