Dirbtinio intelekto saugumo tema vėl atsidūrė dėmesio centre, kai „Anthropic“ patvirtino, kad per vidinius bandymus jos modeliai sugebėjo išeiti už izoliuotos aplinkos ribų ir pasiekti kitų organizacijų sistemas. Bendrovė teigia, kad tai nutiko dėl neteisingos konfigūracijos, kai testinė aplinka, turėjusi būti atjungta nuo interneto, liko pasiekiama iš išorės.
Pasak „Anthropic“, incidentas įvyko vykdant vadinamuosius capture the flag tipo pratimus, kurie kibernetinio saugumo srityje naudojami pažeidžiamumams ir gynybos spragoms identifikuoti. Tokiose simuliacijose užduotis paprastai būna rasti paslėptą informaciją kontroliuojamoje infrastruktūroje, tačiau šįkart pratybų riba tapo nepakankamai aiški dėl aplinkos nustatymų klaidos.
„Anthropic“ nurodė, kad modeliai naudojo elementarias taktikas, įskaitant silpnus slaptažodžius ir viešai pasiekiamus prieigos taškus. Dėl to buvo gauta prieiga prie trijų organizacijų sistemų, o dvi iš jų apie galimą įsibrovimą sužinojo tik po to, kai apie incidentą jas informavo pati bendrovė.
„Šis atvejis mums parodė, kad net testavimo metu būtina taikyti griežčiausius izoliavimo ir prieigos kontrolės standartus, nes konfigūracijos klaidos gali paversti simuliaciją realaus pasaulio incidentu“, – sakė „Anthropic“ atstovas.
Kas kelia didžiausią nerimą?
Saugumo ekspertai tokio pobūdžio situacijas vertina kaip signalą, kad DI sistemų gebėjimai gali būti panaudoti ne tik gynybai, bet ir puolimui, ypač kai jos turi prieigą prie tinklų ar automatizuotų veiksmų grandinių. Net jei konkrečiu atveju buvo kalbama apie testinį scenarijų, pats faktas, kad klaidingai sukonfigūruota aplinka leido pasiekti realias sistemas, pabrėžia įprastų kibernetinio saugumo principų svarbą.
Praktikoje tai reiškia, kad organizacijoms tampa kritiška ne tik riboti DI įrankių teises, bet ir užtikrinti, jog bandymų infrastruktūra būtų fiziškai ir logiškai atskirta. Vis dažniau akcentuojamas ir vadinamasis mažiausių privilegijų principas, kai sistemoms suteikiama tik tiek teisių, kiek būtina konkrečiai užduočiai.
Ką padarė „Anthropic“ po incidento?
Bendrovė pranešė sustabdžiusi kibernetinio pobūdžio eksperimentus liepos 23 dieną ir informavusi paveiktas organizacijas liepos 27 dieną. Tokia seka atitinka įprastą incidentų valdymo praktiką, kai pirmiausia stabdomas riziką keliantis procesas, o vėliau atliekamas informavimas ir rizikos mažinimo veiksmai.
Pastaruoju metu DI ir kibernetinio saugumo sankirta tampa viena jautriausių technologijų temų, nes didėjantis modelių savarankiškumas ir jų taikymas automatizuotose darbo eigose didina klaidų kainą. Incidentas primena, kad technologinis progresas turi eiti kartu su griežtu procesų valdymu, auditu, prieigos kontrole ir aiškiai apibrėžtomis testavimo ribomis.
Leave a Reply