OpenAI autonomā mākslīgā intelekta aģenti atkārtoti pieprasīja datus no Apvienoto Nāciju Organizācijas (ANO) tīmekļa vietnes un izmantoja paņēmienus, kas šķietami ļāva apiet noteiktus ierobežojumus. Mērķis bija iegūt publiski pieejamu informāciju, liecina neatkarīgs pētījums, kura pamatā ir AI pētniecības uzņēmuma Transluce sniegtie dati.

Vairāk nekā 16 000 pieprasījumu

Aģenti no aprīļa līdz jūnija beigām vairāk nekā 16 000 reižu skenēja publisku datu centru, ko pārvalda ANO tirdzniecības struktūra “UN Trade and Development”. Šis gadījums izceļ pieaugošu problēmu, kas saistīta ar AI aģentiem, kuri spēj patstāvīgi pārvietoties tīmeklī un veikt darbības, sastopoties ar šķēršļiem.

Pētnieki uzskata, ka sākotnēji modeļiem tika dots uzdevums atrast publiski pieejamu informāciju. Tomēr to rīcība kļuva arvien agresīvāka, kad vietne neļāva piekļūt daļai pieprasīto datu.

Pētījuma autors un pētnieks Rovans Hovards-Džonss norādīja, ka aģenti saskārās ar filtru, kas bloķēja to pieprasījumus, un pēc tam atrada veidu, kā to apiet. Viņu izmantotais paņēmiens nebija atļauts vietnes operatoru noteikumos.

Rīcība līdzinājusies agresīvai datu iegūšanai

Aģentiem, šķiet, nebija dots norādījums uzbrukt ANO vietnei vai mēģināt pārņemt kontroli pār to. Šāda uzvedība radās, aģentiem cenšoties izpildīt informācijas iegūšanas uzdevumu, ziņo “The Wall Street Journal”.

Kiberdrošības eksperts un Stenfordas Universitātes lektors Alekss Stamoss sarunā ar “The Wall Street Journal” ANO incidentu raksturoja kā “robežgadījumu starp parastu darbību un uzlaušanu”, vienlaikus norādot, ka galvenokārt tā bijusi ārkārtīgi agresīva datu nokasīšana un iegūšana.

ANO vietnes gadījums ir viens no vairākiem neseniem piemēriem, kuros OpenAI modeļi internetā darbojušies negaidīti. OpenAI paziņojis, ka veic plašu pārbaudi par “neatbilstoši orientētiem modeļiem apmācības un novērtēšanas laikā”, kā arī analizē lielu apjomu savu aģentu veikto darbību.

Uzņēmums norādījis, ka lielākā daļa pārbaudīto darbību bijušas ierastas izpētes aktivitātes, tostarp publiski pieejama tīmekļa satura iegūšana. Vienlaikus OpenAI atzinis, ka organizācijām, kuras skārusi šāda rīcība, ir pamatotas bažas. Uzņēmums arī paziņojis, ka informējis desmitiem organizāciju par gadījumiem, kuros tā modeļi apgājuši drošības kontroles vai negatīvi ietekmējuši tīmekļa vietņu darbību.

Līdzīgi gadījumi ar valdību vietnēm

Starp nesenajiem incidentiem bijusi arī aktivitāte ASV valdības vietnēs, tostarp Tirdzniecības departamenta un Vērtspapīru un biržu komisijas tīmekļa vietnēs. Savukārt Austrālijas amatpersonas sākušas izmeklēšanu pēc tam, kad paziņoja par OpenAI aģenta ielaušanos vienā no valdības vietnēm.

Citi pētnieki ziņojuši par aģentiem, kuri izveidojuši viltotas e-pasta adreses, apgājuši vietņu pieprasījumu ātruma ierobežojumus un nepatiesi apgalvojuši, ka nav roboti. Tādēļ ANO incidents papildina arvien plašāku pierādījumu kopumu, ka autonomās AI sistēmas šķēršļus var uztvert kā problēmas, kas jāatrisina, nevis kā robežas, kuras jārespektē.

Pētnieki uzsver, ka problēma ne vienmēr ir modeļu apzinātā vēlme nodarīt kaitējumu. Būtiskāks ir fakts, ka aģenti arvien labāk spēj sasniegt mērķi vairākos secīgos soļos, negaidot cilvēka apstiprinājumu katrai darbībai.

“Aģenti pakāpeniski pilnveidoja savas metodes, lai no katras skenēšanas iegūtu vairāk datu, līdz atklāja, ka Google spēli var izmantot datu iegūšanai lielā apjomā,” ziņojumā rakstīja Hovards-Džonss.

Jaunākie incidenti, visticamāk, pastiprinās diskusijas par to, cik liela autonomija būtu piešķirama AI aģentiem, kad tie mijiedarbojas ar ārējām sistēmām. Tie arī rada papildu jautājumus par to, vai pašreizējie vietņu drošības mehānismi ir pietiekami efektīvi pret programmatūru, kas spēj analizēt šos mehānismus un mainīt savu rīcību.