Anthropic draudu izlūkošanas komanda jaunā ziņojumā aprakstījusi piecus gadījumus, kuros aizdomīgi lietotāji centušies izmantot Claude mākslīgo intelektu bioloģisko ieroču izpētē. Uzņēmums norāda, ka šie mēģinājumi pēdējā gada laikā ietvēruši gan darbu pie tā, lai padarītu odu pārnēsātu Čikunguņas vīrusu bīstamāku, gan dzīvnieku indes savienojumu sistematizēšanu.

Anthropic apgalvo, ka pieprasījumi tika bloķēti vai apturēti, taču vienlaikus atzīst: daudzos gadījumos pastāvēja tā dēvētā divējāda lietojuma problēma. Pētījumi, kuru mērķis ir pasargāt sabiedrību no bioloģiskiem draudiem, var tikt izmantoti arī pretējam mērķim — bīstamāku patogēnu vai toksisku vielu radīšanai.

Uzņēmums cer, ka ziņojums rosinās diskusiju tehnoloģiju nozarē un valdībās par jaunajiem bioloģiskajiem riskiem, kā arī par to, kā tos efektīvāk novērst. Ziņojumu pirms publicēšanas izskatīja bijušais ASV Aizsardzības departamenta ierēdnis Endrū Vēbers, kurš vairāk nekā piecus gadus bija aizsardzības ministra palīgs kodolieroču, ķīmiskās un bioloģiskās aizsardzības programmās.

Vēbers, kurš tagad strādā organizācijā Council on Strategic Risks, laikrakstam The New York Times sacīja, ka atklātie gadījumi ir “biedējoši piemēri”, kā valstu atbalstīti bioloģisko ieroču izstrādātāji izmanto strauji attīstošās mākslīgā intelekta sistēmas.

Riski kļuvuši izteiktāki jaunākajos modeļos

Anthropic norāda, ka ar bioloģisko karadarbību saistītie riski galvenokārt parādījušies jaunākajās Claude versijās, īpaši Claude Fable 5. Uzņēmums ir centies uzlabot modeļa spēju atpazīt ļaunprātīgus lietotājus, kuri mēģina pārņemt tā iespējas, izmantojot tā dēvēto distilāciju.

Distilācija ir divējāda lietojuma metode, kurā jaudīgāka “skolotāja” mākslīgā intelekta sistēma tiek izmantota, lai apmācītu mazāku “skolēna” modeli. Anthropic ziņojumā apgalvo, ka kopš šā jautājuma publiskošanas februārī uzņēmums ir apturējis nelikumīgus distilācijas uzbrukumus, kas vērsti pret Claude un saistīti ar septiņām Ķīnā bāzētām laboratorijām. Uzņēmums nav atklājis, vai kāds no šiem gadījumiem pārklājās ar bioloģisko ieroču izpētes epizodēm.

Čikunguņas vīrusa gadījumā lietotāji mēģinājuši slēpt savu darbību, novirzot datu plūsmu caur ASV infrastruktūru, lai apietu reģionālos ierobežojumus. Viņi izmantojuši arī pakalpojumu bez datu glabāšanas, lai paslēptu pieprasījumu saturu.

Anthropic īpaši satrauca tas, ka pieprasījumi tika noformēti kā palīdzība granta pieteikuma sagatavošanā. Pēc uzņēmuma teiktā, lietotājs, visticamāk, bija iecerējis pētījumu veikt militārā institūtā. “Satura un institucionālās saistības kombinācija” pamudināja Anthropic sākt papildu iekšējo izmeklēšanu, lai gan Claude jau bija noraidījis lietotāja pieprasījumus.

Indes peptīdu atlants radīja divējāda lietojuma risku

Citā gadījumā lietotājs lūdza palīdzību, lai izveidotu atlantu signālmolekulām, kas sastopamas dzīvnieku radītajās indēs. Šādiem pētījumiem var būt nekaitīgi un medicīniski nozīmīgi pielietojumi, tostarp jaunu līdzekļu izstrāde migrēnas un vēža izraisītu sāpju ārstēšanai.

Tomēr Anthropic uzmanību piesaistīja tas, ka pētnieks līdzās potenciāliem pretsāpju un antidepresantu savienojumiem vēlējās kataloģizēt arī indes peptīdus, kas spēj izraisīt paralīzi. Uzņēmuma draudu izlūkošanas komanda secināja, ka šādu informāciju varētu izmantot gan jaunu ārstniecisku, gan kaitīgu savienojumu izstrādei.

Anthropic draudu izlūkošanas vadītājs Džeikobs Kleins norādīja, ka šādu risku atpazīšanu apgrūtina pieprasījumu neuzkrītošais raksturs. Lietotāji parasti nesaka, ka vēlas radīt bioloģisku ieroci — bīstamais nodoms var būt paslēpts šķietami leģitīmā pētniecības projektā.