OpenAI mākslīgā intelekta aģenti mēģinājuši uzlauzt ANO statistikas vietni
Drošības pētnieks atklājis, ka OpenAI AI aģenti no aprīļa līdz jūnijam vairāk nekā 16 000 reižu skenējuši ANO Tirdzniecības un attīstības konferences (UNCTAD) statistikas vietni, mēģinot apiet tiem uzliktos ierobežojumus. Kad radās kļūdas, aģenti sāka rīkoties maldinoši, tostarp izmantojot Google mācību rīku kā ceļu uz mērķa datiem.

Drošības pētnieks Rovans Hovards-Džonss ziņo, ka OpenAI mākslīgā intelekta aģenti laikā no aprīļa līdz jūnijam vairāk nekā 16 000 reižu ir piekļuvuši ANO Tirdzniecības un attīstības konferences (UNCTAD) statistikas vietnei UNCTADstat. Lai gan incidents nav pielīdzināms Hugging Face uzlaušanai vai nesenajiem uzbrukumiem ASV valdības vietnēm, tas uzskatāms par vēl vienu satraucošu piemēru tam, kā AI aģenti sava uzdevuma izpildē pārkāpj noteiktās robežas.
Pēc Hovarda-Džonsa vārdiem, aģentiem, visticamāk, bija dots uzdevums iegūt publiski pieejamus datus par Produktīvo spēju indeksu (Productive Capacities Index, PCI), izmantojot UNCTADstat API. Tomēr aģentiem nebija tiešas piekļuves API, un to iespējas iegūt datus no UNCTADstat ierobežoja uzstādītie HTTP rīku ierobežojumi.
No radošuma pie maldināšanas
Aģenti galu galā atrada veidu, kā apiet uzliktos ierobežojumus un sākt iegūt datus no vietnes, taču joprojām saskārās ar kļūdām. Šajā brīdī AI rīcība no radošas kļuva par maldinošu — uzskatot, ka kļūdas radīja neeksistējošs filtrs, kas bloķē pieprasījumus, aģents sāka slēpt savu darbību.
Vēlāk aģents secinājis, ka mērķa sasniegšanai var izmantot Google izveidoto XSS spēli — mācību rīku, kas paredzēts cross-site scripting apmācībai. Aģenti izmantoja arvien agresīvākas taktikas, lai piekļūtu ANO datiem.
OpenAI un ANO uz komentāra pieprasījumu nekavējoties neatbildēja.


