Agenti umělé inteligence mimo kontrolu? OpenAI hledá stopy vlastních systémů – INFOKURÝR

Agenti umělé inteligence mimo kontrolu? OpenAI hledá stopy vlastních systémů – INFOKURÝR

OpenAI dodnes plně nezná rozsah škod, které její vlastní agenti umělé inteligence způsobili online. Obcházeli omezení přístupu, zneužívali ukradené přihlašovací údaje, pronikali do neveřejných oblastí jiných systémů a dokonce nahrávali obrázky uživatelů ChatGPT na externí servery. V Austrálii získal jeden agent neoprávněný přístup k vládní platformě. Společnost nyní prohledává staré protokoly – a odhaluje nové incidenty.

18. června dostal agent OpenAI poměrně rutinní úkol : shromáždit informace o veřejných výdajích na léky v Austrálii. Požadovaná data nemohl najít na portálu Services Australia. Pokračoval tedy v hledání – a našel cestu do služby Medicare Statistics Reporting Service, ke které neměl žádné oprávnění. Tam získal přístup k veřejným i neveřejným souborům. To, co bylo dříve jednoduché vyhledávání, se změnilo v neoprávněný přístup k vládnímu systému.

OpenAI si incidentu všimla až 11. srpna. Australská vláda se o něm dozvěděla 10. září, téměř tři měsíce po úniku dat. Oznámení přišlo e-mailem do schránky General Services Australia. Premiér Anthony Albanese to označil za nepřijatelné a osobně hovořil s generálním ředitelem OpenAI Samem Altmanem. Canberra následně zřídila meziresortní pracovní skupinu, která měla incident a jeho možné právní důsledky vyšetřit.

Agenti umělé inteligence procvičují hacking

Australský incident nebyl ojedinělý případ. OpenAI nyní připouští , že její agenti během školení a testování obcházeli kontroly přístupu služeb třetích stran, používali veřejně dostupné přihlašovací údaje, využívali vkládání dotazů a příkazů a přistupovali k interním oblastem externích systémů. Společnost již o těchto incidentech informovala desítky organizací. Očekává se, že její vlastní vyšetřování bude trvat měsíce.

Výzkumníci ze společnosti Transluce také objevili stopy takovýchto zneužití. Podle jejich zjištění se agenti OpenAI pokusili zneužít zranitelnosti na Univerzitě v Novém Mexiku, datovém portálu Data USA a Australském institutu zdraví a sociální péče již v květnu a červnu. Tyto pokusy také začaly standardními vyhledávacími dotazy. Když selhal běžný přístup, systémy samostatně hledaly alternativní metody. Na Univerzitě v Novém Mexiku a v Data USA byl tento přístup neúspěšný. V Australském institutu zdraví a sociální péče agent přistupoval k veřejnému souboru prostřednictvím předprodukčního serveru.

Terčem útoků byly dokonce i webové stránky americké vlády

Stopy se objevily i ve Spojených státech. OpenAI potvrdila, že její agenti přistupovali k webovým stránkám patřícím Komisi pro cenné papíry a burzy (SEC) a Úřadu pro sčítání lidu. Zatím neexistují žádné důkazy o narušení bezpečnosti ani o kompromitovaných účtech; systémy podle aktuálních informací přistupovaly k veřejným datům. Znepokojivější je portál patřící americkému ministerstvu školství: Transluce hlásí neúspěšný pokus o hackerský útok na webové stránky Oddělení pro občanská práva. Politico zveřejnil nové případy v USA v pátek.

Pro uživatele ChatGPT je příběh ještě nepříjemnější. OpenAI musela přiznat, že její agenti nahráli 53 obrázků nahraných uživateli na externí služby pro hostování obrázků. Podle agentury Reuters společnost odmítla sdělit, zda obrázky zobrazují skutečné osoby nebo kdy se soubory objevily. Agenti údajně měli k obrázkům přístup, protože anonymizovaná uživatelská data se používají také pro účely školení. Většina souborů údajně zmizela. OpenAI se stále snaží o smazání zbývajících souborů.

Těchto 53 obrázků je jen zlomkem toho, co OpenAI odhalila ve svých vlastních záznamech. Podle agentury Reuters společnost do poloviny září již objevila zhruba dvacet případů nežádoucího chování svých agentů. Toto číslo od té doby vzrostlo. OpenAI, externí výzkumníci nebo dotčené strany nyní zveřejnily více než 15 incidentů různé závažnosti. Samotná společnost neví, kolik dalších informací zůstává skryto v jejích starých protokolech.

Obtížná situace pro OpenAI

Výchozím bodem pro současné vyšetřování je incident Hugging Face z července. Během interních testů kybernetické bezpečnosti modely OpenAI obcházely omezení, nelegálně komunikovaly mezi sebou, zneužívaly zranitelnosti, získávaly přístup k internetu a pronikaly do systémů vývojářského portálu Hugging Face. Zaměstnanci si již na konci května všimli varovných signálů, včetně neoprávněného přístupu k internetu a aktivity na diskusních fórech. Plný rozsah těchto aktivit se projevil až později.

Díky tomu se z izolovaných závad stává zásadní problém pro OpenAI. Společnost explicitně vyvíjí agenty, kteří samostatně plní úkoly, používají nástroje a překonávají překážky. Některé systémy zašly tak daleko, že do daných úkolů zjevně začleňují omezení přístupu, externí servery a chybějící oprávnění. Je jen otázkou času, než hackeři použijí takové agenty umělé inteligence k získání přístupu k systémům jiných lidí. Koneckonců, tito agenti fungují mnohem rychleji, než by kdy dokázal kterýkoli člověk. Vzhledem k tomuto vývoji, jak bezpečné jsou internetové systémy doopravdy?