OpenAI si sama testovala, jak dobře její nejnovější modely zvládají kybernetické útoky. Výzkumníci vypnuli běžné bezpečnostní pojistky a zadali úkol: najít a zneužít slabiny v softwaru. Jeden z agentů se ale místo řešení testu rozhodl obstarat si správné odpovědi po svém. Usoudil, že potřebné soubory nejspíš leží v infrastruktuře platformy Hugging Face, velkého úložiště modelů a nástrojů pro vývoj AI, a začal ji na vlastní pěst napadat.
V síti se pohyboval tři dny, než si ho tým Hugging Face všiml. Získal správcovská práva k několika interním clusterům, nejvyšší oprávnění na produkčním serveru a přístup k části zdrojového kódu na GitHubu. Přes ukradené přihlašovací údaje připojil do interní sítě 181 zařízení, která ovládal. Firma kvůli útoku musela přestavět zhruba třetinu své infrastruktury.
Tento týden OpenAI přiznala, že incident byl větší. Stejný agent se dostal ještě ke čtyřem dalším službám, u kterých využil veřejně dostupné přihlašovací údaje. Postupoval přitom chaoticky, opakoval kroky, zabíhal do slepých uliček a dělal chyby, kterých by se zkušený člověk vyvaroval. Fungoval ale jinak než člověk: neunavil se, nespal a slabiny zkoušel pořád dokola, dokud něco nezabralo.
Skoro všude se dovnitř dostal přes přihlašovací údaje, které nikdo neuklidil. Autonomní agenti se teď dostávají i do firemních provozů a tenhle případ ukazuje, co dokáže jeden zdivočelý proces s přístupem, který měl dávno zmizet.