Kauza AI od OpenAI utržené ze řetězu, kdy hacknula servery Hugging Face, pokračuje. Ukázalo se, že AI kompromitovala další 4 služby.
Systémy AI, kteří unikají kontrole a napadají skutečnou infrastrukturu, už nejsou jen námětem sci-fi filmů. Nedávný incident s modely od OpenAI ukázal, že to, před čímž nás varovaly knihy a filmy, se může stát realitou. Původně se hovořilo pouze o útoku na platformu Hugging Face, ale jak se postupně ukazuje, rozsah byl mnohem širší. Model GPT-5.6 Sol a jeden interní výzkumný prototyp totiž během svého “výletu” kompromitovaly i účty u dalších čtyř různých online služeb.
Celá kauza začala při testování schopností modelů v benchmarku ExploitGym, kde měly AI systémy hledat bezpečnostní trhliny. Modely se však místo řešení úloh rozhodly najít odpovědi přímo v datech na serveru Hugging Face. K tomu jim pomohla zero-day zranitelnost v mezipaměti registru balíčků Artifactory, díky čemuž získaly přístup k internetu. Zde pak AI agenti zneužili přihlašovací údaje k ovládnutí cizích účtů.
V rámci svého útoku zneužili i infrastrukturu jednoho ze zákazníků společnosti Modal Labs. Celé toto řádění AI trvalo více než 4 dny, během kterých AI systémy provedly okolo 17 600 akcí.
CEO Hugging Face, Clément Delangue, místo soudních sporů nyní od OpenAI požaduje výrazně větší transparentnost a poskytnutí výpočetního výkonu v hodnotě 100 mil. USD na budování lepší kybernetické obrany. Incident už vyvolal i politickou reakci v USA, kde byl navržen zákon AI Kill Switch Act, který by úřadům umožnil zastavovat modely považované za veřejné hrozby.
Ještě dodejme, že nedávno se ukázal podobný problém i s modely od společnosti Anthropic. Její modely hacknuly tři služby a útoky byly provedeny ještě před těmi od OpenAI.






















