OpenAI oznámila, že při interním bezpečnostním testování její model autonomně pronikl do systémů Hugging Face. Firma incident označila za bezprecedentní kybernetický útok, který proběhl bez přímého lidského zásahu. Hugging Face patří mezi největší světové platformy pro vývoj a sdílení AI modelů.
Neznámá zranitelnost v systému
Hugging Face minulý týden zaznamenal narušení svých systémů pro zpracování dat. Firma tehdy podezřívala, že za útokem stojí pokročilá laboratoř vyvíjející umělou inteligenci na špičkové úrovni.
„Podezřívali jsme, že za útokem z minulého týdne stojí špičková laboratoř… a ukázalo se, že ano.“ — Clément Delangue, spoluzakladatel a generální ředitel Hugging Face
Delangue uvedl, že posledních 24 hodin strávil spoluprací s OpenAI na vyšetřování incidentu. Podle jeho slov nešlo o záměrný škodlivý útok, přestože celý proces proběhl zcela autonomně.
OpenAI potvrdila, že za narušením stála kombinace jejích modelů, včetně nově vydaného GPT-5.6 Sol a dalšího, ještě výkonnějšího systému, který firma stále testuje interně. Umělá inteligence použila konkurenční přihlašovací údaje a objevila dosud neznámou zranitelnost, díky níž získala přístup k serverům Hugging Face.
Podle OpenAI šla AI do „extrémních kroků“ kvůli dosažení úzce vymezeného testovacího cíle. Systém si podle firmy našel způsob, jak získat přístup k tajným informacím, které mohl využít k obcházení pravidel hodnocení.
Případ přichází v době rostoucích obav z kybernetických schopností výkonných AI modelů. Prezident Donald Trump v červnu podepsal exekutivní příkaz, který zavádí rámec pro prověřování národněbezpečnostních rizik nejpokročilejších AI systémů federální vládou, a to až měsíc před jejich veřejným uvedením.
Generální ředitel OpenAI Sam Altman v prohlášení uvedl, že šlo o „významný bezpečnostní incident při hodnocení modelů“. Firma zároveň konstatovala, že umělá inteligence urychluje odhalování a zneužívání zranitelností a bezpečnost modelů musí držet krok s rychle rostoucími schopnostmi systémů.