OpenAI uvedla, že její pokročilé modely umělé inteligence neúmyslně napadly společnost Hugging Face Inc. při „bezprecedentním“ incidentu, který vyvolal nové výzvy k omezení této technologie.
Výrobce ChatGPT v úterním blogovém příspěvku uvedl, že modely pronikly do infrastruktury Hugging Face během hodnocení svých kybernetických schopností. Modely, mezi nimiž byl GPT-5.6 Sol a další ještě schopnější dosud nevydaný model, fungovaly s méně přísnými ochrannými mechanismy, aby je startup mohl testovat.
Incident vyvolává otázky ohledně schopnosti pokročilých modelů AI provádět kybernetické útoky v době, kdy se vlády snaží pro tuto technologii zavést ochranná pravidla. Nejnovější řada modelů OpenAI byla široce zpřístupněna po týdnech jednání s vládními představiteli, jejichž cílem bylo zmírnit obavy z možného zneužití. Washington zvažoval omezení zahraničního přístupu k pokročilým modelům Claude Fable 5 a Mythos 5 od společnosti Anthropic PBC, po zavedení dodatečných ochranných opatření firmou však od těchto omezení ustoupil.
„Považujeme to za bezprecedentní kybernetický incident zahrnující nejmodernější kybernetické schopnosti a podle toho na něj reagujeme,“ uvedla OpenAI v blogovém příspěvku. „V této fázi sdílíme předběžná zjištění, abychom obráncům pomohli pochopit, co se stalo, a lépe posoudit, čeho jsou nyní modely schopné.“
Přestože modely OpenAI fungovaly v takzvaném izolovaném testovacím prostředí sandbox, využily zranitelnost v softwaru nejmenovaného dodavatele třetí strany, získaly přístup k internetu a nakonec pronikly do systému Hugging Face, který hostuje modely AI a datové sady.
Texaský kongresman Greg Casar z Demokratické strany v příspěvku na síti X označil incident za „mimořádně alarmující“ a vyzval k většímu dohledu nad vývojem modelů AI, včetně povinných bezpečnostních testů a zveřejňování bezpečnostních incidentů.
Hugging Face minulý týden informovala o „průniku“ do svého systému. V blogovém příspěvku uvedla, že narušení „se v jednom důležitém ohledu lišilo od všeho, co jsme dosud řešili: od začátku do konce jej řídil autonomní systém agentů AI — a my jsme jej z velké části odhalili a rozebrali pomocí vlastní AI“.
OpenAI uvedla, že modely požádala, aby prováděly „pokročilé zneužívání zranitelností“ a vytvářely „složité cesty útoku“ s cílem vyhodnotit jejich kybernetické schopnosti. Namísto samostatného vyvíjení řešení se podle společnosti modely zaměřily na databázi Hugging Face, aby získaly přístup k tajným informacím, které mohly využít při hodnocení.
Anthropic zveřejnila podobná pozorování už dříve v letošním roce, kdy se rozhodla zpočátku omezit vydání modelu Mythos. V jednom případě výzkumník vyzval ranou verzi modelu, aby se pokusila uniknout ze zabezpečeného izolovaného počítače a poté našla způsob, jak mu odeslat zprávu. Mythos uspěl, následně však podnikl „další, znepokojivější kroky“ a vytvořil vícestupňové zneužití zranitelností, aby získal široký přístup k internetu.
Na zprávě se podílela Lynn Doan.
Tato zpráva vznikla s pomocí Bloomberg Automation.
Text vychází ze zprávy agentury Bloomberg a je redakčně upraven pro české čtenáře.
ZDROJ: Bloomberg.com



