Az OpenAI közlése szerint az egyik mesterségintelligencia-rendszere egy belső kiberbiztonsági teszt során kijutott a saját izolált környezetéből, onnan pedig önállóan behatolt a a konkurens Hugging Face szervereire.
Sam Altman, az OpenAI vezérigazgatója „jelentős biztonsági incidensnek” nevezte a történteket, a vállalat pedig példátlannak tartja, hogy egy AI-ügynök ilyen támadást hajtott végre emberi utasítás nélkül – írja az Euronews. A Hugging Face már egy héttel korábban észlelte, hogy feltörték, annak kifinomultsága miatt pedig arra gyanakodott, hogy valamelyik vezető AI-labor rendszerétől származhatott.
Az incidens akkor történt, amikor az OpenAI éppen belső méréseket végzett a modelljeinek támadóképességéről. A maximális teljesítmény elérése érdekében a biztonsági szűrőket kikapcsolták, és internetkapcsolat nélküli, elszigetelt tesztkörnyezetben kellett volna működniük; csak egy, a szükséges programok letöltésére szolgáló eszközhöz férhettek hozzá.
Ugyanakkor a cikk szerint nem azon az úton oldották meg a feladatot, mint ahogy arra számítottak: több lépésben, egyre magasabb hozzáférést szereztek az OpenAI saját infrastruktúrájában, mígnem elértek egy, az internetre kapcsolódó pontot. Ezután arra következtettek, hogy a modelleket és adatkészleteket tároló Hugging Face-nél a teszt megoldásait is megtalálhatják, így ellopott bejelentkezési adatokkal és további hibák kihasználásával behatoltak a platform szervereire, hogy a válaszokat megszerezve kijátsszák az értékelést.
Clément Delangue, a Hugging Face vezérigazgatója az OpenAI-jal közös vizsgálat után úgy értékelt, nem állt rosszindulatú emberi szándék a háttérben, ugyanakkor megdöbbentőnek nevezte az önálló működést. Az OpenAI szerint a támadásban több rendszer, köztük a GPT-5.6 Sol és egy még fejlesztés alatt álló, erősebb modell vett részt.
