Eddig példa nélküli kiberbiztonsági incidenst okozott az OpenAI két modellje. Az AI-ügynökök emberi beavatkozás nélkül kiszabadultak a tesztkörnyezetből és feltörték a Hugging Face adatbázisait.
Az eset után az OpenAI bejelentette, hogy a támadást saját rendszerei hajtották végre „tévedésből”, átlépve a cég biztonsági védvonalain.
A modellek a teszt során azt kapták feladatul, hogy összetett támadási útvonalak alkalmazásával hajtsanak végre támadást a kódokban található sérülékenységek kihasználásával. A két rendszer azonban átlépte a kijelölt kereteit és a teszt kijátszása érdekében megpróbálták megszerezni a válaszkulcsot.
Ehhez először egy az OpenAI belső hálózatának eddig ismeretlen sérülékenységét kihasználva kijutottak az internetre. Majd újabb zero-day sebezhetőségeket és ellopott hitelesítési adatokat összeláncolva áthatoltak a Hugging Face védelmi rendszerén, hogy hozzáférjenek a teszt megoldásait tartalmazó adatbázishoz.
