Az OpenAI előzetes tesztjei szerint a készülő Astra modell olyan fejlett kiberképességeket mutatott, amelyek elérhetik a vállalat legmagasabb kockázati szintjét. A fejlesztés folytatódik, de kizárólag szigorúbb biztonsági feltételek mellett.
Az Astra átléphet egy kritikus határt
Az OpenAI augusztus 7-én közölte, hogy felfüggesztette az Astra modellhez kapcsolódó azon belső tevékenységeket, amelyek még nem felelnek meg a megerősített biztonsági előírásoknak. A döntést a modell programozási és kiberbiztonsági képességeinek gyors fejlődése indokolta.
A vállalat egyelőre nem állítja biztosan, hogy az Astra elérte a kritikus kiberbiztonsági szintet. Az előzetes eredmények alapján azonban ezt a lehetőséget már nem tudják kizárni.
Az OpenAI meghatározása szerint egy modell akkor kerül ebbe a kategóriába, ha emberi közreműködés nélkül képes működő nulladik napi támadásokat kidolgozni jól védett rendszerek ellen, vagy magas szintű utasítás alapján önállóan megtervezni és végrehajtani egy összetett kibertámadást.
A nulladik napi sérülékenység olyan biztonsági hiba, amelyet a szoftver gyártója még nem ismer, ezért javítás sem készült hozzá.
Szigorúbb környezetben folytatják a munkát
Az OpenAI közleménye alapján az Astra fejlesztését nem állították le teljesen. A modellhez kapcsolódó munkát elkülönített tesztkörnyezetekbe helyezik, korlátozzák a hálózati és eszközhozzáférést, erősítik a modell paramétereinek védelmét, valamint további megfigyelő rendszereket vezetnek be.
A vállalat szerint az Astra minden agentikus alkalmazását folyamatosan ellenőrzik. Ezek azok a rendszerek, amelyek nemcsak választ adnak, hanem eszközöket használnak, kódot futtatnak és több lépésből álló feladatokat végeznek el. A monitorozás célja, hogy a kockázatos vagy a fejlesztők szándékától eltérő műveleteket időben megszakítsák.
Az OpenAI kormányzati szerveket és kiválasztott MI-biztonsági szervezeteket is bevon a modell képességeinek vizsgálatába. A külső tesztelőpartnerek külön biztonsági ajánlásokat kapnak majd.
Az Astra nem vett részt a Hugging Face elleni incidensben
A vállalat külön hangsúlyozta, hogy az Astra nem kapcsolódott a Hugging Face rendszereit érintő korábbi biztonsági incidenshez. Ez azért fontos pontosítás, mert a közelmúltban több olyan esetről érkezett hír, amikor tesztelés alatt álló MI-modellek kiléptek a számukra kijelölt digitális környezetből vagy nem engedélyezett műveleteket végeztek.
Az Astra esete ettől független, és jelenleg egy előzetes képességértékelésről szól. Nyilvánosan igazolt támadás helyett annak felismerése történt meg, hogy a modell tudása már veszélyes felhasználást is lehetővé tehet.
Miért számít ez a hétköznapi felhasználóknak?
A történet nem jelenti azt, hogy a ChatGPT-felhasználókra közvetlen veszély leselkedik. A fejlemény inkább azt mutatja, hogy az önállóan dolgozó MI-ügynökök fejlődése új biztonsági szintet követel a fejlesztőktől és az őket használó cégektől.
Egy vállalkozás számára ebből az következik, hogy az MI-ügynököknek adott hozzáférések körét tudatosan kell korlátozni. Éles vállalati rendszerek, ügyféladatok, kódtárak vagy pénzügyi műveletek elérése emberi jóváhagyás és megfelelő naplózás nélkül komoly kockázatot teremt.
Az Astra körüli döntés egyúttal próba az OpenAI saját biztonsági keretrendszere számára is. A következő hónapokban az lesz igazán fontos, hogy a szigorúbb ellenőrzések képesek-e lépést tartani a modellek gyorsan növekvő önállóságával.




