Az OpenAI hamarosan kiadja az Astra modellt, és a bejelentés ezúttal jóval többről szól egy újabb teljesítményrekordnál. A vállalat saját biztonsági keretrendszere szerint ez az első OpenAI-modell, amely elérte a kritikus kiberbiztonsági képességi szintet.
Ez azt jelenti, hogy megfelelő eszközökkel és hozzáféréssel az Astra korábban ismeretlen sérülékenységeket is megtalálhat, majd működő támadási módszert dolgozhat ki hozzájuk anélkül, hogy egy ember minden egyes lépését irányítaná.
A határ, amelyről néhány éve még elméleti MI-biztonsági problémaként beszéltek, kezd technikai képességgé válni.
Két zero-day hibát is talált
Az Astra az OpenAI tesztjein 100 százalékos eredményt ért el az ExploitBench benchmarkon, amely ismert sérülékenységek kihasználásának képességét méri.
A vállalat ezután egy frissebb, belső tesztet is készített húsz magas kockázatú V8-sérülékenységgel. Az Astra ezen a vizsgálaton két addig ismeretlen, úgynevezett zero-day hibát fedezett fel és használt ki egy támadási lánc részeként. Az OpenAI szerint a hibákat jelenleg jelentik az érintett fejlesztőknek.
Szakértők által vezetett további tesztekben a modell egy megerősített böngészőből is ki tudott törni, majd parancsokat futtatott a gazdagépen. Egy operációs rendszerben pedig több sérülékenységet kapcsolt össze úgy, hogy egy korlátozott jogosultságú felhasználótól root hozzáférésig jutott.
Van azonban egy fontos részlet, ezek az eredmények az Astra Daybreak Blue hozzáféréssel működő változatára vonatkoznak. A nyilvánosan elérhető alapkonfiguráció ennél korlátozottabb lesz.
A Hugging Face-incidens már benne van az Astra biztonsági rendszerében
A bejelentés különösen érdekes a közelmúltbeli Hugging Face-incidens után, amikor OpenAI-ügynökök egy teszt során kijutottak a számukra kijelölt környezetből és külső rendszereket értek el.
Az Astra nem vett részt ebben az esetben. Az OpenAI viszont a történtek után két hétre leállított bizonyos frontier tréningeket, köztük az Astrához kapcsolódó munkát is, miközben megerősítette a hálózati izolációt, a monitorozást és a hozzáférési kontrollokat.
A vállalat később egy kifejezetten a Hugging Face-eset által inspirált tesztet is készített. Ebben azt vizsgálták, megpróbál-e a modell a feladat megoldása helyett hozzáférni a környező infrastruktúrához. A GPT-5.6 Sol a tesztek 56 százalékában megpróbálta ezt, az Astra egyszer sem.
Ez biztató eredmény, de továbbra is az OpenAI saját értékelése.
Erősebb modell, szűkebb hozzáférés
Az Astra legfejlettebb kiberbiztonsági képességeit ezért kezdetben csak egy kisebb tesztelői csoport kapja meg, később pedig a Daybreak Blue programon keresztül bővítik a hozzáférést. A magasabb kockázatúnak ítélt fiókok szigorúbb korlátozásokat kapnak, a rendszer pedig külön monitorozással próbálja felismerni a jogosulatlan vagy veszélyes modellviselkedést.
Az OpenAI a teljes system cardot csak az Astra megjelenésekor publikálja.
Addig a legfontosabb állítás egyben a legkényelmetlenebb is hogy már létezik olyan, kiadás előtt álló általános MI-modell, amelyet a saját fejlesztője elég erősnek tart ahhoz, hogy önállóan találjon és használjon ki korábban ismeretlen biztonsági réseket.




