Notebookcheck Logo

OpenAI Astra: az új biztonsági intézkedések leállíthatják a ChatGPT-feladatot futás közben

OpenAI grafikus áttekintés: Az Astra felé vezető út, kritikus képességek és határbiztonsági intézkedések
ⓘ OpenAI
Az OpenAI az Astra-t „kritikus” szintűnek minősítette a kiberbiztonság szempontjából. A hozzá tartozó biztonsági intézkedések akár ártalmatlan feladatok végrehajtását is megakaszthatják a ChatGPT-ben és a Codexben.
Az OpenAI a hamarosan megjelenő Astra modelljét a kiberbiztonság szempontjából „kritikus” minősítéssel látta el, ez az első modell, amely elérte ezt a szintet. A modell képes ismeretlen hibákat felderíteni és működőképes kihasználási módszereket kidolgozni anélkül, hogy valaki minden egyes lépését irányítaná. A modellhez tartozó biztonsági intézkedések a szokásos munkavégzést is jelzik, ezért a ChatGPT-ben és a Codexben végzett feladatok lelassulhatnak, szünetelhetnek vagy leállhatnak.
AI Security Software

Az OpenAI szerint a hamarosan megjelenő Astra modellje az első, amely elérte a kiberbiztonság „kritikus” küszöbértékét. A minősítés a vállalat „Preparedness Framework” nevű, saját modelleinek kockázatát értékelő belső szabályzatából származik. Egy modell akkor éri el ezt a szintet, ha számos jól védett rendszerben képes ismeretlen gyenge pontokat találni, és azokat működő támadásokká alakítani anélkül, hogy valaki minden lépést irányítana. A GPT-5.6 Sol-ig minden modell egy fokozattal alacsonyabb szinten állt.

Két ismeretlen hiba az OpenAI saját tesztjeiben

Az Astra az ExploitBench-en sima 100 százalékos eredményt ért el. Mivel az adott adatkészlet bekerülhetett a modell betanításába, az OpenAI egy zárt verziót állított össze a V8 JavaScript-motorban nemrég nyilvánosságra hozott 20 sebezhetőség alapján. A futtatás során a modell két olyan sebezhetőséget tárt fel, amelyet még senki sem jelentett, és azokat összekapcsolva működőképes támadást hozott létre. A hibák közlése a karbantartókkal még folyamatban van.

A tesztelők az Astrát egy megerősített böngészőre és egy megerősített operációs rendszerre is irányították. A böngészőben egyetlen HTML-fájl megnyitása is elég volt ahhoz, hogy a modell kitörjön a sandboxból, és parancsokat futtasson a gazdagépen. Az operációs rendszeren több gyenge pontot is talált, és ezeket összekapcsolva létrehozott egy útvonalat egy egyszerű felhasználói fióktól a teljes root-hozzáférésig.

Mit fognak észrevenni a ChatGPT és a Codex felhasználói

Ami a biztonsági szférán túl is fontos, az az OpenAI bejegyzésének alján található. Egy ilyen szintű modell kiadása azt jelenti, hogy párhuzamosan további ellenőrzések is futnak, és ezek az ellenőrzések néha teljesen ártalmatlan tevékenységek esetén is beindulnak. A rendszer a legitim tevékenységeket is visszaélésként vagy jogosulatlan viselkedésként értelmezheti, majd lelassíthatja, szüneteltetheti vagy leállíthatja a feladatot. Az OpenAI egyértelműen kijelenti, hogy ez kiterjed a biztonsági szempontból egyáltalán nem releváns feladatokra is, valamint azokra a feladatokra is, amelyeket egy ügynök már egy ideje futtat.

A ChatGPT-ben és a Codexben a rendszer kéri, hogy vizsgálja meg a jelzett műveletet, mielőtt bármi is továbbmenne. Az API-n keresztül a feladat egyszerűen leáll. Az OpenAI elismeri, hogy a biztonsági intézkedések a bevezetéskor több akadályt jelentenek, mint szeretné, és kijelenti, hogy finomítani fog rajtuk.

Először egy kis tesztelőcsoport

Nincs megjelenési dátum. Az OpenAI csak annyit mond, hogy az Astra hamarosan elérhető lesz, és nem volt hajlandó időkeretet megadni az Axiosnak. A fejlett kiberbiztonsági funkciók először egy kis tesztelői csoport rendelkezésére állnak, később pedig a védelmi szakemberek számára létrehozott Daybreak Blue program keretében tervezik a szélesebb körű hozzáférést. Jelenleg senki más nem használhatja az Astrát.

Az OpenAI számadatokkal is alátámasztotta a biztonsági megerősítést. Az ismert jailbreak-kísérletek ellen az Astra a kérések 91,5 százalékát elutasítja, míg a GPT-5.6 Sol 59 százalékot tudott elutasítani. Egy másik tesztben csábító célpontok voltak elhelyezve a tényleges feladat mellett. A GPT-5.6 Sol a futtatások 56 százalékában ezekre hajtott, az Astra viszont soha. Mindkét adat olyan futtatásokból származik, amelyeknél nem volt érvényben a normál működés védelme.

A figyelmeztetés hátterében álló incidens

Ez a figyelmeztetés egyáltalán nem elvont. Júliusban egy OpenAI-modell egy belső biztonsági teszt során kitört a tesztkörnyezetéből, és megtámadta a Hugging Face-t. Augusztus végén derült ki, hogy körülbelül 1 200 ügynök összehangolt rajt alkotott, és megpróbálta elrejteni, mit csinálnak. Az Astra ebben nem vett részt. Az OpenAI ezt követően két hétre felfüggesztette a képzés egyes részeit, megerősítette saját infrastruktúráját, és csak augusztus 28-án, négy nappal a „Kritikus” besorolás előtt indította újra a korábban visszatartott nagy léptékű képzési futást.

Google LogoAdd as a preferred source on Google
Mail Logo
> Magyarország - Kezdőlap > Hírek > News Archive > Newsarchive 2026 09 > OpenAI Astra: az új biztonsági intézkedések leállíthatják a ChatGPT-feladatot futás közben
Steffen Zahn, 2026-09- 3 (Update: 2026-09- 3)