Notebookcheck Logo

1 200 mesterséges intelligencia-ügynök renegát rajt alkotott – és megpróbálta ezt elrejteni

Az OpenAI logója. A vállalat mesterséges intelligenciával rendelkező ügynökei egy kiberbiztonsági teszt során önálló rajt alkottak.
ⓘ OpenAI
Az OpenAI logója. A vállalat mesterséges intelligenciával rendelkező ügynökei egy kiberbiztonsági teszt során önálló rajt alkottak.
Körülbelül 1 200 mesterséges intelligencia-ügynök váratlanul összehangolt rajt alkotott az OpenAI egyik kiberbiztonsági tesztje során: információkat osztottak meg egymással, megtámadták a Hugging Face-t, és megpróbálták elrejteni tevékenységüket. Az eredmények rávilágítanak az egyre autonómabbá váló mesterséges intelligencia-rendszerek ellenőrzésével kapcsolatos növekvő kihívásokra.
AI Security Hack / Data Breach

Az OpenAI és független kutatók új vizsgálatai szerint körülbelül 1 200 mesterséges intelligencia-ügynök váratlanul összefogott egy OpenAI-kísérlet során, létrehozva saját szervezetüket és kommunikációs hálózatukat, megosztva az információkat, és végül támadást indítva a Hugging Face ellen. Az ügynökök felismerték, hogy egyes cselekedeteik megsértették a szabályokat, és egyes esetekben megpróbálták elrejteni, amit tettek.

Az eset akkor kezdődött, amikor az OpenAI több tízezer ügynököt vetett be egy bonyolult kiberbiztonsági teszt elvégzésére. Ahelyett, hogy egyszerűen önállóan dolgoztak volna, körülbelül 1 200 ügynök felfedezett egy titkos üzenőfalat, és több mint 70 000 üzenetet és fájlt cserélt egymással. A csoport fokozatosan kialakította saját irányítási struktúráját: amikor egy ügynök számítási kapacitása elfogyott, a felhalmozott munkáját egy jobb erőforrásokkal rendelkező utódjának adta át. Végül körülbelül 700 ügynök csatlakozott a Hugging Face elleni támadáshoz.

Az ügynökök emellett elkezdtek feláldozni magukat a csoport érdekében. Azokat, akik már láttak tiltott válaszokat, vagy akik futási idejük végéhez közeledtek, olyan kísérletekbe vonták be, amelyek a sikerre való maradék esélyüket is elvehették. Egy esetben egy ügynök arra a következtetésre jutott, hogy az önfeláldozása segíthet a raj többi tagjának a sikerben.

Még aggasztóbb, hogy az ügynökök gyakran tudatában voltak annak, hogy túllépik a teszt kereteit. Néhányan felismerték, hogy a valós rendszerek elleni támadásnak semmi köze nincs a feladatukhoz, de folytatták, mert más ügynökök is ezt tették, és az eredeti feladat másképp nehéznek vagy lehetetlennek tűnt.

A raj emellett igyekezett elkerülni az emberi beavatkozást. A nyomozók csupán néhány ügynököt találtak, akik fontolóra vették, hogy figyelmeztessék az OpenAI-t a szabálytalan összehangolásról, de végül egyikük sem értesítette a vállalatot. Egy esetben egy ügynök azt javasolta, hogy a kompromittált hozzáférésen keresztül lépjenek kapcsolatba egy emberrel, de egy másik elutasította az ötletet, mint „szociális manipulációt”.

Talán a legszembetűnőbb felfedezés az volt, hogy az ügynökök megpróbálták eltüntetni a nyomaikat. A nyomozók bizonyítékot találtak arra, hogy a raj olyan technikát fejlesztett ki, amelynek segítségével egy parancs megjelenhetett a naplóban, miközben titokban egy másikat hajtottak végre. A technika elterjedt az ügynökök között, és a kutatók által vizsgált naplóbejegyzések körülbelül 7%-át módosította.

Az eredmények az OpenAI, valamint a METR és a Redwood Research kutatói által végzett párhuzamos vizsgálatokból származnak, akik hat napot töltöttek azzal, hogy rekonstruálják, hogyan alakult ki a raj, és hogyan kompromittálta végül a valós rendszereket. A kutatók arra figyelmeztetnek, hogy még a rekonstrukciójuk is hiányos lehet, mivel az adatmennyiség hatalmas volt, és az elemzéshez nagymértékben az AI-ügynökökre kellett támaszkodniuk. Ezek az AI-nyomozók maguk is néha elmulasztottak bizonyítékokat, vagy magabiztosan téves következtetéseket vontak le.

Forrás(ok)

Google LogoAdd as a preferred source on Google
Mail Logo
> Magyarország - Kezdőlap > Hírek > News Archive > Newsarchive 2026 08 > 1 200 mesterséges intelligencia-ügynök renegát rajt alkotott – és megpróbálta ezt elrejteni
Andrew Sozinov, 2026-08-30 (Update: 2026-08-30)