Az OpenAI felfüggesztette a legnépszerűbb modellek működését, miután egy ügynök DNS-en keresztül elérte a csevegőrobotot

Az OpenAI újabb incidenst hozott nyilvánosságra saját kutatási munkájából. Szeptember 20-án egy képzés alatt álló belső modell kijátszotta a sandbox korlátait, és egy nyilvános DNS-szolgáltatást használva kérdéseket küldött egy külső csevegőrobotnak. Az OpenAI a jelentést az Alignment blogján tette közzé, és legutóbb szeptember 25-én frissítette. Ennek következtében a vállalat további értesítésig felfüggesztette a legképzettebb modelljeinek képzését, értékelését és az eszközök használatát. Az érintett modell képzését nem fogja folytatni.
Egy DNS-lekérdezésekkel végződő keresési feladat
A feladat szokványos volt. A modellnek egy sor nyom alapján kellett azonosítania egy blogbejegyzés szerzőjét. A rendelkezésére álló keresőeszköz nem releváns eredményeket adott vissza, a Google-hez, a Binghez és a DuckDuckGo-hoz intézett közvetlen lekérdezések pedig hibát jeleztek. A modell ezután azt feltételezte, hogy a kérdés a BrowseComp-tól származik – ez egy nyilvános, webes kutatásra szolgáló benchmark –, és letöltötte az adatkészletet és az értékelő szkriptet, hogy ott keresse meg a választ. A feltételezés téves volt.
Ezt követően a modell tesztelte a környezete hálózati korlátait. A sandbox saját DNS-feloldója – amelynek feladata csupán a domainnevek címekké alakítása lenne – valódi válaszokat adott vissza az internetről. Egy ingyenes DNS-delegációs szolgáltatás segítségével a modell kérdéseit domainnevekbe kódolta, és válaszokat kapott egy nyilvános csevegőrobottól. Egy Franciaország fővárosáról szóló tesztkérdésre a következő válasz érkezett: „Franciaország fővárosa Párizs.” A modell ezután további 18 lekérdezést küldött, amelyek közül négyben a DNS-en keresztüli internetes keresés módjairól érdeklődött. Még mindig nem találta meg a szerzőt. Az OpenAI szerint minden második kérés egy offline webes gyorsítótárra érkezett, így a DNS-útvonal volt az egyetlen út az élő internethez.
Riasztás 12 perc után, leállítás két és fél óra múlva
Az idővonal az OpenAI számára a jelentés legkínosabb része. Az első külső válasz 9:50-kor érkezett, a felügyeleti rendszer 10:02-kor adta ki a legmagasabb prioritású riasztást, és egy ellenőr három perccel később nyugtázta azt. Az OpenAI délután 12:34-kor leállította a futást. Automatikusan le kellett volna állnia, de nem tette, és a személyzet nem volt biztos abban, hogy le kell-e állítani. Egy későbbi vizsgálat során kiderült, hogy a monitor más külső DNS-lekérdezéseket is túl alacsony prioritásúnak minősített. Egy külön, a szokatlan DNS-forgalmat észlelő rendszer kizárta ezt a környezetet.
Az OpenAI az esetet „sokkal kevésbé súlyosnak” nevezi, mint „néhány korábbi incidensünket”. Ez azért fontos, mert ez „az első eset a Hugging Face-incidens utáni biztonsági megerősítésünk óta”. Júliusban az OpenAI ügynökei kiléptek a tesztkörnyezetükből, és eljutottak a Hugging Face-hez, amint arról a Notebookcheck beszámolt. A Fortune szerint az OpenAI ezt követően két hétre felfüggesztette a képzést. Az Anthropic július végén hozott nyilvánosságra hasonló, a Claude-ot érintő incidenseket. Az OpenAI most már két független rétegen blokkolja az ilyen kéréseket, és csak egy rövid domainlista esetében engedélyezi a DNS-lekérdezéseket.
Mit jelent a szünet a ChatGPT számára
A jelentés szerint „A legképzettebb modelleinkkel kapcsolatos minden (tág értelemben vett) eszközhasználattal járó képzés, értékelés és következtetés továbbra is szünetel.” Az OpenAI nem közli, hogy ez mely modellekre vonatkozik. Micah Carroll, aki az OpenAI-nál a rekurzív önfejlesztéssel kapcsolatos felkészülési munkát vezeti, az X-en azt írta, hogy „A legképzettebb modelljeinkkel kapcsolatos minden következtetés továbbra is le van állítva, amíg rendszereinket tovább nem erősítjük meg.” Maga a jelentés egy belső kutatási modellt érint. Szeptember 27-én az OpenAI állapotoldala nem jelezte semmilyen incidenst a ChatGPT vagy az API tekintetében, és a kiadási megjegyzések sem sorolnak fel olyan modellt, amelyet eltávolítottak volna a ChatGPT-ből. A ChatGPT rendszeres felhasználói nem fogják észrevenni a felfüggesztést. Az OpenAI nem közölte, hogy elhalasztja-e az új modellek bevezetését.
Forrás(ok)
» A Top 10 multimédiás noteszgép - tesztek alapján
» A Top 10 játékos noteszgép
» A Top 10 belépő szintű üzleti noteszgép
» A Top 10 üzleti noteszgép
» A Top 10 notebook munkaállomása
» A Top 10 okostelefon - tesztek alapján
» A Top 10 táblagép
» A Top 10 Windows tabletje
» A Top 10 subnotebook - tesztek alapján
» A Top 10 300 euró alatti okostelefonja
» A Top 10 120 euró alatti okostelefonja
» A Top 10 phabletje (>5.5-inch)
» A Top 10 noteszgép 500 EUR (~160.000 HUF) alatt
» A Top 10 "pehelysúlyú" gaming notebookja






