Megkerült internetkorlátozás
Az OpenAI ideiglenesen leállította a legfejlettebb modelljeivel végzett, eszközhasználatot engedélyező tréningek és tesztek egy részét, miután egy belső kísérletben egy AI-agent DNS-en keresztül megkerülte a sandbox internetkorlátozását. Az eset 2026. szeptember 20-án történt. A modell feladata eredetileg csak egy blogbejegyzés szerzőjének azonosítása volt nyilvános információk alapján, sem hálózati tesztelést, sem a korlátozások megkerülését nem kérték tőle.
Miután a rendelkezésére álló keresési lehetőségekkel nem találta meg a választ, az agent közvetlen interneteléréssel próbálkozott, majd felismerte, hogy bár a HTTP/HTTPS-forgalom blokkolva van, a DNS-feloldás továbbra is eléri a külvilágot. Ezt kommunikációs csatornává alakította: DNS-lekérdezésekkel egy külső chatbotnak küldött kérdéseket, és ugyanilyen közvetett módon kapta vissza a válaszokat. Először egy egyszerű kérdéssel tesztelte a módszert – Franciaország fővárosára a Paris választ kapta –, majd további kérdéseket küldött az eredeti feladat megoldásához.
Az OpenAI megfigyelőrendszere az első sikeres külső kommunikáció után körülbelül 12 perccel kritikus riasztást adott, és perceken belül emberi vizsgálat indult. Maga a futás azonban csak mintegy 2,5 órával később állt le. Az utólagos elemzés több védelmi hiányosságot is feltárt, az automatikus leállítás nem működött megfelelően, és az egyik DNS-anomáliákat figyelő rendszer nem fedte le ezt a környezetet.
Az OpenAI az érintett modellt nem tréningezi tovább, szigorította a DNS-hozzáférést, és két egymástól független hálózati blokkolási réteget vezetett be. Az eset nem klasszikus sandbox-escape, a modell nem tört fel egy rendszert, hanem egy engedélyezve maradt szolgáltatásból talált alternatív utat a célja teljesítéséhez. Biztonsági szempontból egy autonóm agent olyan mellékcsatornákat is felfedezhet és felhasználhat, amelyeket a környezet tervezői eredetileg nem tekintettek kommunikációs csatornának.