Dario Amodei figyelmeztetése

Editors' Pick

Az Anthropic vezérigazgatója, Dario Amodei szerint az AI kiberképességeinek fejlődése olyan ütemet ért el, hogy 6–12 hónapon belül elképzelhetővé válhat egy nagyméretű, AI-agentek által irányított botnet. Amodei nem azt állítja, hogy ilyen rendszer ma már létezik vagy biztosan létrejön, egy kockázati forgatókönyvet vázol fel arra az esetre, ha a modellek képességei tovább gyorsulnak, miközben a biztonsági korlátok nem fejlődnek velük együtt. Becslése szerint egy tartósan fennmaradó, internetes rendszereket tömegesen kompromittáló hálózat akár több százmilliárd dolláros kárt is okozhatna. 

A félelmet a közelmúlt kiberbiztonsági tesztjeivel indokolja. Fejlett AI-agentek már képesek hosszú támadási folyamatokat végrehajtani, rendszereket felderíteni, sérülékenységeket keresni és kihasználni, hitelesítő adatokat megszerezni, majd további célpontok felé továbblépni. Korábbi tesztek során Anthropic-modellek hibásan izolált környezetből valódi rendszereket is kompromittáltak, az egyik modell például rosszindulatú PyPI-csomagot publikált, amelyet valódi gépek telepítettek. Amodei szerint a következő lépcső az lehet, amikor sok száz vagy ezer ilyen agent párhuzamosan dolgozik, és folyamatosan új gépeket keres a már megszerzett infrastruktúráról. 

A probléma nem egy új AI-vírus, hanem az automatizálás léptéke. Egy agent képes lehet felderítésre, exploitok adaptálására és a kompromittált rendszerek kezelésére, miközben további agentpéldányok ugyanezt végzik más célpontokon. Ha ehhez önfenntartó infrastruktúra és megfelelő perzisztencia társul, az emberi operátoroknál lényegesen gyorsabban terjedő támadási rendszer jöhet létre. A teljes internet átvétele ezért nem szó szerint minden internetes eszköz elfoglalását jelenti, hanem egy olyan kiterjedt botnet lehetőségét, amelynek felszámolása rendkívül nehéz lenne. 

Amodei ezért a frontier modellek fejlesztési ütemének tudatos lassítását javasolja. Első lépésként az AI-laboroknak független külső értékelők számára tartós, alkalmazotti szintű hozzáférést kellene biztosítaniuk a legfejlettebb modellek teszteléséhez, ezt az Anthropic saját maga vállalja. Ezt közös biztonsági követelmények és a demokratikus országok közötti koordináció követné, hosszabb távon pedig nemzetközi megállapodások korlátozhatnák a különösen veszélyes képességek – például az AI-val gyorsított önfejlesztés – ellenőrizetlen növekedését. Amodei érvelése szerint akár egy-két évnyi plusz idő is jelentősen többet adhatna a kiberbiztonsági védelem, az AI-alignment, az interpretálhatóság és a biztonsági tesztelés fejlesztésére.

FORRÁS