Dario Amodei lassítaná az AI-ipar tempóját, egy háromlépcsős tervvel , amellyel az Anthropic vezetője azt szeretné elérni, hogy a biztonsági intézkedések lépést tartsanak az egyre képzettebb modellekkel. Nem a modellek tanításának leállításáról vagy a fejlődés befagyasztásáról beszél, hanem kontrollált lassításról. Az üzenetet különösen súlyossá teszi, hogy az AI-verseny egyik éllovasától érkezik.
Amodei szerint két fejlemény változtatta meg a kockázatokról alkotott képét. Az első a recursive self-improvement: az AI-modellek közvetlenül is hozzájárulnak a következő generációk fejlesztéséhez. Az Anthropic ezt már kutatási ügynökökkel teszteli. A második az OpenAI–Hugging Face incidens, amelyben AI-ügynökök a teszt célján kívül eső biztonsági műveleteket hajtottak végre. Amodei arra figyelmeztet, hogy a képzettebb, de ugyanilyen rosszul összehangolt rendszerek sokkal súlyosabb károkat okozhatnak.
Három lépés a lassításhoz, a verseny leállítása nélkül
A javaslat papíron meglehetősen konkrét:
- Állandóan jelen lévő független értékelők a csúcskategóriás modelleket fejlesztő vállalatoknál, a munkatársakéhoz közeli hozzáféréssel. Ők ellenőriznék a biztonsági szabályok betartását, jelentenék az incidenseket, és a tanítási folyamatokat is vizsgálnák. Az Anthropic közlése szerint ezt az intézkedést egyoldalúan is bevezeti.
- Közös szabványok a demokratikus országok AI-vállalatai között, beleértve az ellenőrizetlen fejlődés korlátait is. Ehhez a kormányok bevonására is szükség lenne, akár azért is, hogy a versenytársak közötti koordináció egyes formái jogszerűen megvalósulhassanak.
- Globális koordináció, az Egyesült Államok és olyan autoriter államok, mint Kína között is, ahol az egyezmények betartása ellenőrizhető.
Itt rajzolódik ki az érdekes ellentmondás: Amodei lassítaná az AI fejlődését, de nem bármi áron. Egyidejűleg azt is vallja, hogy az Egyesült Államoknak és szövetségeseinek meg kell őrizniük előnyüket Kínával szemben, vagyis a „féket” összehangoltan kellene használni, nem egyetlen vállalatnak vagy országnak. Senki sem akar elsőként levenni a lábát a gázpedálról, miközben a rivális tovább gyorsít.
Akár meglepő, akár nem, az üzenet a riválisoknál is visszhangra talált. Sam Altman szerint az OpenAI egyetért a belső hozzáféréssel dolgozó független értékelők ötletével, és hasonló intézkedést vezetne be; Elon Musk is támogatásáról biztosította a lassítás gondolatát. A vita néhány nappal azután erősödött fel, hogy egy volt Anthropic-kutató a szuperintelligenciáért folyó verseny veszélyeire figyelmeztetett. Ezúttal azonban nem csupán figyelmeztetésekről van szó: az egyik nagy AI-vállalat konkrét felügyeleti mechanizmust tesz az asztalra, és saját magán kezdi annak bevezetését.




