Az AI-ügynökök egyre jobbak azokban a feladatokban, ahol gyorsan eldönthető, hogy helyes-e a válasz, de ebből azonban még nem következik, hogy képesek önálló, nyílt végű kutatásra! Márpedig az AI robbanásszerű önfejlesztéséről szóló forgatókönyvek jelentős része éppen ezt feltételezi.
Egy friss kísérletben frontier AI-ügynökök két, korábban nem publikált kutatási problémán dolgoztak hat napon át, jelentős számítási és API-kerettel. Mindkét elkészült tanulmányt egyértelműen elutasították az eredeti kutatók: az ügynökök ígéretes ötleteket vetettek fel, de gyenge adatok alapján gyorsan elvetették őket, nem tudtak érdemben visszalépni és stratégiát váltani, a kritikákra pedig inkább óvatosabb megfogalmazásokkal, mint jobb kutatással reagáltak. Még a rendelkezésükre álló időt és költségkeretet sem használták ki.
Ez fontos különbség: az ellenőrizhető részfeladatok felgyorsítása nem azonos a teljes kutatási folyamat automatizálásával. Ha az ítélőképesség, a kreatív irányváltás vagy a valós kísérletek továbbra is szűk keresztmetszetek maradnak, akkor egyes munkafázisok százszoros gyorsulása sem feltétlenül vezet robbanásszerű fejlődéshez.
A vizsgálat mindössze két esetre épül, és nem bizonyítja, hogy az ügynökök ezeket a korlátokat nem fogják hamar leküzdeni. De látjuk, hogy az önfejlesztő AI felé vezető út rögös, és nem feltétlenül automatikusan elérhető. Ezért még nincs késő a lassításhoz sem: a kapcsolódó elemzés szerint egy nemzetközi megállapodás ellenőrzéséhez sem feltétlenül jövőbeli technológia, hanem politikai akarat és kölcsönös, helyszíni auditálás kellene.
Van még időnk cselekedni, de nem kellene tovább várni.
Források:
https://www.normaltech.ai/p/ai-agents-cant-yet-do-open-ended
https://ai-frontiers.org/articles/an-international-ai-slowdown-is-ready-whenever-politicians-are