Куча ШІ-агентаў спальвае токены амаль без росту якасці — стваральнік Codex растлумачыў чаму
Распрацоўшчык OpenAI Codex Эрык Правенчэр папярэдзіў: запуск вялікай колькасці ШІ-агентаў паралельна часцей за ўсё проста рэзка павялічвае расход токенаў, не паляпшаючы вынік.
Распрацоўшчык OpenAI Codex Эрык Правенчэр папярэдзіў: запуск вялікай колькасці ШІ-агентаў паралельна часцей за ўсё проста рэзка павялічвае расход токенаў, не паляпшаючы вынік.
Правенчэр называе гэта «падаткам на каардынацыю». Чым больш агентаў працуе адначасова, тым больш часу і токенаў сыходзіць на паўторныя праверкі і дубліраванне дзеянняў.
«Вельмі складана падтрымліваць столькі паралельных патокаў, не дэградуючы ў хаос і не спальваючы токены на празмерныя праверкі», — напісаў ён. Паводле яго, агенты пачынаюць літаральна «пераправеряць хатнюю працу адно аднаго».
I hate to say it, but if you’re running more than 2 sub agents at time, you’re almost certainly burning tokens for 0 quality gain.
Agents don’t trust each other enough to avoid double-checking everyone’s homework.
У якасці прыкладу Правенчэр прывёў эксперымент, у якім 1393 агенты Claude Fable выкарыстоўваліся для рэфактарынгу аднаго Python-файла. На працу сышло каля $20 тысяч у токенах. Ён лічыць, што адзін агент GPT-6 Astra мог бы выканаць тую ж задачу за «нязначную долю гэтых выдаткаў».
Пры гэтым роі агентаў сапраўды могуць скараціць час выканання некаторых задач. Але Правенчэр называе перарасход токенаў «пасткай»: дадатковыя агенты патрабуюць уласных сістэмных промптаў, паўтараюць выклікі інструментаў і нярэдка робяць адну і тую ж працу.
«Дубліраванне працы — мабыць, галоўная праблема», — адзначыў распрацоўшчык. Замест пастаяннай працы вялікай колькасці агентаў Правенчэр прапануе дзяліць задачу на асобныя патокі і вяртаць вынікі галоўнаму агенту толькі пасля завяршэння, без пастаяннага апытання астатніх. Ён таксама прызнаў, што OpenAI яшчэ належыць палепшыць інструменты для каардынацыі некалькіх агентаў.
Рэлацыраваліся? Цяпер вы можаце каментаваць без верыфікацыі акаўнта.