Когато не един AI агент върши работата, а няколко наведнъж. Понякога се допълват, понякога си пречат.
Пращаш петима души да купят подарък за един и същ рожден ден, без да се чуят. Връщат се с пет шала. Поотделно никой не е сбъркал. Сбъркала е организацията.
Anthropic описа през юни 2025 г. как е построила своята система за проучвания. Схемата е проста. Водещ агент получава въпроса, разделя го и праща по-малки агенти да търсят паралелно, всеки в своята посока. После водещият сглобява. По данни на компанията, на нейния вътрешен тест тази система се е справила с 90,2% по-добре от един-единствен агент с Claude Opus 4.
Удоволствието не е евтино. Пак по данни на Anthropic, един агент харчи около четири пъти повече токени от обикновен разговор, а многоагентната система - около 15 пъти повече. Токените са парчетата текст, по които се плаща работата на модела. Повече агенти, повече сметка.
А грешките са точно като с подаръка. Ранните агенти пускали по 50 подагента за прост въпрос, търсели безкрайно източници, които не съществуват, и се разсейвали един друг с излишни съобщения. Без подробно описание на задачата дублират работата и оставят дупки. Това го пише самата Anthropic.
Изследователи стигат до същото и отвън. В работа от 2025 г. екип описа 14 начина, по които такива системи се провалят, и ги проследи в над 1600 записа от седем популярни инструмента за строене на агенти. Подредиха ги в три групи: лошо устроена система, разминаване между агентите и слаба проверка на крайния резултат.
Кога си струва
Anthropic сама казва къде не става: когато всички агенти трябва да виждат едно и също или зависят силно един от друг. Повечето задачи с код, по нейните думи, имат по-малко неща за вършене наистина паралелно, отколкото едно проучване. Преди да пуснеш рой, питай дали задачата наистина се дели на парчета. Ако не се дели, един агент е по-евтин и по-лесен за следене.