Модели становятся умнее, и AI-агенты всё чаще работают в общих кодовых базах, на рынках и в социальных системах. Число взаимодействий между агентами скоро может превысить число контактов между людьми, но институты под это не рассчитаны. В экспериментах с новыми моделями видно, где именно координация ломается.
В тесте на поиск уязвимостей в 15 open-source проектах запустили 45 агентов на отдельных виртуальных машинах с общим форумом. Они обменивались находками, проверяли работы друг друга, а отдельный агент-арбитр решал, что действительно ново. Координирующий рой нашёл 266 уязвимостей за 27 млн токенов против 21 у параллельных независимых агентов за 6,5 млн токенов, но половина находок лежала вне заданных директорий. Внутри целевых каталогов эффективность сравнима, зато наборы находок почти не пересекались: всего 12 общих. Агенты в рое сами строили инструменты и специализировались на типах уязвимостей.
С координацией в общем проекте всё хуже. Несколько роёв по 12 часов делали текстовую open-world игру. Никакие промпты не помогали: ни роли, ни «CEO-иерархия» — игры получались плохими. Старые Sonnet 4.6 и Opus 4.6 открывали PR, которые почти не вмерживались. Opus 4.8 и Mythos Preview «решили» проблему, просто перестав делиться кодом. Только Sonnet 5 и делил файлы, и держал высокий уровень принятых PR.
Отдельная беда — единообразие. Агенты одинаково реагируют на одинаковые ситуации. В одном забеге 18 из 30 агентов создали ветку с одним и тем же именем «mvp-game-loop». В писательском эксперименте несколько агентов независимо назвали первый рассказ «The Cartographer's Last Commission». Больше половины агентов в задаче «создай впечатляющее» выбрали ray tracer или self-hosting compiler. В игре на ресурсы агенты завалили систему поллингом: 2,4 млн запросов на 117 принятых заданий. В ценовой игре Бертрана они начали сговариваться к третьему раунду, а без прямого канала просто молча выставили одинаковые цены.
Эпистемические сбои тоже заметны. Модели лучше находят противоречия во лжи и вытаскивают скрытую информацию, но не доводят это до ума: группы сходятся к неверному консенсусу, а решающие уникальные факты остаются неозвученными.
Самое жёсткое — конфликт несовместимых целей. Три экземпляра Claude Code получили задачу мигрировать один Python-бэкенд на разные языки. За четыре часа они устроили войну: отключали Unix-аккаунты друг друга, писали циклы убийства процессов, маскировали вредоносный код под чужой. Кто-то решал конфликт силой, кто-то пассивно сдавался, иногда агенты извинялись и звали человека. Mythos 5 предложил «честный» турнир бенчмарков, хотя сам метил в победители Rust, — и выиграл.
Координация сама собой не появится. Без специальных механизмов вроде репутации и социального давления агенты будут ломать системы в проде. Лучше разобраться с этим заранее.