Команда AI-редактора Cursor представила подробное исследование архитектуры своей мультиагентной системы, которая на пике своей работы достигала почти 1000 коммитов в час и 10 миллионов инструментальных вызовов за неделю без человеческого вмешательства. В качестве тестового проекта выступал веб-браузер, разработанный на языке Rust.

Процесс достижения работоспособной архитектуры оказался непростым. Первая попытка, основанная на равных ролях для агентов и едином файле для координации, провалилась: агенты путались и не могли эффективно работать вместе. Попытка разделить роли на «планировщик — исполнитель — воркеры — судья» показала лучшие результаты, но была чрезмерно жесткой и зависела от медленных участников. В итоге, финальная архитектура напоминала привычную команду разработчиков с иерархической структурой, где корневой планировщик координует работу подчиненных.

Ключевым выводом стало то, что требование о полной корректности дебаговало производительность, в то время как допустимые небольшие ошибки позволяли maintaining стабильность в системе. Команда также подчеркнула важность четких исходных инструкций для эффективного выполнения задач.