Команда AI-редактора Cursor опубликовала подробный отчет о разработке мультиагентной системы, способной генерировать около 1000 коммитов в час, что соответствует 10 миллионам вызовов инструментов за неделю без человеческого вмешательства. В качестве тестового проекта был выбран веб-браузер на Rust.
Дорога к успешной архитектуре была сложной. Первоначально агенты получили равные роли и общий файл для координации, но это привело к путанице и снижению производительности. Вторая схема с выделением ролей «планировщик — исполнитель — воркеры — судья» показала лучшие результаты, но оказалась слишком ограниченной. Третья версия, с непрерывным исполнителем, выявила проблемы, такие как засыпание агентов и преждевременные отчеты о выполнении.
Финальная архитектура превратилась в модель, напоминающую команду разработчиков: корневой планировщик управляет задачами и создает подпланировщиков. Воркеры работают с конкретными задачами в независимых копиях репозиториев. Команда также отметила, что требование 100% корректности коммитов замедляет работу системы. Поэтому был принят подход, допускающий минимальные ошибки, которые затем быстро исправляются.
Отдельное внимание уделено качеству инструкций — четкие формулировки обеспечивают более высокую продуктивность. В заключение, автор исследования Уилсон Лин предложил воспринимать модель как нового сотрудника с инженерными навыками, но без знания конкретной кодовой базы.
