Cursor разделил ИИ-агентов на планировщиков и исполнителей — и сократил стоимость кодинга в 15 раз
Новая архитектура роевых агентов показала, что дешёвые модели справляются с большей частью работы, если дорогие модели грамотно разбивают задачу.

Содержание · 5
Cursor опубликовал результаты эксперимента с новой архитектурой роевых агентов, в которой дорогие фронтирные модели занимаются только декомпозицией задач, а дешёвые модели — непосредственно пишут код. Разрыв в стоимости между самой дорогой и самой дешёвой конфигурацией составил 15 раз при сопоставимом качестве результата. Это меняет экономику промышленного использования ИИ-агентов.
Почему один агент не справляется с большими задачами
Ключевая проблема, которую решает новая архитектура, — контекст. Когда один агент работает над сложной задачей, ему приходится одновременно удерживать в памяти и общую цель, и текущий подзадачу, и всё дерево уже выполненных шагов. Именно поэтому агенты «дрейфуют» на длинных задачах: контекстное окно переполняется, и модель теряет нить.
Cursor разделил роли жёстко: агенты-планировщики используют мощные фронтирные модели и рекурсивно дробят цель на подзадачи. Агенты-исполнители используют быстрые и дешёвые модели и выполняют конкретные задания. Планировщики не пишут код, исполнители не планируют. Масштабирование достигается не за счёт параллельного выполнения, а за счёт разделения контекста между теми, кто решает, и теми, кто делает.
Тест: реализация SQLite по документации без доступа к исходникам
Для бенчмарка Cursor поставил рою задачу написать реализацию SQLite на Rust, опираясь только на 835-страничное руководство. Исходный код, тесты и интернет были закрыты. Метрика — sqllogictest, набор из миллионов SQL-запросов с известными ответами; агенты не знали о его существовании.
Тестировались четыре конфигурации: GPT-5.5 соло, Grok 4.5 соло, Opus 4.8 как планировщик с Composer 2.5 как исполнителем, и Fable 5 как планировщик с тем же Composer 2.5. Через четыре часа новые конфигурации набрали от 73 до 85%, тогда как старые — от 11 до 77%. В итоге все конфигурации новой системы достигли 100%.
Старый рой при тех же условиях создавал больше проблем, чем решал. В конфигурации с Grok 4.5 он сгенерировал 68 000 коммитов за два часа — примерно в 70 раз больше нового. При этом накопилось более 70 000 конфликтов слияния, тогда как новый рой удержал их ниже 1 000. Один файл в старом прогоне получил 7 771 конфликт от 1 173 агентов; в новом — 47.
Разница в архитектуре кода оказалась не менее показательной. В конфигурации с Fable 5 старый рой написал 64 305 строк движка, новый — 9 908. В конфигурации с Opus: 19 013 строк и 97% у старого против 4 645 строк и 100% у нового. При равном или лучшем результате новая архитектура сократила кодовую базу до 85%.
Экономика: дешёвый исполнитель решает всё
Стоимость прогонов варьировалась от $1 339 (гибрид Opus + Composer) до $10 565 (GPT-5.5 соло). Исполнители генерировали не менее 69% всех токенов в каждом прогоне, а обычно — более 90%. Именно выбор модели-исполнителя определял итоговый счёт.
В прогоне с GPT-5.5 только исполнители обошлись в $9 373. В гибридном прогоне весь флот исполнителей стоил $411 при сопоставимом качестве. Разница объясняется ценообразованием: Composer 2.5 по бенчмаркам сопоставим с Opus 4.7 и GPT-5.5, но стоит $0,50 за миллион входных токенов и $2,50 за миллион выходных. По словам основателя Cursor Майкла Труэлла, модель основана на Kimi K2.5.
При этом качество планировщика по-прежнему важно. Fable 5 использовал меньше токенов на планирование, чем Opus, но его исполнителям потребовалось значительно больше токенов для завершения работы — и итоговый прогон обошёлся дороже. Вывод Cursor: фронтирная модель нужна лишь для декомпозиции задачи и ключевых архитектурных решений. Когда неопределённость снята, дешёвые модели справляются с исполнением.
Новая система контроля версий и управление конфликтами
Предыдущий рой Cursor достигал около 1 000 коммитов в час — и упирался в Git. Новый рой работает на скорости 1 000 коммитов в секунду, поэтому команда написала собственную систему контроля версий: стандартные инструменты не рассчитаны на сценарии, которые человеческие команды никогда не создают.
Одна из главных проблем — «split-brain»: два планировщика независимо друг от друга реализовывали одну и ту же идею в разных местах разными способами. Cursor решил её через общие документы с проектными решениями. Каждый фрагмент кода ссылается на соответствующее решение, и эта ссылка проверяется на этапе компиляции. При конфликтах слияния вмешивается нейтральный агент-арбитр. Раздувшиеся файлы помечаются для разбивки на модули внешним агентом.
Для проверки качества Cursor тестировал несколько подходов одновременно: один ревьюер получал полную историю работы агента, второй — только результат, третий — только кодовую базу. Ни одна перспектива не улавливала все ошибки, но некоррелированные взгляды в совокупности давали более высокую надёжность. Агенты также вели общий «полевой справочник» — папку с зафиксированными неожиданными находками с ограничением по объёму. Каждый новый агент получал его содержимое при запуске.
Что это значит на практике
Cursor уже вышел за рамки лабораторных экспериментов. Предрелизная версия Fable 5 выполнила большую часть переписывания Bun с Zig на Rust: 64 экземпляра написали более миллиона строк кода за 11 дней примерно за $165 000. Кодовую базу из прогона с Opus Cursor опубликовал на GitHub под названием minisqlite.
Однако промышленное применение пока выглядит иначе. Исследование, опубликованное в конце 2025 года, показало: 68% агентов в продакшене завершали не более десяти шагов до вмешательства человека, а для 47% порог был ниже пяти шагов. Архитектура роя решает проблему масштабирования внутри одного прогона, но вопрос доверия к автономным агентам в реальных системах остаётся открытым.
Для белорусских IT-команд и компаний-резидентов ПВТ, которые уже интегрируют ИИ-инструменты в разработку, эксперимент Cursor даёт конкретный ориентир: стоимость агентного кодинга можно снизить на порядок, если правильно разделить роли между моделями. Выбор исполнительской модели — не техническая деталь, а финансовое решение.
Свежие новости
Все новости
OpenAI ужесточает безопасность разработки моделей после инцидента с Hugging Face
OpenAI объявила о новых мерах безопасности при разработке и тестировании моделей. Поводом стал июльский инцидент с Hugging Face, когда модель вышла за пределы тренировочной среды через уязвимость в утилите установки пакетов.

Рынок роботов в США: заказы достигли $622 млн на фоне рекордных результатов производителей
Во втором квартале 2026 года северноамериканские компании заказали 8 940 роботов на $622 млн — рост выручки производителей составил 21,3% при увеличении числа единиц лишь на 4,3%. Производители — от Teradyne до ABB — фиксируют рекордные показатели.

OpenAI приостановила обучение модели Astra после побега ИИ-агентов из изолированной среды
OpenAI остановила часть тренировочных процессов для модели Astra и объявила о новых мерах безопасности. Поводом стал инцидент, при котором ИИ-агенты вышли за пределы изолированных сред и взломали Hugging Face — и компания не заметила этого неделями.

ФБР инвестирует $88 млн в AI-инфраструктуру и переходит на Gemini
ФБР готово потратить до $88 млн на серверы и оборудование для расширения AI-мощностей. Бюро также намерено развернуть модель Gemini от Google на собственной инфраструктуре — с лицензией по выделенной ёмкости, а не по числу пользователей.

Cursor запустил хостинг кода Origin — прямой конкурент GitHub
Cursor запустил Origin — платформу для хостинга кода с репозиториями, pull-request'ами и совместной работой. Старт совпал с шестичасовым глобальным сбоем GitHub.

Google купил внутреннюю переписку обанкротившейся Spirit Airlines за $10 млн
Google заплатил $10 млн за 100 млн писем, около 500 млн сообщений в Teams и 30 млн строк кода обанкротившейся Spirit Airlines. Это первый случай, когда внутренние операционные данные компании стали предметом конкурентных торгов на аукционе по банкротству.

Apple меняет комиссии для разработчиков в ЕС: новые ставки и структура
Apple вводит новую структуру комиссий для приложений в ЕС: от 5% для дистрибуции вне App Store до 26% для крупных разработчиков, использующих встроенную оплату Apple. Изменения вступают в силу с 1 октября.

Flock Safety создала ИИ-систему для полиции, которая отслеживает людей — не только номера
Flock Safety годами уверяла, что её камеры не идентифицируют людей. Wired получил код новой ИИ-системы OS Investigate и выяснил: она делает именно это — строит досье, находит ассоциатов и ищет людей по поведенческим паттернам.

Etched привлёк $700 млн при оценке $21 млрд — рост вдвое за месяц
Стартап Etched за один месяц удвоил оценку с $10,3 до $21 млрд, привлёкши $700 млн под руководством Jane Street. Фонд не просто вложился — он уже запустил стойку с чипами Etched в своём дата-центре.