Планирующие агенты против реактивных: кто дешевле в бою
Одни ИИ-агенты сначала строят план из десятка шагов, другие действуют по одному вызову за раз. Разница определяет счёт за токены, скорость ответа и то, где всё сломается.

Когда OpenAI, Anthropic и разработчики фреймворков вроде LangGraph говорят об «агентах», они имеют в виду две разные вещи. Один агент получает задачу, строит план из шагов и идёт по нему. Другой ничего не планирует: смотрит на текущее состояние, вызывает один инструмент, смотрит на результат, вызывает следующий. Первый подход называют планирующим (plan-and-execute), второй — реактивным (обычно это цикл ReAct1). От выбора зависит, сколько вы заплатите за токены, за сколько секунд придёт ответ и в какой момент система пойдёт вразнос.
Что реально отличается
Реактивный агент работает в петле: модель рассуждает, выбирает действие, получает наблюдение, снова рассуждает. Классическая связка «Thought → Action → Observation», повторяемая до тех пор, пока модель не решит, что задача закрыта. Планирующий сначала генерирует весь маршрут — «шаг 1: найти данные, шаг 2: посчитать, шаг 3: оформить отчёт» — а затем исполняет пункты, иногда перепланируя, если что-то пошло не так.
Разница не в интеллекте модели, а в том, где принимается решение о следующем шаге. У реактивного — на каждой итерации, у планирующего — один раз в начале (плюс редкие пересмотры плана).
Цена вопроса в токенах
Реактивный агент на каждом шаге тащит в контекст всю историю: изначальную задачу, все прошлые мысли, все наблюдения. К десятому шагу промпт распухает, и каждый вызов оплачивается по полной. Планирующий агент выносит стратегию наружу и на каждом шаге отправляет модели меньше контекста — часто только текущий пункт плана и нужные данные.
Точных универсальных цифр здесь нет — расход зависит от задачи, модели и того, как вы обрезаете контекст. Но направление устойчивое: чем длиннее цепочка действий, тем дороже обходится реактивный цикл относительно планирующего. На коротких задачах (два-три вызова) разница исчезает, и планирование становится лишними накладными расходами.
Реактивный агент гибок ровно настолько, насколько дорого вы готовы за эту гибкость платить на каждом шаге.
Где что ломается
У обоих подходов свои режимы отказа, и это важнее абстрактных достоинств.
Реактивный агент склонен зацикливаться. Он может по кругу вызывать один и тот же инструмент, получать один и тот же бесполезный результат и не понимать, что застрял. Отсюда обязательный предохранитель — лимит итераций. Без него агент способен сжечь бюджет за один запрос.
Планирующий ломается иначе: он строит план на основе неполной картины мира. Если на шаге 4 выясняется, что данные из шага 2 не подходят, наивный исполнитель всё равно продолжит по плану и выдаст мусор. Поэтому серьёзные реализации добавляют перепланирование — сверку результата с планом и его переписывание. Это возвращает часть гибкости реактивного подхода, но и часть его стоимости.
Сравнение по ключевым параметрам
| Параметр | Реактивный (ReAct) | Планирующий (plan-and-execute) |
|---|---|---|
| Решение о следующем шаге | На каждой итерации | Один раз в начале + перепланирование |
| Расход токенов на длинных задачах | Высокий, растёт с историей | Ниже за счёт вынесенного плана |
| Адаптация к неожиданному | Высокая, из коробки | Только при явном перепланировании |
| Типичный отказ | Зацикливание | Исполнение устаревшего плана |
| Предсказуемость и отладка | Ниже: путь каждый раз разный | Выше: план виден заранее |
| Где уместен | Короткие, слабо структурированные задачи | Длинные многошаговые процессы |
Как выбрать под свою задачу
Универсального победителя нет. Есть свойства задачи, которые склоняют чашу.
- Короткая задача в два-три вызова — берите реактивный. Планирование добавит вызов на генерацию плана и ничего не сэкономит.
- Длинный воспроизводимый процесс (собрать отчёт, обойти пять источников, оформить результат) — планирующий даст меньший счёт и предсказуемый маршрут, который проще логировать.
- Среда, где что угодно может измениться между шагами — реактивный или планирующий с частым перепланированием. Жёсткий план тут развалится.
- Нужна аудируемость (кто-то должен проверить, что агент собирался делать) — планирующий: план читается заранее, до исполнения.
На практике всё чаще собирают гибрид: планирующий верхний уровень раскладывает задачу на подзадачи, а каждую подзадачу решает реактивный подагент с жёстким лимитом итераций. Так стратегия остаётся дешёвой и читаемой, а тактика — гибкой.
Что обязательно закладывать в любую схему
- Лимит итераций или шагов — иначе первый же цикл-ловушка съест бюджет.
- Потолок стоимости на запрос в деньгах или токенах, с жёстким обрывом.
- Логирование каждого шага: вызов инструмента, вход, выход. Без этого отладка агента превращается в гадание.
- Понятный критерий завершения — когда именно задача считается решённой.
Спор «планировать или реагировать» на деле сводится к тому, что вы оптимизируете: минимальный счёт и предсказуемость — или максимальную адаптивность. Выбирать вслепую дорого: длинная задача на реактивном агенте без лимитов способна за один прогон превысить дневной бюджет на API. Начните с профиля своей задачи, а не с модного фреймворка.
1 ReAct (Reasoning + Acting) — схема работы агента, где модель чередует шаги рассуждения и действия: сначала формулирует мысль, затем вызывает инструмент, затем анализирует полученный результат и повторяет цикл.
Prompt-инженер: Идеальные запросы для Midjourney, ChatGPT и других моделей.
Спросить за 15 ₽Источники: ReAct: Synergizing Reasoning and Acting in Language Models (Yao et al.), LangGraph: Plan-and-Execute agents
Частые вопросы
Что дешевле по токенам — планирующий или реактивный агент?
Почему реактивный агент зацикливается?
Можно ли совмещать оба подхода?
Что такое перепланирование и зачем оно нужно?
Какой подход выбрать для аудируемого процесса?
Что обязательно заложить, чтобы агент не сжёг бюджет?
Материал носит информационный характер и подготовлен редакцией «Агентуры». Он не является офертой, рекламой или индивидуальной консультацией. Упомянутые продукты, компании и торговые знаки принадлежат их правообладателям. Перед принятием решений, влекущих юридические или финансовые последствия, обратитесь к профильному специалисту.