Псевдоавтономность: почему «ИИ-агенты» всё ещё нужны няньке
Продукты продают как автономных агентов, которые сами закроют задачу от начала до конца. На практике за ними приходится следить, перепроверять и подстраховываться. Разбираем, где кончается маркетинг и начинается ручной труд.

Осенью 2024 — весной 2025 крупные вендоры один за другим выкатили «агентов»: Anthropic показала Computer Use, OpenAI — Operator, а десятки стартапов пообещали, что их система сама забронирует, закажет, напишет и разошлёт. Формулировка почти везде одинаковая — «автономный ИИ-агент, который выполняет задачу за вас». Проблема в том, что слово «автономный» в этих релизах и слово «автономный» в вашей голове означают разные вещи. Между ними — человек, который всё ещё сидит рядом и жмёт «подтвердить».
Что вендор называет автономией
В маркетинговом смысле агент — это модель, обёрнутая в цикл: она получает цель, разбивает её на шаги, вызывает инструменты (браузер, API, терминал), смотрит на результат и решает, что делать дальше. Формально это действительно больше, чем чат: система сама выбирает следующее действие, а не ждёт вашей реплики на каждом шаге.
Но «сама выбирает» и «можно оставить без присмотра» — не одно и то же. Демонстрации почти всегда показывают удачный прогон на задаче, которую подобрали заранее. В реальном использовании появляются три вещи, которых нет в ролике: незнакомый интерфейс, неоднозначная формулировка задачи и цена ошибки.
Автономность продают как «поставил и забыл». Покупаете вы «поставил и не отходишь» — просто теперь не отходишь от агента, а не от таблицы.
Откуда берётся «псевдо»
Псевдоавтономность — это когда система формально действует без вашего участия, но надёжность на длинной цепочке шагов такая, что оставить её без надзора нельзя. Причина математическая. Если на каждом отдельном шаге агент прав в 95% случаев, то на цепочке из 20 шагов вероятность, что он не ошибётся ни разу, — это 0,95 в двадцатой степени, около 36%. То есть примерно в двух прогонах из трёх где-то будет сбой. А задачи «забронируй, оплати, разошли» — это как раз десятки шагов.
Отсюда парадокс: чем сложнее задачу вы отдаёте агенту, тем нужнее человек, который поймает ошибку. Именно на сложных задачах автономность и обещали.
Где грань проходит на практике
Полезнее делить не на «автономно / неавтономно», а по уровню надзора, который задача реально требует.
| Уровень | Что делает система | Роль человека | Пример |
|---|---|---|---|
| Подсказка | Предлагает вариант, ничего не меняет | Решает и делает сам | Автодополнение кода |
| Черновик | Готовит результат целиком | Проверяет и правит перед отправкой | Драфт письма, отчёта |
| Действие под контролем | Выполняет шаги, спрашивает на важных | Подтверждает ключевые действия | Агент в браузере с паузой перед оплатой |
| Настоящая автономия | Отрабатывает задачу до конца | Смотрит логи постфактум | Узкий скрипт с чёткими правилами |
Почти всё, что сейчас продают как «автономных агентов», живёт на третьей строке, а рекламируется как четвёртая. Настоящая автономия достижима — но обычно там, где задача узкая, правила жёсткие и цена ошибки низкая, а не там, где «сделает за вас что угодно».
Красные флаги в описании продукта
- «Полностью автономный» без указания домена. Автономность бывает только на конкретном классе задач. Универсальной не существует.
- Нет слова «подтверждение» или «откат». Если продукт не рассказывает, как вы вмешиваетесь и отменяете действие, значит, об этом не подумали — или скрывают, что вмешиваться придётся часто.
- Метрики только на «золотых» сценариях. Спрашивайте про success rate на ваших задачах, а не на демо.
- Оплата, отправка, удаление — без паузы. Любое необратимое действие агент должен выносить на подтверждение.
Как выбирать и внедрять без иллюзий
Если вы решаете, брать ли агента в работу, действуйте по шагам:
- Опишите задачу как цепочку шагов. Посчитайте, сколько их. Чем длиннее цепочка, тем ниже итоговая надёжность.
- Отметьте необратимые шаги. Оплата, отправка клиенту, изменение боевой базы. Их выносите на ручное подтверждение независимо от обещаний вендора.
- Прогоните на своих данных, а не на демо. 20–50 реальных кейсов дадут честный процент успеха.
- Посчитайте цену ошибки. Если один сбой стоит дороже, чем вся экономия от автоматизации за месяц, автономия вам пока не по карману.
- Оставьте человека на контроле там, где цена высокая. Это не провал внедрения, а нормальный режим на сегодняшнем уровне моделей.
Экономика тоже не всегда сходится. Агент, который делает 20 вызовов модели на задачу вместо одного, стоит соответственно дороже. Если каждый прогон надо ещё и перепроверять руками, вы платите дважды: за токены и за время проверяющего.
Значит ли это, что агенты бесполезны
Нет. На черновиках и на узких повторяющихся операциях они экономят реальные часы. Ошибка не в технологии, а в ожидании: вам продают отсутствие человека в процессе, а получаете вы смену его роли — с исполнителя на контролёра. Это по-прежнему выгодно, но считать нужно исходя из этой роли, а не из рекламного «поставил и забыл».
Проверяйте не обещание автономии, а её границы. Вопрос не «автономен ли агент», а «на какой задаче, с какой надёжностью и что случится, когда он ошибётся». Ответ на него вендор в ролике обычно не даёт — его придётся получить самому.
Prompt-инженер: Идеальные запросы для Midjourney, ChatGPT и других моделей.
Спросить за 15 ₽Источники: Anthropic — Introducing computer use, OpenAI — Introducing Operator
Частые вопросы
Чем агент отличается от обычного чат-бота?
Почему длинные задачи ломаются чаще коротких?
Можно ли доверить агенту оплату или отправку клиенту?
Как проверить реальную надёжность перед внедрением?
Агент действительно экономит деньги?
Появится ли настоящая автономия в ближайшее время?
Материал носит информационный характер и подготовлен редакцией «Агентуры». Он не является офертой, рекламой или индивидуальной консультацией. Упомянутые продукты, компании и торговые знаки принадлежат их правообладателям. Перед принятием решений, влекущих юридические или финансовые последствия, обратитесь к профильному специалисту.