Открытый и закрытый reasoning: что видно в агентах и что скрыто
OpenAI прячет полную цепочку рассуждений o1 за суммаризацией, DeepSeek и Anthropic показывают её почти целиком. Для тех, кто строит агентов, это разница в отладке, счетах за токены и рисках.

Модели с рассуждением (reasoning) генерируют промежуточные шаги перед финальным ответом — так называемую цепочку рассуждений, chain-of-thought. С выходом OpenAI o1 в конце 2024 года и линейки o3 в 2025-м рынок разделился на два подхода. Одни вендоры отдают эту цепочку разработчику целиком, другие показывают только короткую выжимку, а сами рассуждения держат в закрытом виде. Если вы собираете агента поверх этих API, разница влияет на три вещи сразу: сколько вы платите, как отлаживаете сбои и что можете показать в аудите.
Что такое reasoning-токены и почему из-за них спор
Reasoning-модель тратит токены дважды: сначала на внутренние рассуждения, потом на видимый ответ. У o1 и o3 эти внутренние токены (reasoning tokens1) тарифицируются как обычные выходные, но их содержимого вы в API OpenAI не видите — приходит только итоговый ответ и, при запросе, короткое резюме хода мысли.
DeepSeek с моделью R1 и Anthropic с режимом extended thinking у Claude пошли иначе: полная или почти полная цепочка возвращается в ответе. Вы читаете, как модель перебирала варианты, где ошиблась и почему выбрала конкретный путь.
Скрытая цепочка рассуждений — это чёрный ящик, за содержимое которого вы платите по счётчику, но заглянуть внутрь не можете. Для агента, который принимает решения за пользователя, это не мелочь.
Почему OpenAI прячет цепочку
Компания объясняла закрытость двумя причинами: защита от копирования обучающих данных конкурентами (по сырой цепочке можно дистиллировать модель) и свобода модели рассуждать без цензуры, которую пришлось бы применять к видимому пользователю тексту. Аргумент спорный: разработчики теряют главный инструмент отладки — возможность увидеть, где логика свернула не туда.
Три сценария, где разница видна в деньгах и нервах
- Отладка агента. Когда агент выдал неверное действие — вызвал не тот инструмент, придумал несуществующий параметр — открытая цепочка показывает момент ошибки. С закрытой вы видите только результат и гадаете по резюме.
- Стоимость. Reasoning-токены на сложной задаче могут в разы превышать объём финального ответа. Вы платите за них в обоих подходах, но при закрытом видите лишь агрегированную цифру в поле usage, без понимания, на что ушёл бюджет.
- Аудит и комплаенс. В регулируемых областях от системы иногда требуют объяснимость. Открытая цепочка — сырьё для такого объяснения, хотя и не гарантия: модель может рассуждать одно, а ответить другое.
Важная оговорка про «честность» цепочки
Цепочку рассуждений нельзя читать как протокол реального мышления модели. Исследования Anthropic по faithfulness (верности рассуждений) показывали, что модель порой приходит к ответу одним путём, а в видимой цепочке описывает другой — то есть текст рассуждения не всегда объясняет, почему получился именно такой вывод. Открытый reasoning помогает в отладке, но не превращает модель в прозрачную.
Сравнение подходов
| Параметр | Закрытый reasoning (OpenAI o1/o3) | Открытый reasoning (DeepSeek R1, Claude extended thinking) |
|---|---|---|
| Доступ к цепочке | Только резюме | Полная или почти полная цепочка |
| Тарификация внутренних токенов | Да, как выходные | Да, как выходные |
| Отладка сбоев агента | Косвенная, по итогам | Прямая, по шагам |
| Риск дистилляции | Ниже (цепочка скрыта) | Выше (цепочка доступна) |
| Пригодность для аудита | Ограниченная | Выше, но не абсолютная |
Конкретные цены на reasoning-токены и лимиты у вендоров меняются часто — актуальные цифры сверяйте на страницах прайсинга OpenAI, Anthropic и DeepSeek, а не по этой таблице.
Как выбирать под свою задачу
- Оцените, нужна ли вам цепочка вообще. Для простой генерации текста reasoning-модель — переплата. Она оправдана на задачах с многошаговой логикой: код, планирование, математика, разбор длинных цепочек условий.
- Если строите агента с инструментами — открытая цепочка резко ускоряет разбор инцидентов. Заложите её как критерий выбора модели.
- Если данные чувствительны или конкуренты агрессивны — закрытый reasoning снижает риск утечки логики через сырьё рассуждений.
- Считайте бюджет по реальным прогонам. Возьмите десяток типичных запросов, замерьте поле usage и посмотрите долю reasoning-токенов. На сложных промптах она способна съесть основную часть счёта.
- Не полагайтесь на цепочку как на юридическое объяснение. Для комплаенса стройте отдельный слой логирования действий агента, а reasoning используйте как вспомогательный, а не единственный источник.
Что это меняет для рынка
Разделение на открытый и закрытый reasoning стало новой осью конкуренции. DeepSeek сделал открытость аргументом продаж и давления на цены. OpenAI держит закрытость как защиту модели и данных. Anthropic балансирует: показывает extended thinking, но с оговорками про его неполноту. Для разработчика это значит, что выбор модели теперь — не только про качество ответа и цену за миллион токенов, но и про то, увидите ли вы, как агент пришёл к решению, когда он ошибётся в проде.
1 Reasoning-токены — внутренние токены, которые модель тратит на промежуточные рассуждения перед финальным ответом. В API они обычно учитываются в счёте как выходные, но их текст при закрытом подходе пользователю не возвращается.
Prompt-инженер: Идеальные запросы для Midjourney, ChatGPT и других моделей.
Спросить за 15 ₽Источники: OpenAI — Learning to Reason with LLMs (o1), Anthropic — Extended thinking, документация Claude
Частые вопросы
Плачу ли я за reasoning-токены, если не вижу их содержимого?
Можно ли доверять открытой цепочке как объяснению решения модели?
Какая модель дешевле для агента — с открытым или закрытым reasoning?
Зачем OpenAI скрывает цепочку рассуждений?
Нужна ли reasoning-модель для обычной генерации текста?
Подходит ли открытая цепочка для регулируемых отраслей?
Материал носит информационный характер и подготовлен редакцией «Агентуры». Он не является офертой, рекламой или индивидуальной консультацией. Упомянутые продукты, компании и торговые знаки принадлежат их правообладателям. Перед принятием решений, влекущих юридические или финансовые последствия, обратитесь к профильному специалисту.