Обновлено 21 июля 2026
Think-тул для агентов: пауза между вызовами, когда правил много

Anthropic описала паттерн think для длинных цепочек вызовов инструментов: фиктивный тул, куда модель пишет промежуточные рассуждения после каждого ответа тула — сверить политики, набросать план, не трогая базу и не запрашивая новых данных. Extended thinking запускается до генерации ответа; think вклинивается между шагами, когда решение зависит от только что полученного вывода.
С 15 декабря 2025 года в большинстве сценариев Anthropic советует extended thinking вместо отдельного think-тула — он лучше встроен в рантайм. Сам приём с фиктивным инструментом остаётся рабочим для агентов в Cursor, MCP-серверах и своих рантаймах.
Что показали тесты
На τ-Bench в авиадомене связка think и промпта с примерами дала pass^1 = 0,570 против 0,370 у baseline — относительный прирост 54%.
В retail одного think хватило для 0,812 при baseline 0,783. В SWE-bench аналогичный тул добавили к Claude 3.7 Sonnet: итог 0,623, изолированный вклад think — +1,6% в среднем.
Когда подключать
- разбор вывода предыдущих тулов перед следующим шагом;
- среды с жёсткими политиками, где нужна явная проверка правил;
- последовательные решения, где ошибка на шаге ломает цепочку.
Минимальная схема из τ-Bench: имя think, параметр thought, в описании — что тул только логирует мысль. На сложных доменах сильнее всего срабатывает промпт с примерами: какие правила применимы, все ли поля собраны, какой план действий.
Источник: The "think" tool: Enabling Claude to stop and think in complex tool use situations.