Перейти к содержимому
Экосистема AI Vibe
← Назад к AI Vibe News

Редакция 20 марта 2025 г.

Обновлено 21 июля 2026

Новости

Think-тул для агентов: пауза между вызовами, когда правил много

Агент записывает промежуточные рассуждения в инструмент think между вызовами других тулов в длинной цепочке.

Anthropic описала паттерн think для длинных цепочек вызовов инструментов: фиктивный тул, куда модель пишет промежуточные рассуждения после каждого ответа тула — сверить политики, набросать план, не трогая базу и не запрашивая новых данных. Extended thinking запускается до генерации ответа; think вклинивается между шагами, когда решение зависит от только что полученного вывода.

С 15 декабря 2025 года в большинстве сценариев Anthropic советует extended thinking вместо отдельного think-тула — он лучше встроен в рантайм. Сам приём с фиктивным инструментом остаётся рабочим для агентов в Cursor, MCP-серверах и своих рантаймах.

Что показали тесты

На τ-Bench в авиадомене связка think и промпта с примерами дала pass^1 = 0,570 против 0,370 у baseline — относительный прирост 54%.

В retail одного think хватило для 0,812 при baseline 0,783. В SWE-bench аналогичный тул добавили к Claude 3.7 Sonnet: итог 0,623, изолированный вклад think — +1,6% в среднем.

Когда подключать

  • разбор вывода предыдущих тулов перед следующим шагом;
  • среды с жёсткими политиками, где нужна явная проверка правил;
  • последовательные решения, где ошибка на шаге ломает цепочку.

Минимальная схема из τ-Bench: имя think, параметр thought, в описании — что тул только логирует мысль. На сложных доменах сильнее всего срабатывает промпт с примерами: какие правила применимы, все ли поля собраны, какой план действий.

Источник: The "think" tool: Enabling Claude to stop and think in complex tool use situations.