раздел 02

Уровень усилий

Уровень усилий (effort) - это настройка, которая говорит модели, сколько ресурсов тратить на задачу. Та же модель, те же знания, но разная глубина: сколько думать перед ответом, сколько раз дёрнуть инструменты, насколько подробно отвечать и стоит ли перепроверять себя.

Раньше эту роль играл переключатель «думать / не думать». Сейчас у сильных моделей размышление есть всегда, а усилия регулируют, насколько оно долгое. Fable, например, думает на любом уровне; low значит «подумай коротко».

Пять уровней

low
Быстро и коротко
Минимум размышлений, меньше вызовов инструментов, сжатые ответы. Субагенты, простые правки, вопросы с однозначным ответом.
medium
Обычный разговор
Средняя глубина. Подходит для чата, где вы сами ведёте агента по шагам и не ждёте от него самостоятельных решений.
high
По умолчанию
Стандарт для интеллектуально сложных задач: анализ, тексты с аргументацией, разбор проблем. Модель проверяет себя, но без фанатизма.
xhigh
Код и агенты
В Claude Code по умолчанию для кода и агентных задач. Больше чтения файлов, прогоны тестов, возвраты и исправления по ходу.
max
Правильность важнее цены
Модель тратит столько, сколько нужно. Для задач, где переделка стоит дороже, чем любое количество токенов.

Что меняется при повышении

Пять вещей растут вместе с уровнем, и они связаны между собой:

  • Глубина размышления: на low модель прикидывает, на max перебирает варианты и спорит сама с собой.
  • Число вызовов инструментов: на low агент прочитает один файл и решит, что достаточно; на xhigh пройдёт по всем связанным, запустит тесты, посмотрит логи.
  • Длина ответа: выше усилия - подробнее объяснения, больше вариантов, больше оговорок.
  • Время: от секунд до минут на том же вопросе.
  • Токены: всё перечисленное - это выходные токены, самые дорогие. Плюс лишние чтения файлов добавляют входные.

Отсюда простое следствие: усилия не бесплатны, даже если модель та же. Sonnet на max на простой задаче может стоить дороже, чем Opus на low, и работать дольше.

Где выставляется

В Claude Code модель и уровень усилий переключаются через меню команды /model или в настройках. Там же видно, что стоит сейчас. Для кода и агентных задач по умолчанию стоит xhigh, и это разумный дефолт, если вы не гонитесь за экономией.

В агентах других IDE уровень усилий живёт в настройках чата агента, рядом с выбором модели. Названия пунктов у каждого свои, но шкала та же: от быстрого к тщательному.

В API это параметр запроса, он называется output_config.effort и принимает те же значения. По умолчанию high. Пример тела запроса - в главе 05.

Уровень усилий у субагента можно задать отдельно от основного агента: помощник-читатель на low, основной на xhigh. Это самый частый способ сэкономить без потери качества, подробнее в Субагенты.

Когда какой

low - когда
Субагенты, которые ищут и пересказывают. Простые правки: переименовать, поправить формат, заменить строку. Вопросы, у которых один правильный ответ и он известен. Черновики, которые вы всё равно перепишете.
high - когда
Задачи с рассуждением, где важен ход мысли: разбор транскрипта, письмо с аргументами, ревью документа, ответ на нетривиальный вопрос. Дефолт для всего, что не код.
xhigh - когда
Кодинг и агентные задачи: реализовать фичу, найти баг, рефакторинг. Агент должен сам читать файлы, гонять тесты и возвращаться к ошибкам, для этого нужны усилия выше стандартных.
max - когда
Когда правильность важнее цены: архитектура с нуля, миграция данных, документ с юридическими последствиями, ночной прогон без присмотра. Вы готовы заплатить в разы, лишь бы не переделывать.

Про medium отдельно: это компромисс для интерактивной работы, когда вы сами ведёте агента и хотите ответы быстрее, чем на high, но подробнее, чем на low. В агентной работе он встречается редко.

Как заметить, что усилий мало

Агент срезает углы. Признаки:

  • Правит первый найденный файл, хотя таких мест в проекте пять.
  • Пишет «должно работать», не запуская тесты.
  • Отвечает уверенно на вопрос, который требует сначала посмотреть код.
  • Пропускает часть требований из промпта и не говорит об этом.
  • В длинной задаче теряет нить: сделал половину и отчитался как о целом.

Если узнали свою ситуацию, сначала поднимите усилия на одну ступень. Модель менять пока рано: часто той же Sonnet на xhigh достаточно.

Как заметить, что усилий много

Обратная картина:

  • Простой вопрос обдумывается минуту, ответ на три экрана с оговорками.
  • Агент перечитывает одни и те же файлы, запускает тесты после каждой строчки.
  • Счёт или лимит подписки уходят на задачи, которые вы бы сделали руками за минуту.
  • Ответы на «поправь опечатку» содержат анализ архитектуры.

Тут снижайте усилия и не бойтесь. Качество на простых задачах не упадёт, а скорость вырастет заметно.