Effort: глубина рассуждений агента
Рядом с меню режимов часто стоит отдельная настройка - Effort (усилие), обычно с вариантами вроде Low, Medium, High. Её легко перепутать с режимами разрешений, но это про другое. Режим отвечает на вопрос «что агенту можно делать без спроса». Effort - на вопрос «насколько глубоко модель думает, прежде чем ответить».
Современные модели умеют «размышлять» перед ответом: прежде чем писать код, они внутри себя прокручивают шаги, проверяют варианты, ищут ошибки в собственном плане. Effort задаёт, сколько на это тратить. High - модель думает дольше и тщательнее. Low - отвечает быстрее и короче в рассуждениях.
Effort - это не «умнее или глупее». Это «дольше и тщательнее» против «быстрее и дешевле». Глубокое размышление помогает на сложном и мешает на простом.
Чем отличаются уровни
High (высокий)
Модель тратит больше шагов на обдумывание: разбивает задачу, проверяет себя, перебирает варианты. Ответы качественнее на сложных задачах, но получаются медленнее и дороже - размышление тоже расходует токены.
Low / Medium (низкий и средний)
Модель думает меньше и отвечает быстрее. На простых и понятных задачах результат такой же, а скорость и расход - заметно лучше. На сложной логике может выйти поверхностно.
За что вы платите скоростью и токенами
Размышление модели - это тоже текст, который она генерирует, просто вы его обычно не видите. Значит, High тратит больше токенов и времени на каждый ответ. На большом проекте с сотнями обращений к агенту разница в расходе набегает ощутимая. Поэтому Effort - это ещё и рычаг управления бюджетом, а не только качеством. Подробнее про то, из чего складывается расход и как его держать в узде, - в мануале как управлять расходом токенов.
Когда какой уровень выбирать
1High - для сложного и ответственного
Проектирование архитектуры, разбор запутанного бага, многошаговая задача, где легко ошибиться, работа с незнакомым куском кода. Здесь лишние минуты размышления окупаются.
2Medium - как разумная середина
Обычная разработка: добавить функцию, поправить логику, написать тест. Хватает глубины и не переплачиваете за размышление там, где оно не нужно.
3Low - для простого и массового
Переименовать, поправить текст, мелкая однотипная правка, форматирование. Модели незачем долго думать - быстрее и дешевле.
Хорошо и плохо
Хорошо
Поднять до High, когда агент буксует на сложной задаче или выдаёт поверхностные решения. Опустить до Low на потоке мелких правок, чтобы не жечь токены и время впустую.
Плохо
Держать High всегда «на всякий случай» - вы переплачиваете и ждёте дольше на каждой мелочи. Держать Low на сложной отладке - агент будет ошибаться и гонять вас по кругу.
Частые вопросы
Effort и выбор модели - это одно и то же?
Нет. Модель - это какой «мозг» работает (быстрый или мощный). Effort - сколько этот мозг думает над конкретным ответом. Их настраивают отдельно, и часто мощная модель на Low обгоняет слабую на High.
High всегда даёт лучший результат?
Только там, где задача действительно сложная. На простой правке High и Low дадут одинаковый код, но High сделает это дольше и дороже. Глубина помогает, когда есть над чем думать.