раздел 06
Шпаргалка
Всё главное коротко, чтобы держать под рукой.
Что
У агента две ручки: модель (масштаб ума и цена за токен) и уровень усилий (сколько думает и делает шагов).
Зачем
Чтобы простые задачи шли быстро и дёшево, сложные - без переделок, а лимит подписки доживал до вечера.
Как
Модель по цене ошибки, усилия по числу шагов. Сильная модель на low сначала, каскад - если измерили.
Линейка
| Модель | Вход / выход за 1M | Контекст | Для чего |
|---|---|---|---|
| Haiku 4.5 | 1 / 5 долларов | 200K | Рутина, классификация, субагенты-читатели |
| Sonnet 5 | 2 / 10 | 1M | Код, тексты, большинство ежедневных задач |
| Opus 5 | 5 / 25 | 1M | Сложное рассуждение, архитектура, длинные агентные задачи |
| Fable 5.1 | 10 / 50 | 1M | Самые трудные задачи, автономные прогоны; думает всегда |
Цены - ориентир на момент написания, проверяйте у провайдера.
Усилия: low, medium, high, xhigh, max. По умолчанию high, в Claude Code для кода - xhigh. Переключение через меню /model или настройки; в API - output_config.effort.
Семь правил выбора
- Модель выбирайте по цене ошибки: чем дороже переделка, тем сильнее модель.
- Усилия выбирайте по числу шагов: чем больше агент должен сделать сам, тем выше.
- Считайте цену за выполненную задачу, а не за запрос.
- Сначала самая сильная модель на low, потом точечно вверх, каскад - только с цифрами.
- Субагентам-читателям - Haiku и low. Решения - основному агенту.
- Если результат не устраивает - на одну ступень усилий вверх, модель менять потом.
- Перед сменой модели в длинном диалоге - резюме контекста.
Четыре промпта-заготовки
Простой шаг:
Этот шаг простой, делай на низких усилиях: [что сделать].
Не анализируй архитектуру. Если встретишь неочевидное - остановись и спроси.
План перед кодом:
Это архитектура, думай на максимуме. Задача: [описание].
Перед кодом покажи план: модули, интерфейсы, состояние, что при сбое.
Код не пиши, пока я не подтвержу.
Исследование через субагента:
Отправь субагента на дешёвой модели собрать всё, что связано с [тема]:
файлы, функции, последние изменения. Сам не решай, пока не получишь отчёт.
Дальше разбирайся с полной глубиной, ответ - одна гипотеза и как проверить.
Резюме перед переключением:
Резюмируй: что сделано, что осталось, какие решения приняты и почему,
что нельзя трогать. Коротко, по пунктам. Я перенесу это в новый диалог.
Глоссарий
- Модель - конкретная версия нейросети со своим уровнем способностей и ценой за токен. В семье Claude: Haiku, Sonnet, Opus, Fable.
- Уровень усилий (effort) - настройка глубины: сколько модель думает, сколько вызывает инструментов, насколько подробно отвечает. От low до max.
- Токен - единица текста, за которую берут деньги. Вход - что модель читает, выход - что пишет, включая размышления.
- Контекст - объём текста, который модель держит в одном запросе: промпт, файлы, история. Всё это входные токены каждый ход.
- Субагент - помощник, которого основной агент запускает на отдельную подзадачу. Может работать на своей модели и своих усилиях.
- Каскад - схема, где простые запросы идут на дешёвую модель, сложные - на дорогую. Оправдан на объёме и только после измерений.
Куда дальше
- Выбор модели под задачу - общая картина: GPT, Claude, Gemini, опенсорс, критерии сравнения.
- Токены 101 - за что именно платим и как экономить.
- Лимиты использования - окна подписки и что делать, когда упёрлись.
- Субагенты - как описывать помощников и назначать им модели.
- Контекстное окно - длинный контекст как расход.
- OpenRouter - модели разных вендоров одним ключом.
- Модели для кодинга - что брать под код, если смотреть шире одной семьи.