раздел 01
Линейка: Haiku, Sonnet, Opus, Fable
Четыре модели одной семьи, от самой дешёвой к самой сильной. Именно эту линейку вы видите в меню Claude Code и в настройках агентов в IDE, поэтому разбираем её, а не рынок целиком.
| Модель | Вход / выход, долларов за 1M токенов | Контекст | Для чего |
|---|---|---|---|
| Claude Haiku 4.5 | 1 / 5 | 200K | Рутина, классификация, простые правки, субагенты-читатели |
| Claude Sonnet 5 | 2 / 10 | 1M | Код, тексты, большинство ежедневных задач |
| Claude Opus 5 | 5 / 25 | 1M | Сложное рассуждение, архитектура, длинные агентные задачи |
| Claude Fable 5.1 | 10 / 50 | 1M | Самые трудные задачи, долгие автономные прогоны |
За что именно берут деньги на входе и на выходе - в Токены 101. Коротко: вход - всё, что модель читает (ваш промпт, файлы, история диалога), выход - всё, что она пишет, включая внутренние размышления. Выход дороже в пять раз у каждой модели, и именно он растёт с уровнем усилий.
Haiku 4.5
Быстрая и дешёвая. Доллар за миллион входных токенов - это очень мало: целая кодовая база среднего проекта за несколько центов. Контекст 200K, меньше, чем у старших, но для точечной задачи хватает с запасом.
Куда ставить: переименовать файлы по шаблону, разложить сотню тикетов по категориям, поправить опечатки в текстах, извлечь даты и суммы из писем, сгенерировать двести карточек товаров по одному образцу. И главное - субагенты, которые читают. Когда основной агент отправляет помощника «найди, где в проекте обрабатывается оплата», этому помощнику не нужен Opus: он ищет и пересказывает.
Где сломается: там, где нужно удержать в голове несколько противоречащих требований и принять решение. Haiku пойдёт по первому правдоподобному пути.
Sonnet 5
Рабочая лошадка. Два доллара за вход, десять за выход, контекст миллион токенов. Большинство ежедневных задач разработчика и не-разработчика закрываются ею: написать функцию, поправить баг с понятным стектрейсом, составить письмо клиенту, разобрать транскрипт звонка в резюме, собрать HTML-страницу по описанию.
Хорошее свойство Sonnet - предсказуемость. Она редко удивляет, редко проваливается, и её результат обычно достаточно хорош, чтобы принять без переделки. Если сомневаетесь, какую модель поставить по умолчанию для чата в IDE, ставьте Sonnet.
Opus 5
Сложное рассуждение, архитектура, длинные агентные задачи. Пять и двадцать пять долларов, контекст миллион. Разница с Sonnet проявляется, когда задача требует держать много в голове: спроектировать модуль так, чтобы он не сломал соседние, найти баг, который проявляется только при сочетании трёх условий, сделать ревью чужого кода и увидеть не синтаксис, а замысел.
Opus ставят на планирование. Типичная связка: Opus пишет план, Sonnet исполняет по пунктам, Haiku читает и проверяет. Про такое разделение - в главе 05 и в мануале Субагенты.
Fable 5.1
Самая сильная модель. Десять и пятьдесят долларов, контекст миллион. Думает всегда: у неё нет режима без размышлений, есть только регулятор глубины, и это уровень усилий. Роль - самые трудные задачи и долгие автономные прогоны: когда агент работает ночь над большим рефакторингом, проходит по всей кодовой базе и должен сам замечать, что что-то пошло не так.
На Fable есть смысл переносить то, что Opus делает с ошибками, и то, где переделка стоит дорого: юридически важный документ, миграция данных, архитектура проекта с нуля. На переименование файлов она не нужна, но и не вредна, если стоит на low: про этот приём в главе 04.
Как выбирать между соседями
Про другие семьи
У GPT, Gemini и опенсорсных моделей своя лестница похожей формы: дешёвая-быстрая, средняя, флагман. Как сравнивать между семьями и по каким критериям - в общем мануале Выбор модели под задачу. Здесь мы остаёмся внутри одной линейки, потому что именно её переключают в агентах на лету. Про модели для кода отдельно - Модели для кодинга.