Как управлять
расходом токенов
Кодинг-агент считает каждый запрос в токенах, а токены - это либо ваши кредиты по подписке, либо деньги по API. Расход легко раздувается: длинный диалог, весь проект в контексте, огромные ответы. Здесь - не теория про то, что такое токен, а привычки на каждый день, чтобы агент не жёг токены зря и работал дешевле.

для кого этот курс
программа курса
Куда уходят токены
Почему у кодинг-агента расход растёт: токены тратятся и на вход (весь контекст - файлы, история, правила, инструменты), и на выход (ответ). Длинный диалог тащит всю историю снова. Коротко: подписка против API.
Что ест токены больше всего
Большой контекст (много файлов, весь проект), длинные сессии, огромные ответы, повторное перечитывание одного и того же, думающие (reasoning) режимы, субагенты. Где реально уходят токены.
Гигиена контекста
Новый чат под новую задачу, компактизация (сжатие истории), не тащить весь проект - только нужные файлы, короткие сфокусированные задачи. Простые привычки, которые срезают расход.
Модель и режимы под задачу
Дешёвая модель для простого, флагман для сложного. Режимы: сначала план и обсуждение, потом исполнение - меньше переделок. Кэш контекста (prompt caching) удешевляет повторную отправку одной и той же основы.
Рабочие привычки
Дробить задачи, давать точный контекст сразу (меньше итераций - меньше токенов), не гонять агента вслепую, ставить проверки и тесты, вовремя останавливать зацикливание. Как работать, чтобы не переделывать.
Где смотреть и как ограничить
Подписка - страница usage и лимиты. API - баланс, лимиты, шлюзы с бюджетами. Счётчик контекста и usage прямо в IDE. Как видеть расход и не выйти за рамки.
Шпаргалка
Таблица что ест токены - что делать, чек-лист экономии и короткий глоссарий: токен на вход и на выход, кэш контекста, компактизация, reasoning.