Как экономить токены в Claude Code и Codex?
Больше всего токенов уходит на три вещи: сессию, открытую часами, субагентов и постоянное содержимое, которое отправляется с каждым ходом (CLAUDE.md или AGENTS.md, MCP-серверы, описания skills). Начните с трёх шагов: очищайте чат при смене задачи, держите уровень рассуждений на medium (в Codex это значение по умолчанию; в Claude Code — /effort medium) и дайте простым субагентам модель поменьше. Именно в токенах измеряются 5-часовой и недельный лимиты.
Codex
Для каждой задачи начинайте новый чат, в обычной работе используйте medium, рутину отдавайте модели поменьше и отключайте MCP-серверы, которыми не пользуетесь.
Расход Codex зависит от размера контекста, модели, уровня рассуждений и вызовов инструментов, поэтому экономить токены — значит урезать каждое из четырёх. При смене задачи используйте /new (или /clear), а когда одна задача разрослась — /compact; /status показывает расход токенов и сколько контекста осталось. Модель и уровень рассуждений выбираются в /model: medium для повседневной работы, выше — только для трудных задач, а для рутины — GPT-5.6 Terra или Luna: по словам OpenAI, так лимитов хватает на дольше. Fast mode расходует лимит быстрее, поэтому отключайте его через /fast, когда лимит на исходе. Держите AGENTS.md коротким и отключайте неиспользуемые MCP-серверы: и то и другое отправляется с каждым сообщением.
Что сказано в официальной документации
Different models can use different amounts of your allowance for the same task. Larger inputs and outputs, higher reasoning settings, Fast mode and tasks with multiple steps can also increase usage.Higher effort can use more of your allowance and does not always produce a better result.Limit the number of MCP servers you use. Every MCP server adds more context to your messages and uses more of your limit. Disable MCP servers when you don't need them.Switch to a smaller model for routine tasks. Using GPT-5.6 Terra or GPT-5.6 Luna can extend your local-message usage limits, depending on the model you switch from.Reduce the size of your AGENTS.md. If you work on a larger project, you can control how much context you inject through AGENTS.md files by nesting them within your repository.Claude
Сначала откройте /usage и посмотрите, что он называет. Долгая сессия — /clear. Субагенты — модель поменьше. Постоянное содержимое — сократите.
По подписке /usage в Claude Code раскладывает недавний расход по skills, субагентам, плагинам и отдельным MCP-серверам и отмечает любое поведение, на которое приходится 10 % расхода или больше, — каждое с советом; клавиши d и w переключают между 24 часами и 7 днями. Два совета с панели /usage, дословно: «Longer sessions are more expensive even when cached. /compact mid-task, /clear when switching to new tasks.» (долгие сессии обходятся дороже даже с кэшем; /compact — посреди задачи, /clear — при переходе к новой) и «Each subagent runs its own requests. Be deliberate about spawning them — and consider configuring a cheaper model for simpler subagents.» (каждый субагент делает собственные запросы; запускайте их обдуманно и подумайте о более дешёвой модели для простых субагентов). Итак: /clear между задачами и /compact только посреди задачи; для повседневной работы — Sonnet и /effort medium (по умолчанию стоит high), а к модели побольше или effort повыше переходите только для трудных задач; в простых субагентах пишите model: haiku; запустите /context, чтобы увидеть, сколько занимает постоянное содержимое, и держите CLAUDE.md в пределах 200 строк. Панель оценивает расход по истории сессий на этом компьютере, так что другие устройства и claude.ai в неё не входят.
Что сказано в официальной документации
On a Pro, Max, Team, or Enterprise plan, /usage also shows a breakdown of what counts against your plan limits: Attribution: recent usage attributed to skills, subagents, plugins, and individual MCP servers, each shown as a percentage of the total.Use /clear to start fresh when switching to unrelated work. Stale context wastes tokens on every subsequent message.Sonnet handles most coding tasks well and costs less than Opus. Reserve Opus for complex architectural decisions or multi-step reasoning.Частые заблуждения
- Поставишь skill или инструмент для экономии токенов — и расход упадёт больше чем вдвое
Не упадёт. Такие инструменты обещают от 60 до 90 %. В парных тестах JetBrains, где сравнивали счёт, rtk на низком уровне рассуждений обходился на 7,6 % дороже за задачу, а на высоком разницы не было; caveman сэкономил около 8,5 % при обещанных 65 %. Прежде чем что-то ставить, посмотрите в /usage и /context, куда уходят ваши токены.
- Если токены уходят быстро, значит, я что-то делаю не так
Не всегда. Иногда виновата платформа, и что бы вы ни меняли, это не поможет. В разборе от 2026-04-23 Anthropic связала жалобы на то, что лимиты расходуются быстрее ожидаемого, с ошибкой кэширования в Claude Code и сбросила лимиты всем подписчикам. Проверьте в журнале сбросов на этом сайте, не было ли недавно объявления, а потом уже разбирайтесь со своими привычками.
- Промпты на английском тратят меньше токенов
Ни один официальный источник этого не говорит. Обе компании называют факторами расхода размер контекста, модель, уровень рассуждений и вызовы инструментов; языка промпта нет ни в одном из списков. Главные статьи расхода — долгие сессии и субагенты, начинайте с них.
Сделайте это в первую очередь
- Очищайте чат при смене задачи: /clear в Claude Code, /new в Codex. Если старый разговор остаётся, каждое следующее сообщение платит за него снова.
- Держите уровень рассуждений на medium. В Codex это значение по умолчанию; в Claude Code по умолчанию стоит high, поэтому введите /effort medium. Повышайте только для трудных задач: более высокий уровень медленнее, тратит больше и не всегда даёт лучший результат.
- Дайте простым субагентам модель поменьше: model: haiku в начале файла субагента в Claude Code, default_subagent_model в разделе [agents] файла config.toml в Codex.
- Используйте /compact, только когда одна задача сделана наполовину, а контекст слишком разросся. Это сам по себе большой запрос, а не плановая уборка.
- Запустите /context в Claude Code или /status в Codex, чтобы увидеть, чем заполнен контекст.
- Держите CLAUDE.md в пределах 200 строк, а AGENTS.md — таким же коротким. Процедуры под конкретные задачи переносите в skills: они загружаются только при использовании.
- Отключите MCP-серверы и удалите плагины, которыми не пользуетесь. Они занимают место на каждом ходу.
- Пишите конкретные промпты с названием файла и функции, например «исправь функцию login в auth.ts». «Улучши этот код» заставляет агента читать всё подряд.
- Всё равно не хватает? Посмотрите, сколько осталось до следующего сброса, и тогда решайте, ждать ли.