Token 知识库

额度什么时候重置、怎么省 token?按目录查阅各个主题,Codex 和 Claude 分开说明,附官方原文和链接。

Claude Code 和 Codex 怎么省 token?

最费 token 的就三样:开了很久的长会话、subagent、每轮都要带上的固定内容(CLAUDE.md / AGENTS.md、MCP、skill 描述)。先做三件事:换任务就 /clear,推理强度别开太高(Codex 用默认的 medium,Claude Code 设 /effort medium),给简单的 subagent 配小模型。token 就是额度的计量单位,5 小时额度和周额度扣的都是它。

Codex

换任务就 /new,日常用 medium 推理档,杂活交给小模型,不用的 MCP 关掉。

Codex 的用量跟着上下文大小、模型、推理强度和工具调用走,所以省 token 就是把这四样各砍一点。换任务时用 /new(或 /clear)开新对话,同一任务太长了用 /compact,/status 能看到当前 token 用量和上下文还剩多少。模型和推理强度在 /model 里切:日常用 medium,难题才调高;例行任务换 GPT-5.6 Terra 或 Luna,官方写明这样能让额度用得更久。Fast 模式扣得更快,额度紧时用 /fast 关掉。AGENTS.md 写短、不用的 MCP 停掉,这两样每条消息都要带。

官方原文

Different models can use different amounts of your allowance for the same task. Larger inputs and outputs, higher reasoning settings, Fast mode and tasks with multiple steps can also increase usage.
OpenAI Help Center · Managing usage with GPT-6 Astra in Work and Codex
Higher effort can use more of your allowance and does not always produce a better result.
OpenAI Help Center · Managing usage with GPT-6 Astra in Work and Codex
Limit the number of MCP servers you use. Every MCP server adds more context to your messages and uses more of your limit. Disable MCP servers when you don't need them.
OpenAI Developers · Codex pricing
Switch to a smaller model for routine tasks. Using GPT-5.6 Terra or GPT-5.6 Luna can extend your local-message usage limits, depending on the model you switch from.
OpenAI Developers · Codex pricing
Reduce the size of your AGENTS.md. If you work on a larger project, you can control how much context you inject through AGENTS.md files by nesting them within your repository.
OpenAI Developers · Codex pricing

Claude

先打开 /usage,看它点名的是哪一项,再对号入座:长会话就 /clear,subagent 就配小模型,固定内容就瘦身。

订阅用户在 Claude Code 里输入 /usage,面板会把最近的用量归到 skill、subagent、插件和各个 MCP 上,并把占近期用量 10% 以上的行为单独标出来,每条带一个建议;按 d / w 切换 24 小时和 7 天。/usage 面板上有两句原话。一句说长会话即使有缓存也更贵,任务做到一半用 /compact,换任务用 /clear:「Longer sessions are more expensive even when cached. /compact mid-task, /clear when switching to new tasks.」另一句说每个 subagent 各跑各的请求,别随手开,简单的 subagent 考虑配便宜的模型:「Each subagent runs its own requests. Be deliberate about spawning them — and consider configuring a cheaper model for simpler subagents.」对应的动作是:换任务 /clear、同一任务做到一半才 /compact;日常用 Sonnet,effort 默认是 high、想省就 /effort medium,难题才换更大的模型或调高;简单的 subagent 写 model: haiku;用 /context 看固定内容占了多少,CLAUDE.md 控制在 200 行内。面板的数字按本机会话历史估算,不含其他设备和 claude.ai。

官方原文

On a Pro, Max, Team, or Enterprise plan, /usage also shows a breakdown of what counts against your plan limits: Attribution: recent usage attributed to skills, subagents, plugins, and individual MCP servers, each shown as a percentage of the total.
Claude Code docs · Manage costs effectively
Use /clear to start fresh when switching to unrelated work. Stale context wastes tokens on every subsequent message.
Claude Code docs · Manage costs effectively
Sonnet handles most coding tasks well and costs less than Opus. Reserve Opus for complex architectural decisions or multi-step reasoning.
Claude Code docs · Manage costs effectively

常见误解

  • 装一个省 token 的 skill 或工具,就能省一大半

    不能。这类工具宣称省 60%–90%。JetBrains 按账单做的配对实测里,rtk 在低推理档每个任务反而多花 7.6%、高档持平,caveman 宣称省 65%、实测约 8.5%。先用 /usage 和 /context 看清 token 花在哪,再决定装不装。

  • token 掉得快,一定是我用法有问题

    不一定。平台自己出过问题,那种情况你怎么省都没用。Anthropic 在 2026-04-23 的故障说明里写明,Claude Code 的一个缓存 bug 导致了「额度掉得比预期快」的反馈,并因此给所有订阅用户重置了额度。先去本站的重置记录看看最近有没有公告,再回头查自己的用法。

  • 用英文写提示更省 token

    没有官方依据。两家列出的影响因素是上下文大小、模型、推理强度和工具调用,没有提示语言这一项。真正的大头是长会话和 subagent,先砍这两样。

先做这几件

  • 换任务就清空:Claude Code 用 /clear,Codex 用 /new。旧对话留着,后面每条消息都要为它再付一次。
  • 推理强度别开太高:Codex 用默认的 medium;Claude Code 默认是 high,想省就输入 /effort medium。只给难题调高,高一档更慢、更费,不保证更好。
  • 给简单的 subagent 配小模型:Claude Code 在 subagent 文件头部写 model: haiku,Codex 在 config.toml 的 [agents] 里设 default_subagent_model。
  • 同一任务做到一半上下文太大时才 /compact;它本身是一次大请求,别当成日常清理。
  • Claude Code 输入 /context、Codex 输入 /status,看上下文被什么占了。
  • CLAUDE.md 控制在 200 行内,AGENTS.md 同理写短;专项流程挪进 skill,用到才加载。
  • 不用的 MCP 停掉,不用的插件卸掉;它们每轮都占地方。
  • 提示写具体,点名文件和函数,比如「改 auth.ts 里的 login 函数」;「优化一下代码」会触发大范围读文件。
  • 都做了还是不够,先看离下次重置还有多久,再决定要不要等。

Codex 重置公告与记录 · Claude 重置公告与记录