사용량 위키: 한도 초기화 시간과 토큰 절약

한도는 언제 초기화되고, 어떻게 하면 더 오래 쓸 수 있을까요? 주제별로 찾아보세요. Codex와 Claude를 따로 답하며, 공식 문서의 원문 인용과 링크를 함께 제공합니다.

Claude Code와 Codex에서 토큰을 절약하는 방법은?

토큰을 가장 많이 쓰는 것은 세 가지입니다. 몇 시간째 열어 둔 세션, 서브에이전트, 그리고 매 턴마다 함께 보내는 고정 내용(CLAUDE.md나 AGENTS.md, MCP 서버, 스킬 설명)입니다. 먼저 세 가지부터 하세요. 작업을 바꿀 때 대화를 비우고, 추론 강도를 medium으로 두고(Codex는 기본값, Claude Code는 /effort medium), 단순한 서브에이전트에는 작은 모델을 지정합니다. 5시간 한도와 주간 한도는 바로 이 토큰으로 측정됩니다.

Codex

작업마다 새 대화를 시작하고, 평소에는 medium 추론을 쓰고, 일상적인 작업은 작은 모델에 맡기고, 안 쓰는 MCP 서버는 끄세요.

Codex 사용량은 컨텍스트 크기, 모델, 추론 강도, 도구 호출에 따라 달라지므로, 토큰 절약은 이 네 가지를 조금씩 줄이는 일입니다. 작업을 바꿀 때는 /new(또는 /clear), 한 작업이 길어졌을 때는 /compact를 쓰세요. /status는 토큰 사용량과 남은 컨텍스트를 보여 줍니다. 모델과 추론 강도는 /model에서 고릅니다. 평소에는 medium, 어려운 문제에만 더 높게 설정하고, 일상적인 작업에는 GPT-5.6 Terra나 Luna를 쓰세요. OpenAI는 이렇게 하면 한도를 더 오래 쓸 수 있다고 설명합니다. Fast mode는 한도를 더 빨리 쓰므로 한도가 빠듯하면 /fast로 끄세요. AGENTS.md는 짧게 유지하고 안 쓰는 MCP 서버는 비활성화하세요. 둘 다 메시지마다 함께 전송됩니다.

공식 문서 원문

Different models can use different amounts of your allowance for the same task. Larger inputs and outputs, higher reasoning settings, Fast mode and tasks with multiple steps can also increase usage.
OpenAI Help Center · Managing usage with GPT-6 Astra in Work and Codex
Higher effort can use more of your allowance and does not always produce a better result.
OpenAI Help Center · Managing usage with GPT-6 Astra in Work and Codex
Limit the number of MCP servers you use. Every MCP server adds more context to your messages and uses more of your limit. Disable MCP servers when you don't need them.
OpenAI Developers · Codex pricing
Switch to a smaller model for routine tasks. Using GPT-5.6 Terra or GPT-5.6 Luna can extend your local-message usage limits, depending on the model you switch from.
OpenAI Developers · Codex pricing
Reduce the size of your AGENTS.md. If you work on a larger project, you can control how much context you inject through AGENTS.md files by nesting them within your repository.
OpenAI Developers · Codex pricing

Claude

먼저 /usage를 열어 무엇을 지목하는지 보세요. 긴 세션이면 /clear, 서브에이전트면 작은 모델, 고정 내용이면 줄이기입니다.

구독 사용자가 Claude Code에서 /usage를 입력하면 최근 사용량을 스킬, 서브에이전트, 플러그인, 개별 MCP 서버별로 나눠 보여 주고, 그중 10% 이상을 차지하는 항목을 따로 표시하며 항목마다 팁을 붙여 줍니다. d나 w를 누르면 24시간과 7일을 오갑니다. /usage 패널에 나오는 팁 두 가지를 원문 그대로 옮기면 이렇습니다. "Longer sessions are more expensive even when cached. /compact mid-task, /clear when switching to new tasks."(긴 세션은 캐시가 있어도 더 비쌉니다. 작업 도중에는 /compact, 새 작업으로 바꿀 때는 /clear를 쓰세요.) "Each subagent runs its own requests. Be deliberate about spawning them — and consider configuring a cheaper model for simpler subagents."(서브에이전트는 저마다 따로 요청을 실행합니다. 신중하게 띄우고, 단순한 서브에이전트에는 더 저렴한 모델을 지정해 보세요.) 그러니 작업 사이에는 /clear를 쓰고 /compact는 작업 도중에만 쓰세요. 평소에는 Sonnet과 /effort medium(기본값은 high)을 쓰고, 어려운 문제에만 더 큰 모델이나 더 높은 effort로 올리세요. 단순한 서브에이전트에는 model: haiku를 적으세요. /context로 고정 내용이 얼마나 차지하는지 보고, CLAUDE.md는 200줄 이내로 유지하세요. 패널 수치는 이 컴퓨터의 세션 기록으로 추정한 것이어서 다른 기기와 claude.ai는 포함되지 않습니다.

공식 문서 원문

On a Pro, Max, Team, or Enterprise plan, /usage also shows a breakdown of what counts against your plan limits: Attribution: recent usage attributed to skills, subagents, plugins, and individual MCP servers, each shown as a percentage of the total.
Claude Code docs · Manage costs effectively
Use /clear to start fresh when switching to unrelated work. Stale context wastes tokens on every subsequent message.
Claude Code docs · Manage costs effectively
Sonnet handles most coding tasks well and costs less than Opus. Reserve Opus for complex architectural decisions or multi-step reasoning.
Claude Code docs · Manage costs effectively

흔한 오해

  • 토큰 절약 스킬이나 도구를 설치하면 사용량이 절반 넘게 줄어든다

    그렇지 않습니다. 이런 도구들은 60~90% 절감을 내세웁니다. JetBrains가 청구 금액 기준으로 진행한 짝 비교 테스트에서 rtk는 낮은 추론 강도에서 작업당 7.6% 더 들었고 높은 강도에서는 차이가 없었으며, caveman은 65%를 내세웠지만 약 8.5%를 절약했습니다. 무엇이든 설치하기 전에 /usage와 /context로 토큰이 어디에 쓰이는지 확인하세요.

  • 토큰이 빨리 닳는다면 내가 뭔가 잘못 쓰고 있는 것이다

    항상 그렇지는 않습니다. 플랫폼 쪽 문제일 때도 있으며, 그럴 때는 무엇을 바꿔도 소용없습니다. Anthropic은 2026-04-23 장애 보고서에서 한도가 예상보다 빨리 줄어든다는 제보의 원인이 Claude Code의 캐시 버그였다고 밝히고, 모든 구독자의 사용량 한도를 리셋했습니다. 먼저 이 사이트의 리셋 기록에서 최근 공지가 있었는지 확인한 다음 내 사용 습관을 살펴보세요.

  • 프롬프트를 영어로 쓰면 토큰이 덜 든다

    공식 근거가 없습니다. 두 회사 모두 사용량에 영향을 주는 요인으로 컨텍스트 크기, 모델, 추론 강도, 도구 호출을 꼽으며, 프롬프트 언어는 어느 쪽 목록에도 없습니다. 큰 비중을 차지하는 것은 긴 세션과 서브에이전트이니 그것부터 줄이세요.

먼저 할 일

  • 작업을 바꿀 때 대화를 비우세요. Claude Code는 /clear, Codex는 /new입니다. 이전 대화가 남아 있으면 이후의 모든 메시지가 그 비용을 다시 냅니다.
  • 추론 강도는 medium으로 두세요. Codex는 이것이 기본값이고, Claude Code는 기본값이 high이므로 /effort medium을 입력합니다. 어려운 문제에만 올리세요. 높일수록 느리고 더 많이 쓰며, 결과가 항상 더 좋은 것도 아닙니다.
  • 단순한 서브에이전트에는 작은 모델을 지정하세요. Claude Code는 서브에이전트 파일 맨 위에 model: haiku를, Codex는 config.toml의 [agents] 아래에 default_subagent_model을 설정합니다.
  • /compact는 한 작업이 반쯤 진행됐는데 컨텍스트가 너무 커졌을 때만 쓰세요. 그 자체가 큰 요청 한 번이며, 평소에 하는 정리가 아닙니다.
  • Claude Code에서는 /context, Codex에서는 /status를 실행해 무엇이 컨텍스트를 채우고 있는지 보세요.
  • CLAUDE.md는 200줄 이내로, AGENTS.md도 그만큼 짧게 유지하세요. 특정 작업용 절차는 스킬로 옮기세요. 스킬은 쓸 때만 로드됩니다.
  • 안 쓰는 MCP 서버는 비활성화하고 안 쓰는 플러그인은 제거하세요. 매 턴마다 자리를 차지합니다.
  • 프롬프트는 파일과 함수를 짚어 구체적으로 쓰세요. 예: "auth.ts의 login 함수를 고쳐 줘". "이 코드를 개선해 줘"라고 하면 에이전트가 넓은 범위를 읽게 됩니다.
  • 그래도 부족한가요? 기다릴지 정하기 전에 다음 리셋까지 얼마나 남았는지 확인하세요.

Codex 리셋 발표 기록 · Claude 리셋 발표 기록