Wiki de uso: cuándo se reinician los límites y cómo ahorrar tokens

Cuándo se reinician los límites y cómo hacer que duren más. Consulta por temas, con respuestas separadas para Codex y Claude, basadas en la documentación oficial, con citas y enlaces.

¿Cuántos tokens gastan los servidores MCP y cómo reducirlo?

Por defecto, Claude Code solo mete en el contexto los nombres de las herramientas MCP y las instrucciones del servidor, y carga la definición completa de una herramienta cuando se usa, así que unos cuantos servidores más cuestan poco. En Codex, cada servidor MCP añade contexto a cada mensaje. La solución es la misma en los dos: apaga lo que no uses.

Codex

Cada servidor MCP añade contexto a cada mensaje y gasta más de tu límite. OpenAI dice que uses menos y los apagues cuando no los necesites.

Escribe /mcp en la CLI para ver los servidores de esta sesión, o ejecuta codex mcp list para ver todo lo que tienes configurado. No hace falta borrar un servidor para dejar de pagarlo: en su entrada [mcp_servers.<nombre>] de ~/.codex/config.toml, escribe enabled = false, y vuelve a cambiarlo cuando lo necesites. Si solo usas una o dos herramientas de un servidor, enuméralas en enabled_tools; las demás no se entregan al modelo. OpenAI no documenta si Codex carga las definiciones de herramientas bajo demanda.

Qué dice la documentación oficial

Limit the number of MCP servers you use. Every MCP server adds more context to your messages and uses more of your limit. Disable MCP servers when you don't need them.
OpenAI Developers · Codex pricing
enabled (optional): Set false to disable a server without deleting it.
OpenAI docs · Model Context Protocol
enabled_tools (optional): Tool allow list.
OpenAI docs · Model Context Protocol

Claude

Muy poco por defecto: solo entran en el contexto los nombres de las herramientas y las instrucciones del servidor. Míralo con /context y apaga en /mcp los servidores que no uses.

Claude Code trae tool search activado por defecto: las definiciones completas de las herramientas se quedan fuera del contexto hasta que Claude usa una, y por eso Anthropic dice que más servidores tienen un impacto mínimo. El otro coste es lo que devuelven las herramientas. Claude Code avisa cuando una salida de MCP pasa de 10 000 tokens y la limita a 25 000 por defecto; lo que sea mayor se guarda en un archivo y en la conversación solo queda la ruta. Un servidor que apagas en /mcp queda apagado solo para el proyecto actual, y su configuración se conserva.

Qué dice la documentación oficial

MCP tool definitions are deferred by default, so only tool names and server instructions enter context until Claude uses a specific tool. Run /context to see what's consuming space.
Claude Code docs · Manage costs effectively
Only tool names and server instructions load at session start, so adding more MCP servers has minimal impact on your context window.
Claude Code docs · Connect Claude Code to tools via MCP
Output warning threshold: Claude Code displays a warning when any MCP tool output exceeds 10,000 tokens
Claude Code docs · Connect Claude Code to tools via MCP
Default limit: the default maximum is 25,000 tokens
Claude Code docs · Connect Claude Code to tools via MCP
Prefer CLI tools when available: Tools like gh, aws, gcloud, and sentry-cli are still more context-efficient than MCP servers because they don't add any per-tool listing.
Claude Code docs · Manage costs effectively
On a Pro, Max, Team, or Enterprise plan, /usage also shows a breakdown of what counts against your plan limits: Attribution: recent usage attributed to skills, subagents, plugins, and individual MCP servers, each shown as a percentage of the total.
Claude Code docs · Manage costs effectively
If you've logged into Claude Code with a claude.ai account, MCP servers you've added in claude.ai, known as connectors, are automatically available in Claude Code
Claude Code docs · Connect Claude Code to tools via MCP
You can also run /mcp to toggle any connector Claude Code fetches on or off for the current project only.
Claude Code docs · Connect Claude Code to tools via MCP

A través de un proxy de terceros, se cargan todas las definiciones de herramientas

El comportamiento por defecto tiene una excepción. Cuando ANTHROPIC_BASE_URL apunta a un host que no es de Anthropic, como un intermediario o una pasarela, Claude Code desactiva tool search, porque la mayoría de los proxies no reenvían los bloques de los que depende.

A partir de ahí, todas las definiciones de herramientas MCP entran en el contexto desde el principio, y el número de servidores que tengas instalados empieza a importar. Si usas un proxy, escribe primero /context para ver cuánto ocupa MCP y después apaga los servidores que este proyecto no necesite.

Qué dice la documentación oficial

Tool search is enabled by default: MCP tools are deferred and discovered on demand. Claude Code disables it when ANTHROPIC_BASE_URL points to a non-first-party host, since most proxies don't forward tool_reference blocks.
Claude Code docs · Connect Claude Code to tools via MCP

Errores frecuentes

  • Un servidor MCP que nunca llamas no cuesta nada

    No es cierto. En Codex, cada servidor activado añade contexto a cada mensaje, se use o no. Claude Code solo lleva por defecto los nombres de las herramientas, que es poco pero no cero; a través de un proxy de terceros, o con alwaysLoad activado, lleva todas las definiciones de herramientas. Apaga lo que no uses.

  • En Claude Code, más servidores MCP siempre son más tokens

    No por defecto. Claude Code aplaza las definiciones de herramientas, y Anthropic dice que añadir más servidores MCP tiene un impacto mínimo en tu contexto. Dos cosas sí cuestan: que tool search esté desactivado, algo habitual detrás de un proxy, y una herramienta que devuelve mucho contenido en una sola llamada.

  • Lo que gasta los tokens es la lista de herramientas

    No solo eso. La lista de herramientas es un coste fijo; lo que devuelven las herramientas suele ser el mayor. Cada resultado se queda en la conversación y se vuelve a enviar con cada mensaje posterior. Una salida de MCP puede llegar a 25 000 tokens por defecto, lo que pesa más que muchas definiciones de herramientas.

Consejos

  • Claude Code: escribe /context para ver cuánto contexto ocupan las herramientas MCP.
  • Claude Code: escribe /mcp y apaga los servidores que este proyecto no necesite. Vuelve a encenderlos cuando hagan falta.
  • Claude Code: escribe /usage para ver qué parte del uso reciente corresponde a cada servidor MCP. Empieza por los que pesan mucho y rara vez hacen falta.
  • Cuando exista una herramienta de línea de comandos (gh, aws, gcloud, sentry-cli), deja que el agente ejecute el comando en vez de añadir el servidor MCP equivalente.
  • Claude Code: no pongas alwaysLoad: true en un servidor salvo que sus herramientas hagan falta en cada turno. Con eso, todas las herramientas de ese servidor se cargan al inicio de la sesión.
  • Claude Code: si inicias sesión con una cuenta de claude.ai, los conectores que añadiste en claude.ai aparecen automáticamente en Claude Code. Apaga en /mcp los que este proyecto no use, o pon "disableClaudeAiConnectors": true en tus ajustes para apagarlos todos.
  • Codex: en ~/.codex/config.toml, escribe enabled = false en los servidores que no estés usando, y enabled_tools en los servidores de los que solo necesites unas pocas herramientas.
  • Pide menos: limita el rango y el número de filas al consultar, y no te traigas una tabla entera o una página entera.

Anuncios de reinicio de Codex · Anuncios de reinicio de Claude