> ## Documentation Index
> Fetch the complete documentation index at: https://docs.utmkit.co/llms.txt
> Use this file to discover all available pages before exploring further.

# Límites de solicitudes

> Un límite de solicitudes por token con una indicación de reintento, y dos límites de abuso que responden con el mismo estado y un código distinto.

Dos tipos de límite aplican a la API y al servidor MCP. Es fácil confundirlos porque los dos
dicen "no" por un rato; no están relacionados.

## El límite de solicitudes, por token

Cada token puede hacer un número fijo de solicitudes por minuto — **120 hoy**, contadas en
una ventana que se reinicia cada minuto. Una solicitud que pasa ese límite responde
`429 rate_limited` con un encabezado `Retry-After` que nombra los segundos hasta que se
reinicia la ventana, y el mismo número en el cuerpo como `retry_after_seconds`:

```json theme={null}
{
  "error": {
    "code": "rate_limited",
    "message": "This token has made more than 120 requests in 60 seconds. Retry in 17 seconds.",
    "retry_after_seconds": 17
  }
}
```

El contador es por token, no por espacio de trabajo o por usuario: dos tokens en el mismo
espacio de trabajo tienen dos contadores. También es duradero, así que un rechazo sobrevive
a que la aplicación se reinicie; esperar es lo único que lo limpia.

El servidor MCP está detrás de la misma puerta, así que un asistente conversador se topa con
el mismo límite. Una solicitud rechazada no se "usa": no actualiza la hora de último uso del
token.

<Tip>
  Respeta `Retry-After` en vez de reintentar en un horario fijo. La mayoría de los clientes
  HTTP tratan el 429 como reintentable y esperarán el tiempo correcto si los dejas leer el
  encabezado.
</Tip>

## Dos 429 más

Por separado, dos límites de abuso responden `429 limit_reached` con una frase que nombra el
límite que se alcanzó. Son iguales en cada plan, y ninguno es algo que fije el plan:

* **300 enlaces nuevos por día, por espacio de trabajo.** Contados de la misma manera sin
  importar si el enlace vino de la consola, el asistente o la API. El rechazo no lleva
  encabezado `Retry-After`.
* **10,000 conversiones por hora, por token.** El rechazo lleva un encabezado `Retry-After`
  y `retry_after_seconds` en el cuerpo, como el límite de solicitudes.

El servidor MCP devuelve la frase del límite de enlaces como resultado de herramienta; no
hay herramienta de conversiones. Mismo estado que el límite de solicitudes, código distinto:
ramifícate sobre `code`, no sobre el estado.

## Lo que no es un límite aquí

El propio asistente de chat del producto, dentro de la consola, corre bajo límites propios
para que una conversación no se descontrole. Esos límites son del chat, no de la API ni del
servidor MCP: nada que construyas contra cualquiera de las dos puertas se ve afectado por
ellos, y nada aquí te deja cambiarlos.
