Las traducciones son generadas a través de traducción automática. En caso de conflicto entre la traducción y la version original de inglés, prevalecerá la version en inglés.
Límites de tarifas y cuotas
La plataforma Claude en AWS asigna límites de velocidad de nivel 1 al suscribirse. Anthropic gestiona los límites de tarifas directamente, no a través de los sistemas de cuotas de AWS.
Límites predeterminados
La plataforma Claude en AWS utiliza el programa de niveles estándar de Anthropic, idéntico a la API Claude de origen. Se aplican límites de nivel 1 por espacio de trabajo. Los límites se agrupan por familia de modelos. Por ejemplo, todos los modelos Opus comparten un límite combinado, todos los modelos Sonnet comparten otro y todos los modelos Haiku comparten un tercero.
Para conocer los valores de nivel 1 actuales (RPM, ITPM, OTPM) y los umbrales de niveles superiores, consulte los límites de velocidad
Cabeceras con límite de velocidad
Todas las respuestas incluyen encabezados que indican el estado actual de tu límite de velocidad. Encabezados clave:
-
anthropic-ratelimit-requests-limit— Número máximo de solicitudes por minuto -
anthropic-ratelimit-requests-remaining— Solicitudes que permanecen en la ventana actual -
anthropic-ratelimit-requests-reset— Hora en la que se restablece el límite de solicitudes (RFC 3339) -
anthropic-ratelimit-tokens-limit— Número máximo de fichas combinadas (entrada+salida) por minuto -
anthropic-ratelimit-tokens-remaining— Las fichas combinadas que quedan en la ventana actual -
anthropic-ratelimit-tokens-reset— Hora en la que se restablece el límite de fichas combinadas (RFC 3339) -
anthropic-ratelimit-input-tokens-limit//— encabezados-remaining-resetInput-token-specific -
anthropic-ratelimit-output-tokens-limit/-remaining/-reset— encabezados Output-token-specific -
retry-after— En una respuesta de 429, el número de segundos que hay que esperar antes de volver a intentarlo
Consulte los encabezados de respuesta
¿Solicita límites más altos
A diferencia de la API Claude propia, el avance automático de nivel no se aplica a la plataforma Claude en AWS. Para solicitar límites más altos, póngase en contacto con el representante de su cuenta de Anthropic e indique su ID de espacio de trabajo y el rendimiento deseado. Para ver los umbrales de nivel y otros detalles, consulta los límites de velocidad
Errores en el límite de velocidad
Cuando superas un límite de velocidad, la API devuelve HTTP 429 con un rate_limit_error tipo. Implementa un retroceso exponencial con fluctuación en tu lógica de reintento. El retry-after encabezado indica cuántos segundos hay que esperar antes de volver a intentarlo.