Las traducciones son generadas a través de traducción automática. En caso de conflicto entre la traducción y la version original de inglés, prevalecerá la version en inglés.
API de respuestas en el punto final de Bedrock-Mantle
Amazon Bedrock proporciona la API de OpenAI respuestas tanto en los puntos finales como en bedrock-runtime los bedrock-mantle terminales. La API le permite utilizar herramientas y OpenAI SDK familiares con los modelos de Amazon Bedrock, de modo que puede migrar las aplicaciones existentes con un mínimo de cambios en el código: basta con actualizar la URL base y la clave de API. Para las aplicaciones nuevas, recomendamos el punto final. bedrock-runtime
Los dos terminales no admiten funciones idénticas. Las solicitudes bedrock-runtime son siempre sincrónicas, las herramientas del servidor no están disponibles y solo se admite el proyecto predeterminado. Para ver la comparación completa, consulteTerminales compatibles con Amazon Bedrock, y para ver los detalles de cada diferencia, consulte. Uso de la API Responses en el punto final de Bedrock-Runtime
importante
Cuando utilice el OpenAI SDK con Amazon Bedrock, debe dirigirlo al punto final de Amazon Bedrock, no al punto final. OpenAI Configure las siguientes variables de entorno y elija la URL base para el punto final que desee:
# bedrock-runtime (recommended) OPENAI_BASE_URL="https://bedrock-runtime.<your-region>.amazonaws.com/openai/v1" # bedrock-mantle OPENAI_BASE_URL="https://bedrock-mantle.<your-region>.api.aws/v1" OPENAI_API_KEY="<your Bedrock API key>"
No utilices tu clave de OpenAI API ni la URL OpenAI base (https://api.openai.com/v1). Estas se conectan OpenAI directamente, no a Amazon Bedrock. Para crear una clave de API de Amazon Bedrock, consulte. Claves de API
También ofrece otras ventajas como las siguientes:
-
Inferencia asincrónica: admite cargas de trabajo de inferencia de larga duración a través de la API de respuestas. Disponible
bedrock-mantlesolo en. -
Gestión continua de las conversaciones: reconstruye automáticamente el contexto sin pasar manualmente el historial de conversaciones con cada solicitud
-
Uso simplificado de las herramientas: integración optimizada para los flujos de trabajo de las agencias
-
Modos de respuesta flexibles: admite respuestas en streaming y sin streaming
-
Migración sencilla: compatible con las bases de código de OpenAI SDK existentes
Cada punto final se rige por su propio conjunto de cuotas. En el caso del tráfico de Responsesbedrock-runtime, se aplican las cuotas de fichas por minuto y de fichas por día del modelo, que se comparten con las demás API de inferencia de ese terminal (consulte). Cuotas para el punto final de ejecución básico Para bedrock-mantle, consulte Cuotas para el punto final entre el lecho rocoso y el manto.
Regiones y puntos finales compatibles
En el bedrock-runtime punto final, la API de respuestas está disponible en todos los Región de AWS lugares donde esté disponible ese punto final, incluidas las regiones AWS GovCloud (EE. UU.). Para ver la lista, consulte Disponibilidad regional por puntos finales. En la lista se enumeran los modelos compatibles con la API en cada punto finalDisponibilidad de terminales por modelos.
El bedrock-mantle punto final está disponible en las siguientes AWS regiones:
| Nombre de la región | Región | Punto de conexión |
|---|---|---|
| Este de EE. UU. (Ohio) | us-east-2 | bedrock-mantle.us-east-2.api.aws |
| Este de EE. UU. (Norte de Virginia) | us-east-1 | bedrock-mantle.us-east-1.api.aws |
| Oeste de EE. UU. (Oregón) | us-west-2 | bedrock-mantle.us-west-2.api.aws |
| Asia-Pacífico (Yakarta) | ap-southeast-3 | bedrock-mantle.ap-southeast-3.api.aws |
| Asia-Pacífico (Bombay) | ap-south-1 | bedrock-mantle.ap-south-1.api.aws |
| Asia-Pacífico (Sídney) | ap-southeast-2 | bedrock-mantle.ap-southeast-2.api.aws |
| Asia-Pacífico (Tokio) | ap-northeast-1 | bedrock-mantle.ap-northeast-1.api.aws |
| Europa (Fráncfort) | eu-central-1 | bedrock-mantle.eu-central-1.api.aws |
| Europa (Irlanda) | eu-west-1 | bedrock-mantle.eu-west-1.api.aws |
| Europa (Londres) | eu-west-2 | bedrock-mantle.eu-west-2.api.aws |
| Europa (Milán) | eu-south-1 | bedrock-mantle.eu-south-1.api.aws |
| Europa (Estocolmo) | eu-north-1 | bedrock-mantle.eu-north-1.api.aws |
| América del Sur (São Paulo) | sa-east-1 | bedrock-mantle.sa-east-1.api.aws |
| AWS () GovCloud US-West | us-gov-west-1 | bedrock-mantle.us-gov-west-1.api.aws |
Requisitos previos
Antes de usar las API, asegúrese de tener lo siguiente: OpenAI
-
Autenticación: puede autenticarse mediante:
-
Clave de API de Amazon Bedrock (requerida para OpenAI el SDK)
-
AWS credenciales (compatibles con las solicitudes HTTP)
-
-
OpenAISDK (opcional): instale el SDK de OpenAI Python si utiliza SDK-based solicitudes.
-
Variables de entorno: defina las siguientes variables de entorno:
-
OPENAI_API_KEY— Configure su clave de API de Amazon Bedrock -
OPENAI_BASE_URL— Establezca el punto final de Amazon Bedrock para su región (por ejemplo,https://bedrock-runtime.us-east-1.amazonaws.com/openai/v1o)https://bedrock-mantle.us-east-1.api.aws/v1
-
-
Permisos: las acciones que necesita dependen del punto final. Sí
bedrock-mantle, la inferencia autorizabedrock-mantle:CreateInference. Si está activadabedrock-runtime, autorizabedrock:InvokeModeltanto el objetivo de la inferencia como el proyecto predeterminado de tu cuenta, y la administración de las respuestas almacenadas autorizabedrock:GetInvokey en ese proyecto.bedrock:CancelInvokebedrock:DeleteInvokePara ver ejemplos de políticas, consulte Requisitos previos para ejecutar la inferencia de modelos.
API de modelos
La API de modelos le permite descubrir los modelos disponibles en Amazon Bedrock con tecnología de Mantle. Utilice esta API para obtener una lista de modelos que puede usar con la API de respuestas. Para obtener información completa sobre la API, consulta la documentación de OpenAI modelos
Enumere los modelos disponibles
Para ver una lista de los modelos disponibles, elige la pestaña correspondiente al método que prefieras y, a continuación, sigue los pasos:
API de respuestas
La API de respuestas proporciona una gestión de conversaciones basada en el estado y admite la transmisión, el procesamiento en segundo plano y las interacciones en varios turnos. Para obtener información completa sobre la API, consulta la documentación de OpenAI Responses.
nota
No todos los modelos son compatibles con la API de respuestas. Para ver qué modelos son compatibles con la API de respuestas, consulteCompatibilidad de API por modelos.
Cómo almacena la API de respuestas el estado de las conversaciones
La API de respuestas puede usar el estado almacenado para habilitar las conversaciones en varios turnos y permitirte hacer referencia a los turnos anteriores mediante el previous_response_id parámetro. El almacenamiento está habilitado de forma predeterminada, pero se puede deshabilitar por solicitud mediante el store parámetro. El alcance de las respuestas almacenadas depende del proyecto. La respuesta de un proyecto no puede usarse como la respuesta anterior ni leerse en un segundo proyecto. Para obtener más información sobre los proyectos, consulteProyectos (OpenAI-compatible).
-
Cuando
storeestrue(valor predeterminado), Amazon Bedrock conserva la respuesta, incluidos los datos de entrada y salida, durante 30 días. Durante este período, puede encadenar las solicitudes de seguimiento pasándolasprevious_response_idy recuperar la respuesta con «GET /v1/responses/{id}activadobedrock-mantle» o «GET /openai/v1/responses/{id}activadobedrock-runtime». Transcurridos 30 días, la respuesta se elimina automáticamente y ya no se puede recuperar. -
En
storeese casofalse, Amazon Bedrock no conserva ningún dato de la solicitud o la respuesta. Elprevious_response_idparámetro no se puede usar para continuar la conversación.
El valor predeterminado coincide con true la especificación de la API de OpenAI respuestas. Los clientes que no deseen que Amazon Bedrock conserve los datos de las conversaciones deben store configurarlo de forma explícita false en cada solicitud o configurar el modo de retención de datos de la cuenta ennone, que rechaza store=true rotundamente una opción explícita. Para obtener más información, consulte Retención de datos.
Los datos almacenados se cifran en reposo y se asignan al recurso de proyecto de la AWS cuenta llamante. Los datos se almacenan únicamente para atender sus solicitudes y no se utilizan ni se conservan para ningún otro propósito. Síbedrock-mantle, se guardan en el lugar Región de AWS al que se envió la solicitud. En caso bedrock-runtime afirmativo, una solicitud que utilice la inferencia interregional se puede procesar en otra y la respuesta se almacena en la región que la procesó Región de AWS, de modo que una solicitud que utilice un perfil de inferencia global puede almacenar datos en cualquier región comercial a la que se dirija el perfil. Si tienes requisitos de residencia de datos, usa un perfil de inferencia geográfica en lugar de uno global.
Solicitud básica
Para crear una respuesta, elige la pestaña de tu método preferido y, a continuación, sigue los pasos:
Transmite las respuestas
Para recibir eventos de respuesta de forma incremental, elige la pestaña correspondiente al método que prefieras y, a continuación, sigue estos pasos:
Uso de la API Responses en el punto final de Bedrock-Runtime
La API Responses de on bedrock-runtime usa el mismo formato de solicitud y respuesta que en la versión anteriorbedrock-mantle, por lo que el OpenAI SDK funciona con cualquiera de los dos. Lo que cambia es la URL base, los ID del modelo, los permisos y una pequeña cantidad de comportamientos que se describen en esta sección.
URL y rutas base
Configura tu URL base enhttps://bedrock-runtime.. La API se ofrece en las siguientes rutas:region.amazonaws.com/openai/v1
POST /openai/v1/responses— crear una respuesta.GET /openai/v1/responses/{id}— recuperar una respuesta almacenada.POST /openai/v1/responses/{id}/cancel— cancelar una respuesta que aún está en curso.DELETE /openai/v1/responses/{id}— eliminar una respuesta almacenada.
ID de modelo
Nombre un perfil de inferencia interregional como modelo, no como identificador de modelo básico. Los modelos OpenAI GPT utilizan los global. perfiles us. y en las regiones comerciales y los us-gov. perfiles en las regiones AWS GovCloud (EE. UU.), por ejemplo,. us.openai.gpt-5.6-sol In-Region la inferencia no está disponible para estos modelos en este punto final. Para ver el identificador de perfil de cada modelo, consulte su tarjeta de modelo en yModelos de un vistazo, para saber cómo funciona el enrutamiento, consulteDirige las solicitudes de inferencia de modelos Regiones de AWS con inferencia interregional.
Permisos
Al crear una respuesta, se autorizan dos recursos: bedrock:InvokeModel (obedrock:InvokeModelWithResponseStream) en el objetivo de la inferencia, como ocurre con cualquier solicitud de inferencia, y bedrock:InvokeModel en el proyecto predeterminado de tu cuenta. La recuperación, la cancelación y la eliminación de una respuesta almacenada autorizan, y bedrock:DeleteInvoke respectivamente bedrock:GetInvokebedrock:CancelInvoke, a cada uno de ellos en el proyecto. Los ID de respuesta individuales no son recursos de IAM.
Dos claves de condición permiten que una política de un recurso restrinja al otro. La autorización de destino de inferencia incluyebedrock:ProjectArn, y la autorización de proyecto, los valores según el perfil de inferencia o el modelo base que haya nombrado su solicitudbedrock:ModelArn, nunca según los modelos de destino a los que se dirige un perfil interregional. Para ver ejemplos de políticas, consulte Requisitos previos para ejecutar la inferencia de modelos.
Diferencias de comportamiento
-
Las solicitudes son siempre sincrónicas.
background=truese rechaza con un error 400. Elstoreparámetro no se ve afectado y mantiene su valor predeterminadotrue, por lo que las conversaciones almacenadas en varios turnos funcionan con normalidad. -
modeles obligatorio en todas las solicitudes, incluida una que suministre.previous_response_idEsto difiere de la especificación de la API de OpenAI respuestas y debedrock-mantleaquella en la que el modelo se puede omitir y heredar de la respuesta anterior. El modelo forma parte de lo que está autorizada la solicitud, por lo que debe figurar su nombre en la propia solicitud. -
Server-side el uso de herramientas y las herramientas preconfiguradas no están disponibles, incluida la búsqueda en la web. Client-side el uso de la herramienta funciona en ambos puntos finales.
-
Solo se admite el proyecto predeterminado. El
OpenAI-Projectencabezado solo se acepta como su ARN de proyecto predeterminadodefaulto como este; cualquier otro valor se rechaza. Consulte Proyectos (OpenAI-compatible). -
No se admiten los perfiles de inferencia de aplicaciones. Una solicitud que nombra a uno como objetivo de inferencia se rechaza con un error 400. Los perfiles de inferencia globales, geográficos y del sistema funcionan con normalidad.
-
Las barreras no se aplican a la API de respuestas. Para aplicar una barandilla a un modelo GPT en este punto final, llama a la API de Converse en su lugar.
-
Una respuesta almacenada pertenece a la persona que la Región de AWS envió. Esa región se encarga de recuperarlo, cancelarlo o eliminarlo y continuar la conversación con
previous_response_idél. Un identificador de respuesta que no se encuentra (porque nunca existió, pertenece a otra cuenta o nunca se almacenó) devuelve el mismo error 404 en todos los casos.
Supervisión y coste
Como todas las solicitudes son sincrónicas, CloudWatch las métricas y el registro de invocaciones de modelos funcionan para la API de respuestas del mismo modo que para las demás API de inferencia de este punto final, incluidas las solicitudes de streaming. El uso se atribuye al objetivo de la inferencia, exactamente igual que en el caso de Converse InvokeModel : el proyecto predeterminado nunca es el ancla de facturación. Consulte Realice un seguimiento del uso y los costos en Amazon Bedrock.