Amazon Bedrock amplía el soporte de API e introduce la inferencia interregional para los modelos de OpenAI
Amazon Bedrock ahora es compatible con los modelos OpenAI GPT-5.6 (Sol, Terra y Luna) en el punto de conexión bedrock-runtime, con compatibilidad con las API Responses, Converse y Chat Completions. También suma compatibilidad con la inferencia entre regiones, lo que permite a los clientes utilizar la inferencia global y geográfica entre regiones para acceder a un mayor rendimiento y reducir los costos de inferencia.
La inferencia entre regiones enruta automáticamente las solicitudes de inferencia entre varias regiones de AWS para ofrecerle un mayor rendimiento, sin necesidad de administrar la capacidad en varias regiones. Las rutas de inferencia geográficas entre regiones dirigen las solicitudes dentro de una geografía predefinida, incluida la nueva compatibilidad con US Geo (US CRIS) incorporada en este lanzamiento. De este modo, es posible escalar y, al mismo tiempo, mantener los datos procesados dentro de esa geografía. Por su parte, las rutas de inferencia globales entre regiones atienden las solicitudes desde cualquier región comercial de AWS en la que esté disponible el modelo. Esto proporciona un acceso más amplio a la capacidad de Amazon Bedrock y el mayor rendimiento posible durante los picos de demanda. Con la inferencia global entre regiones, también obtiene costos más bajos, ya que la inferencia global tiene un precio más bajo por token para los modelos OpenAI que la inferencia geográfica y regional. Este lanzamiento además amplía la compatibilidad de las API: también puede usar los modelos GPT de OpenAI con la API Responses, la API Chat Completions y la API Converse en el punto de conexión bedrock-runtime. Como estas API nativas de OpenAI ahora se ejecutan en bedrock-runtime, los modelos funcionan con los mismos controles a nivel de cuenta que ya utiliza para otros modelos en Bedrock: el uso aparece en el registro de invocaciones del modelo de Bedrock (que se puede entregar a Amazon S3 o los Registros de Amazon CloudWatch) y en las métricas de Amazon CloudWatch que cubren los recuentos de invocaciones, el recuento de tokens, la latencia, los límites y los errores, y se detalla en el Explorador de costos de AWS y el informe de costo y uso de AWS para que pueda atribuir el gasto por modelo.
La inferencia interregional para los modelos de OpenAI está disponible en todas las regiones de AWS en las que se ofrecen modelos de OpenAI en Amazon Bedrock. Para empezar, consulte las fichas del modelo para GPT 5.6 (Sol, Tera y Luna) en la Guía del usuario de Amazon Bedrock.