Amazon Bedrock étend la prise en charge des API et introduit l’inférence interrégionale pour les modèles OpenAI

Publié le: 17 août 2026

Amazon Bedrock prend désormais en charge les modèles OpenAI GPT-5.6 (Sol, Terra et Luna) sur le point de terminaison bedrock-runtime, ainsi que les API Responses, Converse et Chat Completions. Il ajoute également la prise en charge de l’inférence interrégionale, permettant aux clients d’utiliser l’inférence interrégionale globale et géographique pour accéder à un débit plus élevé et à des coûts d’inférence réduits.  

L’inférence interrégionale achemine automatiquement les demandes d’inférence dans plusieurs Régions AWS pour vous offrir un débit plus élevé, sans que vous ayez à gérer la capacité dans plusieurs Régions. L’inférence géographique achemine les demandes au sein d’une zone géographique prédéfinie, y compris la nouvelle prise en charge de la géolocalisation américaine (US CRIS) avec ce lancement, afin que vous puissiez vous mettre à l’échelle tout en conservant les données traitées dans cette zone géographique, tandis que l’inférence interrégionale globale traite les demandes provenant de toutes les Régions AWS commerciales où le modèle est disponible, vous offrant ainsi l’accès le plus large à la capacité Bedrock et le débit le plus élevé en cas de pics de demande. L’inférence interrégionale globale vous permet également de réduire les coûts, car l’inférence globale coûte moins cher par jeton pour les modèles OpenAI que l’inférence régionale et géographique. Ce lancement étend également la prise en charge des API : vous pouvez également utiliser les modèles OpenAI GPT avec les API Responses, Chat Completions et Converse sur le point de terminaison bedrock-runtime. Comme ces API OpenAI natives s’exécutent désormais sur bedrock-runtime, les modèles fonctionnent avec les mêmes contrôles au niveau du compte que vous utilisez déjà pour les autres modèles sur Bedrock : l’utilisation apparaît dans la journalisation des invocations du modèle Bedrock (livrable vers Amazon S3 ou Amazon CloudWatch Logs) et dans les métriques Amazon CloudWatch couvrant le nombre d’invocations et de jetons, la latence, les limitations et les erreurs, et elle est détaillée dans l’Explorateur de coûts AWS et le rapport sur les coûts et l’utilisation AWS afin de permettre l’attribution des dépenses par modèle.

L’inférence interrégionale pour les modèles OpenAI est disponible dans toutes les Régions AWS où les modèles OpenAI sur Amazon Bedrock sont proposés. Pour commencer, consultez les cartes de modèles pour GPT 5.6 (Sol, Terra et Luna) dans le Guide de l’utilisateur d’Amazon Bedrock.