O Amazon Bedrock expande o suporte à API e introduz a inferência entre regiões para modelos OpenAI
Agora, o Amazon Bedrock oferece suporte aos modelos OpenAI GPT-5.6 (Sol, Terra e Luna) no endpoint Bedrock-Runtime, com suporte para as APIs Responses, Converse e Chat Completions. Ele também adiciona suporte à inferência entre regiões, permitindo que os clientes usem a inferência global e geográfica entre regiões para acessar maior throughput e menores custos de inferência.
A inferência entre regiões encaminha automaticamente as solicitações de inferência em várias regiões da AWS para oferecer maior throughput, sem que você precise gerenciar a capacidade em várias regiões. A inferência geográfica entre regiões encaminha solicitações dentro de uma geografia predefinida, incluindo o novo suporte geográfico dos EUA (US CRIS) neste lançamento, para que você possa escalar e manter os dados processados dentro dessa geografia, enquanto a inferência global entre regiões atende solicitações de qualquer região comercial da AWS em que o modelo esteja disponível, oferecendo o acesso mais amplo à capacidade da Bedrock e a maior throughput durante picos de demanda. Com a inferência global entre regiões, você também obtém custos mais baixos, pois a inferência global tem um preço mais baixo por token para modelos OpenAI do que a inferência regional e geográfica. Esse lançamento também expande o suporte à API — você também pode usar modelos OpenAI GPT com a API Responses, a API Chat Complements e a API Converse no endpoint de runtime fundamental. Como essas APIs nativas do OpenAI agora são executadas em runtime básico, os modelos funcionam com os mesmos controles em nível de conta que você já usa para outros modelos no Bedrock: o uso aparece no registro de invocação do modelo Bedrock (disponível para Amazon S3 ou Amazon CloudWatch Logs) e nas métricas do Amazon CloudWatch que abrangem contagens de invocações, contagens de tokens, latência, restrições e erros, e está detalhado no Explorador de Custos da AWS e o relatório de custo e uso da AWS para que você possa atribuir gastos por modelo.
A inferência entre regiões para modelos OpenAI está disponível em todas as regiões da AWS onde os modelos OpenAI no Amazon Bedrock são oferecidos. Para começar, consulte os modelos de placas para GPT 5.6 (Sol, Tera e Luna) no Guia do usuário do Amazon Bedrock.