Amazon Bedrock amplia il supporto API e introduce l'inferenza interregionale per i modelli OpenAI

Inserito il: 17 ago 2026

Amazon Bedrock ora supporta i modelli OpenAI GPT-5.6 (Sol, Terra e Luna) sull'endpoint bedrock-runtime, con supporto per le API Responses, Converse e Chat Completions. Viene inoltre aggiunto il supporto per l'inferenza interregionale, consentendo ai clienti di utilizzare l'inferenza interregionale globale e geografica per ottenere un throughput più elevato e ridurre i costi di inferenza.  

L'inferenza interregionale instrada automaticamente le richieste di inferenza su più regioni AWS per offrire un throughput più elevato, senza richiedere la gestione della capacità su più regioni. L'inferenza interregionale geografica indirizza le richieste all'interno di un'area geografica predefinita (incluso il nuovo supporto US Geo, ossia US CRIS, introdotto con questo lancio), consentendo di scalare mantenendo l'elaborazione dei dati all'interno di tale area; l'inferenza multiregionale globale soddisfa invece le richieste provenienti da qualsiasi regione AWS commerciale in cui il modello è disponibile, garantendo l'accesso più ampio alla capacità di Bedrock e il massimo throughput durante i picchi di domanda. Con l'inferenza multiregionale globale si ottengono anche costi inferiori, poiché l'inferenza globale presenta una tariffa per token più bassa per i modelli OpenAI rispetto all'inferenza regionale e geografica. Questo lancio amplia ulteriormente il supporto API: è ora possibile utilizzare i modelli GPT di OpenAI con le API Responses, Chat Completions e Converse sull'endpoint bedrock-runtime. Poiché queste API native di OpenAI vengono ora eseguite su bedrock-runtime, i modelli funzionano con gli stessi controlli a livello di account già in uso per gli altri modelli su Bedrock: l'utilizzo viene riportato nella registrazione delle invocazioni dei modelli di Bedrock (inviabile ad Amazon S3 o ad Amazon CloudWatch Logs) e nelle metriche di Amazon CloudWatch relative a numero di invocazioni, conteggio dei token, latenza, throttling ed errori; viene inoltre dettagliato in AWS Cost Explorer e in AWS Cost and Usage Report per consentire l'attribuzione della spesa per singolo modello.

L'inferenza interregionale per i modelli OpenAI è disponibile in tutte le regioni AWS in cui sono offerti i modelli OpenAI su Amazon Bedrock. Per iniziare, consulta le schede dei modelli per GPT 5.6 (Sol, Terra e Luna) nella Guida per l'utente di Amazon Bedrock.