Notizia
GPT‑5.6 Sol, Terra e Luna ora su Amazon Bedrock
I tre modelli di OpenAI si chiamano tramite l'API Responses sul endpoint bedrock-mantle, con prezzi pari alle tariffe OpenAI e integrazione negli impegni AWS.
GPT‑5.6 Sol, Terra e Luna ora su Amazon Bedrock
OpenAI porta i modelli GPT‑5.6 Sol, Terra e Luna su Amazon Bedrock in disponibilità generale. Si chiamano via OpenAI Responses API sull’endpoint bedrock‑mantle. Le aziende li usano dentro i controlli di sicurezza, area geografica e costi offerti da AWS [S1].
Il valore pratico è immediato. Gli sviluppatori accedono a modelli di frontiera con le stesse API già adottate. Niente infrastrutture parallele, niente nuovi SDK da integrare. Bedrock estende le proprietà della piattaforma AWS all’inferenza dei GPT‑5.6: sicurezza gestita nel perimetro AWS, elaborazione per Region, controlli di spesa [S1].
I tre modelli coprono carichi distinti. Sol è il riferimento per il ragionamento. Terra bilancia prestazioni e costi in produzione. Luna privilegia inferenze rapide a basso costo. La gamma va da agenti per il coding e ragionamento su orizzonti lunghi a inferenza ad alto volume con vincoli di latenza [S1].
L’accesso resta uniforme. Si invia una richiesta alla Responses API e si seleziona il modello desiderato. L’endpoint è unico (bedrock‑mantle). Cambia solo il modello, che guida il comportamento dell’inferenza [S1].
Il post allinea prezzi e impegni. Le tariffe corrispondono ai listini first‑party di OpenAI. L’uso su Bedrock si somma agli impegni AWS esistenti. I consumi dei modelli rientrano negli stessi conteggi di spesa sul cloud [S1].
Un esempio operativo chiarisce il percorso minimo. Un team che gestisce un agente di coding seleziona Sol per sessioni di ragionamento estese. Effettua la prima chiamata alla Responses API sull’endpoint bedrock‑mantle. Abilita il prompt caching per riutilizzare parti costanti del contesto e ridurre i costi nelle richieste ripetute [S1].
Chi lavora su pipeline ad alto volume può scegliere Luna per ridurre latenza e prezzo per chiamata. Per carichi misti in produzione, Terra offre un equilibrio tra qualità e costo. La scelta del modello dipende dal profilo del carico, non dall’integrazione: le chiamate restano identiche [S1].
Per chi già usa strumenti compatibili con le API di OpenAI, il passaggio è lineare. Si mantiene la familiarità delle chiamate e un unico punto di accesso ai modelli. La combinazione tra API note e proprietà della piattaforma AWS riduce attriti nell’adozione e nella gestione operativa [S1].
Il post è co‑firmato da AWS e OpenAI e include istruzioni passo‑passo per iniziare: impostazione delle chiamate, selezione del modello, uso del prompt caching per ottimizzare i costi [S1].
La novità apre una strada prevedibile: team che standardizzano su API OpenAI possono spostare carichi su Bedrock e sfruttare governance e controlli già in uso su AWS, senza rifare l’integrazione [S1].