// data & ai · giornale tecnico MILANO ● LIVE 00:00:00

OpenAI GPT-5.6 Sol, Terra e Luna sono in GA su Amazon Bedrock

OpenAI GPT-5.6 Sol, Terra e Luna sono in GA su Amazon Bedrock via Responses API sull’endpoint bedrock-mantle, con prompt caching e integrazione Codex.

OpenAI GPT-5.6 nelle varianti Sol, Terra e Luna è ora generalmente disponibile su Amazon Bedrock. I tre modelli coprono workload diversi e si richiamano tutti attraverso la OpenAI Responses API sull’endpoint bedrock-mantle, con la sicurezza, il processing regionale e i controlli di costo di AWS.

Tre varianti, una API

Il nuovo schema di naming separa la generazione (il numero) dai tier di capacità (i nomi). Sol è il modello di reasoning di punta, adatto a coding autonomo e analisi multi-step; Terra bilancia performance e costo per il lavoro di produzione quotidiano; Luna è ottimizzato per inferenza veloce e a basso costo su task come classificazione, summarization e routing. Tutti e tre supportano input testo e immagine, output testo, una context window da 272K token e livelli di reasoning effort da none fino a max, così si può cambiare modello senza toccare l’integrazione.

L’accesso avviene via SDK OpenAI (Python o TypeScript): basta sostituire la base URL con l’endpoint bedrock-mantle e usare l’ID del modello Bedrock. Ogni chiamata gira sotto le policy IAM del cliente, dentro la VPC e con logging su CloudTrail; l’inferenza in-Region aiuta a rispettare i requisiti di data residency.

Prompt caching e costi

Il punto più interessante per chi ottimizza la spesa è il prompt caching, in modalità implicita (attiva di default) o esplicita con cache breakpoint. I token letti dalla cache sono fatturati con uno sconto del 90% rispetto agli input non cached, mentre quelli scritti in cache costano 1,25 volte la tariffa base. Ogni breakpoint richiede un prefisso di almeno 1.024 token e il contenuto resta riutilizzabile per almeno 30 minuti. In più, i token di input letti dalla cache non contano verso la quota input-per-minuto, un vantaggio a scala.

Sul versante coding, i modelli si collegano a Codex, l’agente di OpenAI, puntandolo su Bedrock via ~/.codex/config.toml per farlo girare nell’account AWS. Le quote sono per-modello e per-Region su token input e output al minuto, senza limite di richieste al minuto; il superamento restituisce un HTTP 429 da gestire con backoff esponenziale.

In sintesi

  • Sol, Terra e Luna in GA su Bedrock via Responses API sull’endpoint bedrock-mantle, con context window da 272K token.
  • Prompt caching con sconto del 90% sui token letti dalla cache e prefisso minimo di 1.024 token.
  • Integrazione con Codex per far girare l’inferenza dentro il proprio account AWS.

Fonte: Get started with OpenAI GPT-5.6 Sol, Terra, and Luna on Amazon Bedrock — https://aws.amazon.com/blogs/machine-learning/get-started-with-openai-gpt-5-6-sol-terra-and-luna-on-amazon-bedrock/

Condividi X Facebook LinkedIn WhatsApp Email

// scritto da

Fernando

Hai qualcosa da aggiungere? Unisciti alla discussione.

Il tuo indirizzo email non sarà pubblicato. I campi obbligatori sono contrassegnati *

Altri dell'autore

dalla stessa firma