// data & ai · giornale tecnico MILANO ● LIVE 00:00:00

GPT-5.6 Sol, Terra e Luna disponibili in GA su Amazon Bedrock

OpenAI porta la famiglia GPT-5.6 in general availability su Amazon Bedrock con tre tier (Sol, Terra, Luna), prompt caching con sconto del 90% sull’input cached e un modello di sicurezza a livello hardware.

OpenAI ha reso generalmente disponibili i modelli GPT-5.6 Sol, Terra e Luna su Amazon Bedrock. La novità conta per chi costruisce agenti e prodotti AI perché introduce un nuovo schema di naming (il numero indica la generazione, i nomi Sol/Terra/Luna identificano tier di capacità che possono avanzare a cadenza propria) e perché il pricing corrisponde alle tariffe first-party di OpenAI, con l’uso che concorre agli impegni AWS esistenti.

Tre tier per dimensionare capacità e costo

GPT-5.6 Sol è il modello di reasoning di punta. Secondo OpenAI, Sol raggiunge lo stato dell’arte sull’Artificial Analysis Coding Agent Index con 80 punti (2,8 sopra il modello migliore successivo) usando meno della metà degli output token, in meno della metà del tempo e con circa un terzo di costo in meno; ottiene 73,5% su ExploitBench per la ricerca di cybersecurity contro il 47,9% di GPT-5.5 a parità di budget di token. Su Agents’ Last Exam (workflow professionali lunghi in 55 campi) segna 53,6, superando il secondo modello di 13,1 punti; a reasoning effort medio mantiene un vantaggio di 11,4 punti a circa un quarto del costo stimato. Sol introduce anche il max reasoning effort. Terra è il modello bilanciato per il lavoro di produzione quotidiano, mentre Luna è quello veloce ed economico per inference ad alto volume come classificazione, summarization e routing.

Inference engine, prompt caching e sicurezza

Il traffico agentico è spesso bursty: una richiesta può innescare centinaia di chiamate al modello. L’inference engine di nuova generazione di Bedrock aggrega capacità per assorbire i picchi isolando il throughput di ciascun cliente, con inference in-Region per i requisiti di data residency. GPT-5.6 su Bedrock introduce il prompt caching con cache breakpoint espliciti: si marca la parte riutilizzabile del prompt e Bedrock riusa il contesto già elaborato nelle richieste successive. L’input cached è fatturato con uno sconto del 90% e resta riutilizzabile per almeno 30 minuti. Sul fronte sicurezza, Bedrock usa un modello zero-operator access applicato a livello di chip: nessun operatore AWS può accedere a prompt o completion, ogni chiamata gira sotto le policy IAM del cliente, dentro la VPC e con log su CloudTrail.

  • Tre tier (Sol, Terra, Luna) per dimensionare capacità e costo su ciascun workload, con meno output token dei predecessori.
  • Il prompt caching con sconto del 90% sull’input cached mira a contenere i costi delle run agentiche ripetitive.
  • Disponibilità iniziale: Sol in US East (N. Virginia e Ohio); Terra e Luna anche in US West (Oregon).

Fonte: OpenAI GPT-5.6 Sol, Terra, and Luna now GA on Amazon Bedrock — https://aws.amazon.com/blogs/machine-learning/openai-gpt-5-6-sol-terra-and-luna-are-now-generally-available-on-amazon-bedrock/

Condividi X Facebook LinkedIn WhatsApp Email

// scritto da

Fernando

Hai qualcosa da aggiungere? Unisciti alla discussione.

Il tuo indirizzo email non sarà pubblicato. I campi obbligatori sono contrassegnati *

Altri dell'autore

dalla stessa firma