#openai
risultati
-
Intelligenza utile per dollaro: la pagella dell’AI secondo OpenAI
OpenAI propone di misurare l’AI per «intelligenza utile per dollaro»: un framework utile, ma che orienta la scelta…
-
Quando Codex cancella la home: il bug di GPT-5.6 e la lezione sui permessi degli agenti
Un bug documentato di Codex in cui GPT-5.6 cancella file per errore mostra quanto pesino full access mode…
-
OpenAI presenta GPT-Red: il modello di red-teaming automatico che batte gli umani sulla prompt injection
GPT-Red è un modello interno di OpenAI addestrato in self-play a scovare vulnerabilità di prompt injection: su un’arena…
-
GPT-Red: come OpenAI usa il self-play per irrobustire i modelli contro la prompt injection
OpenAI descrive GPT-Red, il suo red-teamer automatizzato addestrato con reinforcement learning in self-play: usato nell’addestramento di GPT-5.6, ha…
-
GPT-Red, il super-hacker LLM che OpenAI usa per rendere più sicuri i suoi modelli
MIT Technology Review racconta GPT-Red, l’LLM che OpenAI ha addestrato come sparring partner per il red-teaming automatizzato: ha…
-
GPT-5.6 Sol cancella file da solo: le segnalazioni e cosa dice il system card
Diversi utenti segnalano che il nuovo modello di punta di OpenAI, GPT-5.6 Sol, ha cancellato file e interi…
-
Pydantic + OpenAI: output strutturati dagli LLM senza parsing manuale
Combinare i Structured Outputs di OpenAI con Pydantic permette di ricevere oggetti Python tipizzati e validati, invece di…
-
GPT-5.6 Luna, Terra e Sol: cosa cambia per chi usa gli LLM
La release di GPT-5.6 vista da Simon Willison: tre tier, prezzi e un caveat utile sul prezzo per…
-
GPT-5.6: OpenAI punta sul Programmatic Tool Calling per gli agenti
OpenAI porta GPT-5.6 in GA con tre tier e il Programmatic Tool Calling, che esegue JavaScript in un…
-
ChatGPT Work: OpenAI trasforma ChatGPT in un agente che porta a termine il lavoro
OpenAI presenta ChatGPT Work, un agente che agisce su app e file, resta su un progetto per ore…