#openai
risultati
-
GPT-Red, il super-hacker LLM che OpenAI usa per rendere più sicuri i suoi modelli
MIT Technology Review racconta GPT-Red, l’LLM che OpenAI ha addestrato come sparring partner per il red-teaming automatizzato: ha…
-
GPT-5.6 Sol cancella file da solo: le segnalazioni e cosa dice il system card
Diversi utenti segnalano che il nuovo modello di punta di OpenAI, GPT-5.6 Sol, ha cancellato file e interi…
-
Pydantic + OpenAI: output strutturati dagli LLM senza parsing manuale
Combinare i Structured Outputs di OpenAI con Pydantic permette di ricevere oggetti Python tipizzati e validati, invece di…
-
GPT-5.6 Luna, Terra e Sol: cosa cambia per chi usa gli LLM
La release di GPT-5.6 vista da Simon Willison: tre tier, prezzi e un caveat utile sul prezzo per…
-
GPT-5.6: OpenAI punta sul Programmatic Tool Calling per gli agenti
OpenAI porta GPT-5.6 in GA con tre tier e il Programmatic Tool Calling, che esegue JavaScript in un…
-
ChatGPT Work: OpenAI trasforma ChatGPT in un agente che porta a termine il lavoro
OpenAI presenta ChatGPT Work, un agente che agisce su app e file, resta su un progetto per ore…
-
OpenAI: circa il 30% dei task di SWE-Bench Pro e rotto
Un audit di OpenAI stima che circa il 30% dei task di SWE-Bench Pro sia difettoso, tra test…
-
OpenAI acquisisce Ona: gli agenti AI diventano infrastruttura persistente
Con l’acquisizione di Ona, OpenAI punta a dare a Codex ambienti cloud persistenti e sicuri per agenti a…