#llm
risultati
-
GPT-Red, il super-hacker LLM che OpenAI usa per rendere più sicuri i suoi modelli
MIT Technology Review racconta GPT-Red, l’LLM che OpenAI ha addestrato come sparring partner per il red-teaming automatizzato: ha…
-
GenAI per i call center universitari: l’approccio Databricks su piattaforma governata
Databricks mostra come usare GenAI per trascrivere e valutare a scala le chiamate dei call center universitari: Whisper…
-
Thinking Machines Lab rilascia Inkling, MoE multimodale da 975B a pesi aperti
Inkling è un Mixture-of-Experts da 975B parametri totali (41B attivi) con contesto fino a 1M token, input testo-immagini-audio…
-
Grok Build diventa open source dopo il caso privacy
Dopo le proteste per un CLI che caricava intere directory sui bucket cloud di xAI, l’azienda ha disabilitato…
-
Thinking Machines lancia Inkling, il primo modello open-weight contro l’AI \”taglia unica\”
Thinking Machines Lab, la startup di Mira Murati, rilascia Inkling: un MoE open-weight da 975 miliardi di parametri…
-
Mistral Vibe, Claude Code, Cursor e Codex a confronto su un task scaffold-to-PR
MarkTechPost mette a confronto quattro coding agent su un unico workflow di ingegneria (scaffold, test, PR), valutando funzionalità…
-
Claude Sonnet 5 contro Sonnet 4.6 e Opus 4.8: benchmark, prezzi e trade-off
Anthropic ha rilasciato Claude Sonnet 5, il suo modello mid-tier più agentico: batte Sonnet 4.6 su ogni benchmark…
-
UX testing su larga scala con Nova Act: user flow analizzati dall’AI
Una soluzione di riferimento su AWS usa Amazon Nova Act per generare scenari di test dalla documentazione ed…
-
Bonsai 27B: Qwen3.6-27B in versione 1-bit e ternaria per laptop e telefoni
PrismML rilascia Bonsai 27B, build a bassissimo numero di bit di Qwen3.6-27B: la ternaria conserva il 94,6% della…
-
Pydantic + OpenAI: output strutturati dagli LLM senza parsing manuale
Combinare i Structured Outputs di OpenAI con Pydantic permette di ricevere oggetti Python tipizzati e validati, invece di…