#llm
risultati
-
Soofi S 30B-A3B: un foundation model open Mamba-Transformer MoE per tedesco e inglese
Un consorzio di ricerca tedesco rilascia Soofi S 30B-A3B, un base model ibrido Mamba-Transformer MoE che attiva 3,2B…
-
Le allucinazioni del RAG sono spesso fallimenti del retrieval
Quando un sistema RAG risponde con sicurezza ma in modo sbagliato, la causa è quasi sempre a monte:…
-
GPT-Red: come OpenAI usa il self-play per irrobustire i modelli contro la prompt injection
OpenAI descrive GPT-Red, il suo red-teamer automatizzato addestrato con reinforcement learning in self-play: usato nell’addestramento di GPT-5.6, ha…
-
Visione agentic: un Computer Vision MCP Server con Amazon Bedrock
AWS mostra un Computer Vision MCP Server che unisce computer vision, Strands Agents e Model Context Protocol per…
-
GPT-Red, il super-hacker LLM che OpenAI usa per rendere più sicuri i suoi modelli
MIT Technology Review racconta GPT-Red, l’LLM che OpenAI ha addestrato come sparring partner per il red-teaming automatizzato: ha…
-
GenAI per i call center universitari: l’approccio Databricks su piattaforma governata
Databricks mostra come usare GenAI per trascrivere e valutare a scala le chiamate dei call center universitari: Whisper…
-
Thinking Machines Lab rilascia Inkling, MoE multimodale da 975B a pesi aperti
Inkling è un Mixture-of-Experts da 975B parametri totali (41B attivi) con contesto fino a 1M token, input testo-immagini-audio…
-
Grok Build diventa open source dopo il caso privacy
Dopo le proteste per un CLI che caricava intere directory sui bucket cloud di xAI, l’azienda ha disabilitato…
-
Thinking Machines lancia Inkling, il primo modello open-weight contro l’AI \”taglia unica\”
Thinking Machines Lab, la startup di Mira Murati, rilascia Inkling: un MoE open-weight da 975 miliardi di parametri…
-
Mistral Vibe, Claude Code, Cursor e Codex a confronto su un task scaffold-to-PR
MarkTechPost mette a confronto quattro coding agent su un unico workflow di ingegneria (scaffold, test, PR), valutando funzionalità…