#llm
risultati
-
Nemotron Labs 3 Puzzle 75B A9B: NVIDIA comprime un MoE ibrido per raddoppiare il throughput
NVIDIA comprime Nemotron-3-Super in una variante da 75,3B totali e 9,3B attivi, ottenendo fino a 2,14x di throughput…
-
ChatGPT Work: OpenAI trasforma ChatGPT in un agente che porta a termine il lavoro
OpenAI presenta ChatGPT Work, un agente che agisce su app e file, resta su un progetto per ore…
-
OpenAI: circa il 30% dei task di SWE-Bench Pro e rotto
Un audit di OpenAI stima che circa il 30% dei task di SWE-Bench Pro sia difettoso, tra test…
-
Un MCP server ecommerce production-ready con Amazon Bedrock AgentCore e Mistral AI Studio
Come costruire un MCP server ecommerce su Amazon Bedrock AgentCore, con autenticazione JWT a due livelli, deploy via…
-
SpaceXAI rilascia Grok 4.5, modello addestrato con Cursor per coding e task agentici
Grok 4.5 punta su coding, task agentici e knowledge work, addestrato insieme a Cursor. Il dato di spicco…
-
Kenton Varda mette al bando le descrizioni di commit scritte dall’AI
Una citazione raccolta da Simon Willison: Kenton Varda ha imposto una moratoria sulle descrizioni di PR e commit…
-
Un support companion per AWS costruito con Amazon Bedrock AgentCore
AWS mostra come costruire un agente conversazionale su Bedrock AgentCore che analizza log CloudWatch, cerca nella documentazione e…
-
Parsing di PDF in locale con Gemma 4: trattare i documenti come immagini
Un approccio zero-shot al document parsing che renderizza ogni pagina PDF come immagine e la passa a Gemma…
-
Proxy-Pointer RAG: reasoning temporale senza precompilazione semantica
Due approcci opposti al RAG enterprise per query temporali e cross-document: LLM-Wiki compila la conoscenza durante l’ingestion, Proxy-Pointer…
-
Una pipeline RAG di produzione per PDF: parsing relazionale, retrieval sul TOC e risposte tipizzate
Come far evolvere una pipeline RAG minimale in una versione pronta per la produzione, aggiornando un contratto alla…