Senza categoria
risultati
-
GraphEval: valutare le hallucination degli LLM con i knowledge graph
GraphEval, framework di ricercatori Amazon, usa knowledge graph e modelli NLI per individuare e localizzare le hallucination negli…
-
OpenAI GPT-5.6 Sol, Terra e Luna sono in GA su Amazon Bedrock
OpenAI GPT-5.6 Sol, Terra e Luna sono in GA su Amazon Bedrock via Responses API sull’endpoint bedrock-mantle, con…
-
Un recommender next-best-product spiegabile per il banking con SageMaker e PyTorch
Un sistema next-best-product per il banking su SageMaker e PyTorch: architettura multi-tower con attention appresa che fornisce l’explainability…
-
I cinque concetti dietro l’agentic AI che ogni engineer dovrebbe padroneggiare
Tool use, memory, planning loop, orchestrazione multi-agente ed evaluation: i cinque concetti che tengono insieme i sistemi agentic,…
-
dbt Labs ritira la Snowflake Native App: cosa cambia e perché
dbt Labs ritira la dbt Snowflake Native App: maintenance mode da luglio 2026 e rimozione dal Marketplace a…
-
Claude Opus 5 disponibile come modello Databricks-hosted su Model Serving
Databricks Model Serving ora ospita Claude Opus 5 come modello Databricks-hosted, accessibile via Foundation Model APIs in modalità…
-
Un sistema di Intelligent Document Processing su AWS per classificare documenti ed estrarre PII
Un sistema di intelligent document processing su AWS che classifica allegati email ed estrae PII combinando Textract e…
-
Come Airbnb ha democratizzato i dati con la sua Data University
Non solo infrastruttura: Airbnb ha diffuso l’uso dei dati con la Data University, portando gli utenti settimanali della…
-
Capire i benchmark degli LLM: come leggerli senza farsi ingannare
Benchmark diversi misurano capacità diverse, con scoring non confrontabili. Una guida per leggere MMLU, GSM8k, HumanEval e gli…
-
DevOps e DataOps: cosa cambia e quali lezioni portare nel mondo dei dati
DevOps e DataOps condividono i principi lean ma si applicano a oggetti diversi. Metriche DORA, sei metriche di…