Tutte le notizie
// archivio completo, dal più recente
-
LLM cascade per la generazione RAG: partire dal modello piccolo, escalare solo se serve
Un benchmark su venti modelli locali contro un flagship hosted mostra che la dimensione non predice l’accuracy e…
-
Databricks introduce gli spend controls per l’AI in Unity AI Gateway
Unity AI Gateway aggiunge budget alert proattivi su utenti, workspace, use case e account per contenere la spesa…
-
Come la FDA ha portato una piattaforma AI all’85% di utilizzo quotidiano
La FDA ha costruito su Databricks una piattaforma AI governata per i suoi 16.000 dipendenti, passata da meno…
-
Agentic retrieval su Amazon Bedrock: quando il single-shot non basta
La nuova API AgenticRetrieveStream delle Bedrock Managed Knowledge Bases decompone le domande multi-parte, itera e valuta la sufficienza.…
-
Non hai ricevuto il modello AI che hai pagato: il routing rompe l’identità del modello
Il routing a livello di richiesta ha reso il model ID un identificatore legale, ma nessuno ha deciso…
-
Valutare gli agenti AI in produzione: il blueprint di Motorway e AWS
Motorway e AWS hanno costruito una pipeline di valutazione a tre layer per un agente conversazionale, portando le…
-
Perché aggiungere più agenti AI ha reso il nostro sistema più lento
Scalando gli agenti LLM la latency saliva e arrivavano i timeout. La colpa non era di OpenAI: era…
-
RAG: la maggior parte delle “allucinazioni” sono errori di extraction
Nel RAG il modello legge il contesto: se la risposta è sbagliata è quasi sempre un errore di…
-
Agentic AI in produzione: per l’85% delle aziende manca la data foundation
Il nuovo “Agentic AI readiness index 2026” di Fivetran dice che l’85% delle aziende esegue agenti su una…
-
Quali LLM locali girano davvero su una singola GPU da 24GB nel 2026
Quali LLM locali stanno davvero su una singola GPU da 24GB nel 2026 e come si spende la…
-
SQRL: modelli text-to-SQL che ispezionano il database prima di scrivere la query
SQRL di Feyn AI ispeziona il database in sola lettura prima di impegnare la query: 70,6% di execution…
-
MLflow: le trace in Unity Catalog per i workspace con compliance security profile
Le MLflow trace arrivano nelle tabelle Unity Catalog per default sui workspace con compliance security profile: formato OpenTelemetry,…