Tutte le notizie
// archivio completo, dal più recente
-
RAG contro fine-tuning: cosa fanno davvero e quando usare l’uno, l’altro o entrambi
RAG e fine-tuning non sono tecniche in competizione: risolvono problemi diversi a livelli diversi di un’applicazione AI. RAG…
-
Valutare una piattaforma di analytics enterprise: sette criteri e un POC sui tuoi dati
Una guida Databricks propone sette criteri pesati, uno scorecard, un TCO a tre anni e un banco di…
-
Programmazione GPU a tile con NVIDIA: da cuTile e Triton alla flash attention
Un modello di programmazione GPU che ragiona per tile invece che per singolo thread: con TileGym, cuTile e…
-
TabFM: Google porta i foundation model sui dati tabellari
Un foundation model per classification e regression su tabelle mai viste, in un singolo forward pass e senza…
-
Quando Debezium ha senso per la replica di database (e quando pesa)
Debezium cattura le transazioni e le inoltra a Kafka per il CDC. Potente ma da gestire: idempotenza parziale,…
-
Loop engineering: come autoresearch trasforma un agente in un ciclo di ricerca ML
Il loop engineering sostituisce il botta e risposta manuale con un ciclo che pianifica, agisce e verifica da…
-
Claude apps gateway per AWS: governance centralizzata per Claude Code
AWS e Anthropic presentano un control plane self-hosted per gestire accesso, policy e spesa di Claude Code e…
-
Directly Responsible Individuals: perché un agente non può essere il DRI
Simon Willison riflette sul concetto di Directly Responsible Individual applicato agli agenti LLM: un agente non dovrebbe mai…
-
L’AI scrive il tuo connector, ma il last mile resta lavoro tuo
Un coding agent scrive un connector in un pomeriggio. Fivetran spiega perché portarlo in produzione è tutt’altra storia,…
-
Open model sotto pressione: Nathan Lambert e i sei mesi che contano
Su Interconnects, Nathan Lambert avverte che possibili misure di policy negli USA potrebbero relegare gli open model a…
-
Da Hugging Face a SageMaker Studio in un click: cosa cambia davvero
Amazon annuncia un’integrazione deep-link tra Hugging Face e SageMaker AI: modello pre-caricato, permessi IAM automatici e visibilità sulla…
-
Thinking Machines Lab: la tesi tecnica per un’AI human-centered sui model weights
Il laboratorio di Mira Murati sostiene che i valori umani vadano codificati nei model weights fine-tuned, non nei…