#llm
risultati
-
La soglia di un agente non è una percentuale: è un prezzo
Perché fissare un ESCALATION_THRESHOLD = 0.90 uguale per ogni decisione è un errore, e come derivare la soglia…
-
Interrogare un data lake in locale con DuckDB, MCP e Claude
Un tutorial Fivetran mostra come interrogare tabelle Iceberg dal laptop: DuckDB come motore, un server MCP come ponte…
-
Il long context ha un costo: un layer di prompt-pruning deterministico per sistemi LLM
Nelle conversazioni LLM lunghe il prompt cresce all’infinito, accumulando token ridondanti che aumentano costo e latenza. Un pipeline…
-
Il collo di bottiglia dell’AI non è il compute, è spostare i dati
Sara A. Metwalli argomenta che i sistemi AI moderni non sono limitati dalla velocità di calcolo ma dalla…
-
Genie all’hackathon Databricks: interrogare, costruire e comporre agenti sui dati governati
Dal quinto hackathon Genie di Databricks, dieci progetti reali mostrano i tre modi di usarlo: interrogare, costruire e…
-
Databricks misura i coding agent sul proprio codice: cosa cambia su costi e modelli
Databricks ha costruito un benchmark interno sui propri milioni di righe di codice per capire quale coding agent…
-
Il J-lens di Anthropic: guardare cosa un LLM sta calcolando prima che lo scriva
Anthropic ha costruito il Jacobian lens per osservare i layer intermedi di Claude Opus 4.6. In un caso…
-
The Big Con dell’agentic AI: la lezione della dipendenza dai consulenti
Un’analisi che accosta l’over-dipendenza dall’agentic AI a quella storica dal management consulting: delegare cognizione e giudizio alle macchine…
-
Costruire un data science agent autonomo con DeepAnalyze-8B su GPU T4
Un tutorial per trasformare DeepAnalyze-8B in un agente di data analysis: caricamento in 4-bit su GPU T4, esecuzione…
-
RAG era sempre stato un workaround temporaneo. Cosa viene dopo
Un’analisi provocatoria: il RAG è un layer di traduzione ad alta latenza, non un vero sistema di memoria.…