Tutte le notizie
// archivio completo, dal più recente
-
olmo-eval: un banco di prova open source per valutare gli LLM durante lo sviluppo
AllenAI rilascia olmo-eval, un workbench open source per valutare i modelli linguistici durante il loop di sviluppo. Cos’è,…
-
ai_classify è GA su Databricks: classificare il testo senza pipeline custom
La funzione ai_classify di Databricks è generally available: classificazione di testo con label personalizzate, multi-label e UI no-code,…
-
ai_extract è GA su Databricks: estrarre dati strutturati dal testo con una funzione SQL
La funzione ai_extract di Databricks è generally available: estrae dati strutturati da testo non strutturato con schema, validazione…
-
Disaster recovery gestito su Databricks: failover trasparente in Public Preview
Databricks introduce il Managed Disaster Recovery in Public Preview: replica automatica di Unity Catalog e managed table su…
-
Da partizioni a liquid clustering senza riscrivere la tabella: ora è GA su Databricks
Databricks rende GA la conversione di tabelle partizionate a liquid clustering: un solo ALTER TABLE, senza ricreare i…
-
External Lineage in GA su Unity Catalog: il data lineage copre tutto lo stack
Databricks porta External Lineage in general availability su Unity Catalog: sorgenti esterne, dashboard BI e pipeline in un…
-
Delta Sharing diventa OpenSharing: il data sharing punta a uno standard aperto
Databricks rilascia Delta Sharing come standard aperto con il nome OpenSharing: codice su GitHub e sito dedicato. Cosa…
-
I modelli open-weight raggiungono i closed sui benchmark di ragionamento
Tre laboratori indipendenti pubblicano pesi liberi che pareggiano i risultati dei sistemi proprietari sui test di matematica e…
-
DuckDB 2.0: l’analisi locale diventa il default
La nuova release porta query distribuite su file remoti senza un data warehouse. Abbiamo misurato i tempi su…
-
Spiegazione: perché i transformer dimenticano il contesto lungo
Un paper recente formalizza il calo di attenzione oltre la finestra di addestramento. Riassumiamo i risultati senza la…
-
Costruire una pipeline ELT idempotente in 120 righe
Una guida passo-passo per ingestion incrementale, gestione dei tardi e backfill, con dbt e un orchestratore minimale.
-
Il «data contract» non è burocrazia, è rispetto
Definire schemi e SLA tra team produttori e consumatori non rallenta: elimina la categoria di bug più costosa…