#data engineering
risultati
-
Gigatoken: un tokenizer BPE in Rust che arriva a 24,53 GB/s
Gigatoken, tokenizer BPE in Rust sotto licenza MIT, arriva a 24,53 GB/s su GPT-2: 989x i tokenizers HuggingFace.…
-
Collegare S3 a Databricks con IAM temporaneo: setup automatico in pochi click
Automatic Setup for Amazon S3 è ora GA: con AWS IAM temporary delegation basta un login e pochi…
-
Analytics engineer o data engineer: chi serve davvero
Ruoli spesso confusi ma con responsabilità diverse: l’analytics engineer sta vicino al business e ai dati, il data…
-
DevOps e DataOps: cosa cambia e quali lezioni portare nel mondo dei dati
DevOps e DataOps condividono i principi lean ma si applicano a oggetti diversi. Metriche DORA, sei metriche di…
-
dbt Core v2.0: un solo engine in Rust, più dbt State e dbt Wizard
dbt Labs porta dbt Core v2.0 sotto Apache 2.0 e sull’engine Rust di Fusion, affiancandolo a dbt State…
-
cellcentric: il Data Hub come context layer governato per umani e agenti
Quattro anni di disciplina su Unity Catalog e Lakehouse Federation diventano in cellcentric un context layer governato: una…
-
Variant e Variant shredding di Databricks diventano generally available
Il tipo Variant per dati semi-strutturati e il Variant shredding sono in GA: performance di query vicine a…
-
Agentic AI in produzione: per l’85% delle aziende manca la data foundation
Il nuovo “Agentic AI readiness index 2026” di Fivetran dice che l’85% delle aziende esegue agenti su una…
-
Databricks cambia la gestione di continuous jobs e pipelines: cosa rivedere prima di agosto
A inizio agosto 2026 arrivano modifiche a continuous Lakeflow pipelines e continuous jobs: alcune sono breaking. Ecco cosa…
-
Come Netflix ricostruisce in tempo reale la mappa delle dipendenze tra servizi
Netflix racconta come ha costruito una mappa delle dipendenze tra servizi quasi in tempo reale: architettura streaming-first, pipeline…