#data engineering
risultati
-
Comandi Git CLI nelle Git folders di Databricks: ora in Public Preview
Databricks porta i comandi Git CLI nelle Git folders in Public Preview: git stash, rebase interattivo, pre-commit hook,…
-
Databricks disabiliterà i link pubblici per il download del driver JDBC legacy
Da settembre 2026 i link pubblici S3 del Simba JDBC Driver (Legacy) saranno disabilitati. Chi usa download automatizzati…
-
Databricks Runtime 19 è in general availability
DBR 19 è GA su Apache Spark 4.2.0. Attenzione ai behavioral change: Python UDF con Arrow di default,…
-
PyPI blocca i nuovi file sulle release più vecchie di 14 giorni
PyPI ora rifiuta nuovi file sulle release più vecchie di 14 giorni per evitare l’avvelenamento di versioni stabili…
-
Gestire i log su OpenSearch con data streams e ISM
Data streams e Index State Management su Amazon OpenSearch Service automatizzano rollover, retention e tiering dei dati time…
-
Gigatoken: un tokenizer BPE in Rust che arriva a 24,53 GB/s
Gigatoken, tokenizer BPE in Rust sotto licenza MIT, arriva a 24,53 GB/s su GPT-2: 989x i tokenizers HuggingFace.…
-
Collegare S3 a Databricks con IAM temporaneo: setup automatico in pochi click
Automatic Setup for Amazon S3 è ora GA: con AWS IAM temporary delegation basta un login e pochi…
-
Analytics engineer o data engineer: chi serve davvero
Ruoli spesso confusi ma con responsabilità diverse: l’analytics engineer sta vicino al business e ai dati, il data…
-
DevOps e DataOps: cosa cambia e quali lezioni portare nel mondo dei dati
DevOps e DataOps condividono i principi lean ma si applicano a oggetti diversi. Metriche DORA, sei metriche di…
-
dbt Core v2.0: un solo engine in Rust, più dbt State e dbt Wizard
dbt Labs porta dbt Core v2.0 sotto Apache 2.0 e sull’engine Rust di Fusion, affiancandolo a dbt State…