#data engineering
risultati
-
sqlite-utils 4.1.1: un fix per transform, foreign key e transazioni
La patch 4.1.1 chiude un caso limite silenzioso: fare transform di una tabella dentro una transazione con foreign…
-
L’AI scrive il tuo connector, ma il last mile resta lavoro tuo
Un coding agent scrive un connector in un pomeriggio. Fivetran spiega perché portarlo in produzione è tutt’altra storia,…
-
sqlite-utils 4.1: nuove opzioni per insert, upsert e per lo strict mode delle tabelle
La prima dot-release dopo sqlite-utils 4.0 porta piccole ma utili aggiunte: codice Python per generare righe, override dei…
-
Acxiom: lo stack di marketing agentico parte dal data layer
Ankur Jain di Acxiom spiega perché il marketing agentico funziona solo quando i dati proprietari sono integrati nativamente…
-
Netflix spezza le wide partition di Cassandra a runtime, un ID alla volta
Netflix ha portato le letture sulle wide partition di Cassandra da secondi a decine di millisecondi, splittandole in…
-
ClickHouse ha un driver ADBC ufficiale: connettività Arrow-native per ogni linguaggio
ClickHouse annuncia un driver ADBC ufficiale: accesso Arrow-native senza conversioni, con un unico driver scritto in Rust che…
-
Walled garden: quando è il vendor a decidere se puoi usare i tuoi dati
Un post di Fivetran sostiene che le restrizioni delle API SaaS stanno diventando il vero collo di bottiglia…
-
Databricks presenta Feature Views: una feature ML definita una volta, servita ovunque
Databricks annuncia la Public Preview di Feature Views: un framework managed per definire una feature ML una sola…
-
PySpark oltre le basi: partizioni, shuffle, join e piani di esecuzione
Passare a un livello intermedio in PySpark significa soprattutto capire il movimento dei dati: partizioni, shuffle, join, caching,…
-
Tableflow: trasformare i topic Kafka in tabelle Iceberg senza ETL
Confluent Tableflow materializza i topic Kafka come tabelle Apache Iceberg o Delta Lake, gestendo in automatico schematizzazione, conversioni…