#Apache Spark
risultati
-
Databricks Runtime 19 è in general availability
DBR 19 è GA su Apache Spark 4.2.0. Attenzione ai behavioral change: Python UDF con Arrow di default,…
-
Come Dow ha costruito un Carbon Footprint Ledger su Databricks
Il team Enterprise Data & AI di Dow ha costruito un Carbon Footprint Ledger su Databricks con Apache…
-
Scala e Java UDF in Unity Catalog: disponibilità generale
Databricks porta in GA la registrazione di UDF Scala e Java in Unity Catalog: riuso su notebook, job…
-
Apache Spark 4.2: metric views, Auto CDC e primitive vettoriali dentro il motore
Spark 4.2 porta nel motore un semantic layer nativo, Auto CDC nelle pipeline dichiarative, funzioni vettoriali e geospaziali…
-
Remote Shuffle Service ad alte prestazioni su Amazon EMR con Apache Celeborn
Apache Celeborn disaccoppia lo shuffle di Spark dal ciclo di vita degli executor, permettendo di girare al 100%…
-
Anomaly detection in tempo reale con Spark Real-Time Mode
Databricks mostra un pattern di guardrail operativo su Spark Structured Streaming: con Real-Time Mode la latenza scende sotto…
-
PySpark oltre le basi: partizioni, shuffle, join e piani di esecuzione
Passare a un livello intermedio in PySpark significa soprattutto capire il movimento dei dati: partizioni, shuffle, join, caching,…
-
AWS Glue supporta Spark Connect nelle interactive sessions
AWS Glue supporta nativamente Apache Spark Connect: si sviluppa PySpark in locale nel proprio IDE e si esegue…