Articoli
firmati da questo autore
-
Da Hugging Face a SageMaker Studio in un click: cosa cambia davvero
Amazon annuncia un’integrazione deep-link tra Hugging Face e SageMaker AI: modello pre-caricato, permessi IAM automatici e visibilità sulla quota GPU. Miglioramento di workflow, non…
-
Thinking Machines Lab: la tesi tecnica per un’AI human-centered sui model weights
Il laboratorio di Mira Murati sostiene che i valori umani vadano codificati nei model weights fine-tuned, non nei prompt. Al centro dell’argomento c’è la…
-
Correlazioni spurie: nascono dal campione piccolo, non dai dati grandi
Un’analisi su Towards Data Science smonta un’intuizione comune: con pochi soggetti, correlazioni alte compaiono per puro caso. La geometria di Pearson spiega perché.
-
Writable warm storage in OpenSearch Service: scrivere sul tier caldo senza migrazioni
Amazon OpenSearch Service aggiunge un tier warm scrivibile su istanze OI2 e S3: niente più round trip warm-hot-warm per aggiornare dati storici, e Reserved…
-
La soglia di un agente non è una percentuale: è un prezzo
Perché fissare un ESCALATION_THRESHOLD = 0.90 uguale per ogni decisione è un errore, e come derivare la soglia dal rapporto tra costo dell’errore e…
-
Trigger.dev sposta l’observability da Postgres a ClickHouse
Un customer story ClickHouse racconta la migrazione dell’observability di Trigger.dev da Postgres: P95 attorno ai 200 ms e storage ridotto, con i dovuti caveat…
-
Interrogare un data lake in locale con DuckDB, MCP e Claude
Un tutorial Fivetran mostra come interrogare tabelle Iceberg dal laptop: DuckDB come motore, un server MCP come ponte e Claude Desktop come interfaccia. Il…
-
Open Data Infrastructure: la tesi di Fivetran contro i walled garden
Fivetran definisce la Open Data Infrastructure: dato archiviato una volta in formati aperti, compute disaccoppiato, meno lock-in. Una tesi solida ma non nuova, da…
-
sqlite-utils 4.1: nuove opzioni per insert, upsert e per lo strict mode delle tabelle
La prima dot-release dopo sqlite-utils 4.0 porta piccole ma utili aggiunte: codice Python per generare righe, override dei tipi, drop di indici e la…
-
Fivetran Enterprise Data Infrastructure Benchmark 2026: i costi nascosti delle pipeline
Il benchmark 2026 di Fivetran su oltre 500 leader stima 29,3 milioni di spesa annua sui dati e 2,2 milioni solo di manutenzione pipeline.…