Tutte le notizie
// archivio completo, dal più recente
-
Self-Distilled Reasoning: recuperare il ragionamento nel fine-tuning di Amazon Nova
Fare SFT su dataset senza reasoning trace può azzerare la capacità di ragionamento di un modello. Il Self-Distilled…
-
I data center verso un quinto dell’elettricità USA entro il 2035, secondo BloombergNEF
Un report di BloombergNEF stima che i data center useranno un quinto dell’elettricità generata negli USA entro il…
-
srt-slurm: il framework NVIDIA per benchmark riproducibili di LLM serving su SLURM
srt-slurm di NVIDIA trasforma configurazioni YAML dichiarative in workflow di benchmark SLURM riproducibili per il serving distribuito di…
-
Nativ porta i modelli MLX in un’app desktop per Mac
Nativ incapsula MLX in un’applicazione desktop per macOS, con interfaccia di chat e API server locale. Un’alternativa in…
-
Google spinge la serie Gemini Flash su efficienza e prezzo: 3.6 Flash, 3.5 Flash-Lite e Flash Cyber
Google aggiorna il tier Flash di Gemini puntando su token efficiency e costi più bassi. La 3.6 Flash…
-
Il reverse-engineering costa poco: cosa cambia quando il codice è economico
Simon Willison sul crollo del costo di scrivere codice: i coding agent rendono conveniente reverse-engineering e automazioni prima…
-
AI transparency: cosa documentare tra governance, explainability ed EU AI Act
Una guida per distinguere AI transparency, explainability e interpretability, capire cosa impone l’EU AI Act (Articoli 13 e…
-
Gli LLM non ereditano solo i bias: nel recruiting ne inventano di nuovi
Uno studio di Princeton e Chicago (ICML) mostra che gli LLM sviluppano bias propri dall’esperienza e nel recruiting…
-
Couchbase e l’architettura multi-model: Claude su Amazon Bedrock per Capella iQ
Couchbase racconta l’architettura multi-model dietro Capella iQ su Amazon Bedrock: inferenza model-agnostic, Cross-Region Inference e Claude Sonnet 4.5…
-
Data mesh su Redshift: condivisione cross-account governata con SageMaker Unified Studio
Come usare Amazon SageMaker Unified Studio per condividere dati Redshift tra account con logica data mesh: architettura a…
-
Kimi K3: il modello open-weights che accorcia la distanza dalla frontiera
Con Kimi K3, modello open-weights da 2,8T parametri vicino alla frontiera, Nathan Lambert legge un ecosistema in cui…
-
Da Elasticsearch self-managed a OpenSearch: il caso Alight, -55% sui costi
Alight ha lasciato l’Elastic Stack self-managed per Amazon OpenSearch Service: -55% di costi, ~2.000 ore/anno di overhead in…