Tutte le notizie
// archivio completo, dal più recente
-
Google spinge la serie Gemini Flash su efficienza e prezzo: 3.6 Flash, 3.5 Flash-Lite e Flash Cyber
Google aggiorna il tier Flash di Gemini puntando su token efficiency e costi più bassi. La 3.6 Flash…
-
Il reverse-engineering costa poco: cosa cambia quando il codice è economico
Simon Willison sul crollo del costo di scrivere codice: i coding agent rendono conveniente reverse-engineering e automazioni prima…
-
AI transparency: cosa documentare tra governance, explainability ed EU AI Act
Una guida per distinguere AI transparency, explainability e interpretability, capire cosa impone l’EU AI Act (Articoli 13 e…
-
Gli LLM non ereditano solo i bias: nel recruiting ne inventano di nuovi
Uno studio di Princeton e Chicago (ICML) mostra che gli LLM sviluppano bias propri dall’esperienza e nel recruiting…
-
Couchbase e l’architettura multi-model: Claude su Amazon Bedrock per Capella iQ
Couchbase racconta l’architettura multi-model dietro Capella iQ su Amazon Bedrock: inferenza model-agnostic, Cross-Region Inference e Claude Sonnet 4.5…
-
Data mesh su Redshift: condivisione cross-account governata con SageMaker Unified Studio
Come usare Amazon SageMaker Unified Studio per condividere dati Redshift tra account con logica data mesh: architettura a…
-
Kimi K3: il modello open-weights che accorcia la distanza dalla frontiera
Con Kimi K3, modello open-weights da 2,8T parametri vicino alla frontiera, Nathan Lambert legge un ecosistema in cui…
-
Da Elasticsearch self-managed a OpenSearch: il caso Alight, -55% sui costi
Alight ha lasciato l’Elastic Stack self-managed per Amazon OpenSearch Service: -55% di costi, ~2.000 ore/anno di overhead in…
-
Far girare i coding agent per 24 ore: permessi, verifica e review
Con la review umana diventata il collo di bottiglia, alcune tecniche per far lavorare i coding agent per…
-
Forrester: i costi dell’AI stanno per finire sulle bollette software dei clienti
Forrester prevede budget software in crescita: i vendor AI spostano i costi sui clienti con prezzi più alti…
-
MiniCPM5-1B fine-tuned su tracce Claude Fable 5: un thinking model locale da 657MB
Uno sviluppatore ha pubblicato un modello da 1B, con build GGUF a partire da ~657MB, che gira interamente…
-
Da BI legacy ad AI agentica: il caso Tradeshift con Amazon Quick
Tradeshift ha sostituito il suo BI interno con Amazon Quick: query fino a 30 volte più veloci, TCO…