Articoli
firmati da questo autore
-
Google spinge la serie Gemini Flash su efficienza e prezzo: 3.6 Flash, 3.5 Flash-Lite e Flash Cyber
Google aggiorna il tier Flash di Gemini puntando su token efficiency e costi più bassi. La 3.6 Flash usa il 17% di output token…
-
Il reverse-engineering costa poco: cosa cambia quando il codice è economico
Simon Willison sul crollo del costo di scrivere codice: i coding agent rendono conveniente reverse-engineering e automazioni prima rimandate. Cosa cambia per chi lavora…
-
AI transparency: cosa documentare tra governance, explainability ed EU AI Act
Una guida per distinguere AI transparency, explainability e interpretability, capire cosa impone l’EU AI Act (Articoli 13 e 50) e quali artefatti mantenere per…
-
Gli LLM non ereditano solo i bias: nel recruiting ne inventano di nuovi
Uno studio di Princeton e Chicago (ICML) mostra che gli LLM sviluppano bias propri dall’esperienza e nel recruiting stereotipano più degli umani. Cosa li…
-
Couchbase e l’architettura multi-model: Claude su Amazon Bedrock per Capella iQ
Couchbase racconta l’architettura multi-model dietro Capella iQ su Amazon Bedrock: inferenza model-agnostic, Cross-Region Inference e Claude Sonnet 4.5 al ~76% di accuratezza interna.
-
Data mesh su Redshift: condivisione cross-account governata con SageMaker Unified Studio
Come usare Amazon SageMaker Unified Studio per condividere dati Redshift tra account con logica data mesh: architettura a tre account, prerequisiti RA3 e audit…
-
Kimi K3: il modello open-weights che accorcia la distanza dalla frontiera
Con Kimi K3, modello open-weights da 2,8T parametri vicino alla frontiera, Nathan Lambert legge un ecosistema in cui gli open frenano i margini dei…
-
Da Elasticsearch self-managed a OpenSearch: il caso Alight, -55% sui costi
Alight ha lasciato l’Elastic Stack self-managed per Amazon OpenSearch Service: -55% di costi, ~2.000 ore/anno di overhead in meno e zero incidenti P1 sul…
-
Far girare i coding agent per 24 ore: permessi, verifica e review
Con la review umana diventata il collo di bottiglia, alcune tecniche per far lavorare i coding agent per sessioni lunghe: permessi in sandbox, verifica…
-
Forrester: i costi dell’AI stanno per finire sulle bollette software dei clienti
Forrester prevede budget software in crescita: i vendor AI spostano i costi sui clienti con prezzi più alti e usage charges. Per i team…