#llm
risultati
-
Claude Sonnet 5 contro Sonnet 4.6 e Opus 4.8: benchmark, prezzi e trade-off
Anthropic ha rilasciato Claude Sonnet 5, il suo modello mid-tier più agentico: batte Sonnet 4.6 su ogni benchmark…
-
UX testing su larga scala con Nova Act: user flow analizzati dall’AI
Una soluzione di riferimento su AWS usa Amazon Nova Act per generare scenari di test dalla documentazione ed…
-
Bonsai 27B: Qwen3.6-27B in versione 1-bit e ternaria per laptop e telefoni
PrismML rilascia Bonsai 27B, build a bassissimo numero di bit di Qwen3.6-27B: la ternaria conserva il 94,6% della…
-
Pydantic + OpenAI: output strutturati dagli LLM senza parsing manuale
Combinare i Structured Outputs di OpenAI con Pydantic permette di ricevere oggetti Python tipizzati e validati, invece di…
-
Bloccare gli attacchi slow-burn agli agenti con le policy contestuali di Omnigent
Databricks mostra come una policy contestuale stateful in Omnigent blocca un attacco di prompt injection indiretta dove ogni…
-
Ridurre latenza e costi di inference degli LLM in produzione: 12 leve pratiche
Scalare un’app LLM non significa aggiungere GPU, ma togliere lavoro inutile da ogni richiesta. Una rassegna di 12…
-
Agentic AI e margini omni-channel: il caso della finanza retail con Genie
Databricks racconta come i team finance del retail usano un AI coworker basato su ontologia e governance per…
-
Quanto costa davvero far girare un LLM in locale? Euro per milione di token, misurati
Un benchmark misura il costo in energia GPU di otto modelli locali su una singola RTX 3090. Il…
-
Blume: da una cartella di Markdown a una documentazione pronta per gli agenti
Blume è un framework open source zero-config che trasforma una cartella di Markdown in un sito di documentazione,…
-
La vera corsa dell’AI si sta spostando dai frontier model agli open model?
Il CEO di Hugging Face Clem Delangue sostiene che le imprese vogliono sempre più open model per costi,…