#benchmark
risultati
-
Bonsai 27B: Qwen3.6-27B in versione 1-bit e ternaria per laptop e telefoni
PrismML rilascia Bonsai 27B, build a bassissimo numero di bit di Qwen3.6-27B: la ternaria conserva il 94,6% della…
-
@clickhouse/rowbinary: una libreria che è anche una Agent Skill per generare parser
ClickHouse ha rilasciato @clickhouse/rowbinary, reader e writer Node.js per i formati RowBinary che funziona anche come Agent Skill:…
-
NeuroVFM: un foundation model per il neuroimaging addestrato con Vol-JEPA su MRI e CT clinici non curati
Un team dell’University of Michigan pubblica su Nature Medicine NeuroVFM, un modello che impara anatomia e patologia del…
-
TRACE: Stanford trasforma i fallimenti ricorrenti degli agenti in ambienti RL mirati
TRACE diagnostica le capacità mancanti di un agente, genera un ambiente verificabile per ogni gap, addestra un adapter…
-
GPT-5.6 Sol, Terra e Luna disponibili in GA su Amazon Bedrock
OpenAI porta la famiglia GPT-5.6 in general availability su Amazon Bedrock con tre tier (Sol, Terra, Luna), prompt…
-
Fivetran Enterprise Data Infrastructure Benchmark 2026: i costi nascosti delle pipeline
Il benchmark 2026 di Fivetran su oltre 500 leader stima 29,3 milioni di spesa annua sui dati e…
-
Databricks misura i coding agent sul proprio codice: cosa cambia su costi e modelli
Databricks ha costruito un benchmark interno sui propri milioni di righe di codice per capire quale coding agent…
-
SensorFM: il foundation model di Google per la salute da wearable
Google Research presenta SensorFM, un foundation model per dati da wearable pre-addestrato su oltre un trilione di minuti…
-
Databricks ha costruito un benchmark per i coding agent sulle proprie pull request
Databricks ha valutato modelli e harness per il coding partendo dalle pull request realmente mergiate dai suoi ingegneri.…
-
Datalab Lift: un extractor schema-first da 9B a confronto con NuExtract3, Gemini e Docling
Lift di Datalab è un modello vision da 9B che trasforma PDF e immagini in JSON conforme a…