#multimodale
risultati
-
Thinking Machines Lab rilascia Inkling, MoE multimodale da 975B a pesi aperti
Inkling è un Mixture-of-Experts da 975B parametri totali (41B attivi) con contesto fino a 1M token, input testo-immagini-audio…
-
NeuroVFM: un foundation model per il neuroimaging addestrato con Vol-JEPA su MRI e CT clinici non curati
Un team dell’University of Michigan pubblica su Nature Medicine NeuroVFM, un modello che impara anatomia e patologia del…
-
LingBot-World-Infinity: il world model causale open di Robbyant con un harness agentico
Robbyant (Ant Group) rilascia un world model causale da 14B che si comporta come un simulatore interattivo, con…
-
Riassumere video in locale con SmolVLM2-2.2B su una GPU consumer
SmolVLM2-2.2B gira su 5,2 GB di GPU RAM e regge il confronto con modelli più grandi sui benchmark…
-
Gemma 4 12B: il modello multimodale di Google DeepMind che elimina l’encoder separato
Google DeepMind presenta Gemma 4 12B, modello multimodale open-weight con architettura encoder-free. Cosa significa unificare visione e linguaggio…