#llm
risultati
-
Hugging Face: perché le aziende smettono di “affittare” l’AI
Nel podcast Equity di TechCrunch, il CEO di Hugging Face Clem Delangue racconta il boom dell’open source AI…
-
Il backend transformers di vLLM raggiunge la velocità delle implementazioni native
Hugging Face ha ottimizzato il modeling backend transformers di vLLM: su tre modelli Qwen3 il throughput eguaglia o…
-
Fine-tuning spiegato dalle basi: come i modelli pretrained imparano nuove capacita’
Cos’e’ il fine-tuning, perche’ non si capisce senza il pretraining e quando conviene davvero rispetto a un prompt…
-
LingBot-World-Infinity: il world model causale open di Robbyant con un harness agentico
Robbyant (Ant Group) rilascia un world model causale da 14B che si comporta come un simulatore interattivo, con…
-
Riassumere video in locale con SmolVLM2-2.2B su una GPU consumer
SmolVLM2-2.2B gira su 5,2 GB di GPU RAM e regge il confronto con modelli più grandi sui benchmark…
-
Un semantic layer per l’agentic AI su AWS con Stardog e Amazon Bedrock AgentCore
Come costruire un semantic layer con Stardog su Amazon Aurora e Redshift e far ragionare un agente Strands…
-
Clem Delangue (Hugging Face): perché l’open source AI conta sempre di più
Nel podcast Equity di TechCrunch, il CEO di Hugging Face spiega perché le aziende passano dalle API frontier…
-
Loop engineering per il retrieval gerarchico: leggere un documento lungo dal suo indice
Invece di fare top-k su tutte le pagine, il retrieval percorre la table of contents un livello alla…
-
OpenClaw con Ollama: un assistente AI privato sulle app di messaggistica
Come collegare i modelli locali di Ollama a Telegram, WhatsApp e Slack con OpenClaw: dal setup a comando…
-
Come scegliere l’interfaccia migliore per i coding agent
L’interfaccia con cui si orchestrano i coding agent incide molto sulla produttività. Una rassegna di otto strumenti e…