#llm
risultati
-
Il J-lens di Anthropic: guardare cosa un LLM sta calcolando prima che lo scriva
Anthropic ha costruito il Jacobian lens per osservare i layer intermedi di Claude Opus 4.6. In un caso…
-
The Big Con dell’agentic AI: la lezione della dipendenza dai consulenti
Un’analisi che accosta l’over-dipendenza dall’agentic AI a quella storica dal management consulting: delegare cognizione e giudizio alle macchine…
-
Costruire un data science agent autonomo con DeepAnalyze-8B su GPU T4
Un tutorial per trasformare DeepAnalyze-8B in un agente di data analysis: caricamento in 4-bit su GPU T4, esecuzione…
-
RAG era sempre stato un workaround temporaneo. Cosa viene dopo
Un’analisi provocatoria: il RAG è un layer di traduzione ad alta latenza, non un vero sistema di memoria.…
-
Hugging Face: perché le aziende smettono di “affittare” l’AI
Nel podcast Equity di TechCrunch, il CEO di Hugging Face Clem Delangue racconta il boom dell’open source AI…
-
Il backend transformers di vLLM raggiunge la velocità delle implementazioni native
Hugging Face ha ottimizzato il modeling backend transformers di vLLM: su tre modelli Qwen3 il throughput eguaglia o…
-
Fine-tuning spiegato dalle basi: come i modelli pretrained imparano nuove capacita’
Cos’e’ il fine-tuning, perche’ non si capisce senza il pretraining e quando conviene davvero rispetto a un prompt…
-
LingBot-World-Infinity: il world model causale open di Robbyant con un harness agentico
Robbyant (Ant Group) rilascia un world model causale da 14B che si comporta come un simulatore interattivo, con…
-
Riassumere video in locale con SmolVLM2-2.2B su una GPU consumer
SmolVLM2-2.2B gira su 5,2 GB di GPU RAM e regge il confronto con modelli più grandi sui benchmark…
-
Un semantic layer per l’agentic AI su AWS con Stardog e Amazon Bedrock AgentCore
Come costruire un semantic layer con Stardog su Amazon Aurora e Redshift e far ragionare un agente Strands…