Articoli
firmati da questo autore
-
Redpanda, Kafka e Confluent a confronto: cosa cambia davvero
Un confronto tra Apache Kafka, Confluent e Redpanda: latenza, footprint operativo, ecosistema e le nuove architetture diskless che spostano lo storage su object storage.
-
Databricks ha costruito un benchmark per i coding agent sulle proprie pull request
Databricks ha valutato modelli e harness per il coding partendo dalle pull request realmente mergiate dai suoi ingegneri. Due lezioni pratiche: il prezzo per…
-
Datalab Lift: un extractor schema-first da 9B a confronto con NuExtract3, Gemini e Docling
Lift di Datalab è un modello vision da 9B che trasforma PDF e immagini in JSON conforme a uno schema in un unico passaggio.…
-
Loop engineering per il retrieval gerarchico: leggere un documento lungo dal suo indice
Invece di fare top-k su tutte le pagine, il retrieval percorre la table of contents un livello alla volta: un loop limitato che risparmia…
-
OpenClaw con Ollama: un assistente AI privato sulle app di messaggistica
Come collegare i modelli locali di Ollama a Telegram, WhatsApp e Slack con OpenClaw: dal setup a comando singolo alla configurazione del context, fino…
-
Come scegliere l’interfaccia migliore per i coding agent
L’interfaccia con cui si orchestrano i coding agent incide molto sulla produttività. Una rassegna di otto strumenti e tre criteri concreti per scegliere quello…
-
SageMaker HyperPod: cinque nuove funzionalità per l’inference enterprise
Amazon aggiunge a SageMaker HyperPod inference il data capture multi-tier, il deploy diretto da Hugging Face Hub, il caricamento dei pesi da NVMe locale,…
-
Nemotron Labs 3 Puzzle 75B A9B: NVIDIA comprime un MoE ibrido per raddoppiare il throughput
NVIDIA comprime Nemotron-3-Super in una variante da 75,3B totali e 9,3B attivi, ottenendo fino a 2,14x di throughput e portando la concorrenza a 1M…
-
La domanda da 3.000 miliardi: l’AI ripagherà la spesa in infrastruttura?
Il dibattito sul ROI dell’AI torna con numeri più grandi: secondo Sequoia servono 3.000 miliardi di ricavi per giustificare la spesa in chip e…
-
ChatGPT Work: OpenAI trasforma ChatGPT in un agente che porta a termine il lavoro
OpenAI presenta ChatGPT Work, un agente che agisce su app e file, resta su un progetto per ore e trasforma un obiettivo in materiali…