#retrieval
risultati
-
Agentic RAG: quando il retrieval diventa un loop search-read-decide
Un’implementazione minimale con l’OpenAI Agents SDK che trasforma il retrieval in un’azione iterativa dell’agente, con cinque domande da…
-
RAG era sempre stato un workaround temporaneo. Cosa viene dopo
Un’analisi provocatoria: il RAG è un layer di traduzione ad alta latenza, non un vero sistema di memoria.…
-
Loop engineering per il retrieval gerarchico: leggere un documento lungo dal suo indice
Invece di fare top-k su tutte le pagine, il retrieval percorre la table of contents un livello alla…
-
Proxy-Pointer RAG: reasoning temporale senza precompilazione semantica
Due approcci opposti al RAG enterprise per query temporali e cross-document: LLM-Wiki compila la conoscenza durante l’ingestion, Proxy-Pointer…
-
Una pipeline RAG di produzione per PDF: parsing relazionale, retrieval sul TOC e risposte tipizzate
Come far evolvere una pipeline RAG minimale in una versione pronta per la produzione, aggiornando un contratto alla…
-
RAG spiegato: il paper che ha dato agli LLM una memoria esterna
La retrieval-augmented generation collega un modello linguistico a una base di conoscenza esterna. Spieghiamo il paper che ha…
-
Vector database a confronto: latenza, costo, e quando non servono
Abbiamo testato cinque motori su retrieval reale. Spoiler: per molti casi una buona indicizzazione full-text basta.