Opinioni
Editoriali e punti di vista
risultati
-
OpenAI: circa il 30% dei task di SWE-Bench Pro e rotto
Un audit di OpenAI stima che circa il 30% dei task di SWE-Bench Pro sia difettoso, tra test…
-
Kenton Varda mette al bando le descrizioni di commit scritte dall’AI
Una citazione raccolta da Simon Willison: Kenton Varda ha imposto una moratoria sulle descrizioni di PR e commit…
-
SQL, Pandas o AI agents: chi risolve meglio i problemi di analytics
Stesse tre domande di analytics date a SQL, Pandas e a un agente Claude, con tempi di esecuzione…
-
Proxy-Pointer RAG: reasoning temporale senza precompilazione semantica
Due approcci opposti al RAG enterprise per query temporali e cross-document: LLM-Wiki compila la conoscenza durante l’ingestion, Proxy-Pointer…
-
Prompt injection: la vulnerabilità che gli LLM si portano dietro per progettazione
La prompt injection sfrutta l’incapacità degli LLM di distinguere istruzioni e dati. Cos’è, perché è difficile da risolvere…
-
Supercharger: come Rocket Close ha messo l’AI agentica in produzione
Rocket Close ha costruito Supercharger per ottimizzare le operazioni di title insurance con agenti, LLM, Amazon Bedrock e…
-
Guidare un’azienda ibrida uomo-AI: la sfida non è tecnologica, è organizzativa
Con la crescita degli agenti AI autonomi, i team di dati dovranno ripensare governance, ownership e responsabilità. Perché…
-
Dai job agli asset: il modello di maturità dell’orchestrazione dati
Dagster propone un modello di maturità dell’orchestrazione: dalle pipeline job-centriche alle piattaforme asset-aware. Perché spostare il focus dai…
-
Il tuo AI non è rotto: è il data model che non regge
Il salto tra un proof of concept brillante e un sistema AI in produzione vive nei dati. dbt…
-
Il «data contract» non è burocrazia, è rispetto
Definire schemi e SLA tra team produttori e consumatori non rallenta: elimina la categoria di bug più costosa…