#mlops
risultati
-
SageMaker AI: una UI per le inference recommendations della GenAI
Amazon SageMaker AI porta in Studio un’interfaccia low-code per ottenere configurazioni di inference ottimizzate per i modelli generativi,…
-
Loop engineering: come autoresearch trasforma un agente in un ciclo di ricerca ML
Il loop engineering sostituisce il botta e risposta manuale con un ciclo che pianifica, agisce e verifica da…
-
Da Hugging Face a SageMaker Studio in un click: cosa cambia davvero
Amazon annuncia un’integrazione deep-link tra Hugging Face e SageMaker AI: modello pre-caricato, permessi IAM automatici e visibilità sulla…
-
LingBot-VA 2.0: il modello video-action di Robbyant pensato nativamente per la Physical AI
Robbyant (Ant Group) pre-addestra da zero un DiT causale video-action per la manipolazione robotica generalista, invece di adattare…
-
DDP, ZeRO, FSDP: la strategia decide quanto comunichi, il cablaggio quanto ti costa
Un’analisi misurata di DDP, ZeRO e FSDP su A100 e H200. La conclusione controintuitiva: sullo stesso nodo, quattro…
-
Databricks presenta Feature Views: una feature ML definita una volta, servita ovunque
Databricks annuncia la Public Preview di Feature Views: un framework managed per definire una feature ML una sola…
-
Disaggregated prefill e decode per l’inference LLM su SageMaker HyperPod
Il DPD dell’HyperPod Inference Operator separa prefill e decode su pool di GPU distinti collegati via EFA RDMA,…
-
Come Henry Schein One verifica le radiografie dentali in tempo reale con SageMaker AI
Il caso Image Verify: un sistema di quality assessment su Amazon SageMaker AI che valuta la qualità delle…
-
Fine-tuning serverless dei modelli NVIDIA Nemotron 3 su Amazon SageMaker AI
SageMaker AI introduce la serverless model customization per Nemotron 3 Nano e Super: come adattare questi modelli open-weight…
-
SageMaker HyperPod: cinque nuove funzionalità per l’inference enterprise
Amazon aggiunge a SageMaker HyperPod inference il data capture multi-tier, il deploy diretto da Hugging Face Hub, il…