Microsoft Foundry offre ora un catalogo curato di modelli Hugging Face, distribuibili su Managed Compute con sicurezza, governance e osservabilità di livello enterprise. La raccolta viene aggiornata settimanalmente e i modelli possono essere distribuiti con un clic su Foundry Managed Compute. I pesi sono pre-caricati in Azure, i runtime sono costruiti e scansionati da Microsoft, e ogni modello nella raccolta gode della stessa sicurezza, governance, osservabilità e fatturazione enterprise applicata a tutti gli altri modelli su Foundry.

Microsoft Foundry e Managed Compute

Microsoft Foundry è una piattaforma per costruire e gestire applicazioni AI agentiche. Offre la più ampia selezione di modelli su qualsiasi cloud — modelli di Microsoft, OpenAI, Anthropic, Meta, Mistral, DeepSeek, Hugging Face e altri — tutti accessibili tramite un unico endpoint e SDK in Python, C#, JavaScript e Java.

Al di sopra di questi modelli si trova il Foundry Agent Service: orchestrazione multi-agente con memoria integrata, grounding della conoscenza tramite Foundry IQ e un catalogo di strumenti collegabili. Foundry fornisce tracciamento end-to-end, monitoraggio in tempo reale, valutazioni continue e un ottimizzatore di prompt che migliora il comportamento degli agenti in base ai risultati delle valutazioni.

Gli sviluppatori hanno anche accesso a:

  • Filtri di sicurezza dei contenuti

  • Guardrail di aderenza ai compiti

  • Un AI Red Teaming Agent per test avversariali

  • RBAC unificato

  • Rete privata

  • Integrazione con Azure Policy direttamente all'interno della piattaforma

Foundry Managed Compute è la terza opzione di distribuzione, insieme a pay-per-token e throughput provisionato. È una piattaforma GPU gestita come servizio per modelli open-source e personalizzati. Distribuisci un'istanza del modello descritta dal numero di parametri, lunghezza del contesto e ottimizzazione di latenza o throughput, e Foundry gestisce la topologia GPU sottostante. Microsoft si occupa automaticamente degli aggiornamenti dei container, degli upgrade del runtime e delle patch di sicurezza sui runtime supportati — vLLM, SGLang, TensorRT-LLM, NIM, TEI, llama.cpp — senza dover ridistribuire il modello.

Pay-per-token, throughput provisionato e Managed Compute condividono un unico endpoint, gli stessi SDK, la stessa autenticazione, la stessa osservabilità e una singola fattura. I modelli open-source si integrano con Foundry Agents allo stesso modo dei modelli frontier. Managed Compute offre distribuzioni globali per la massima capacità e i migliori prezzi, e distribuzioni Data Zone per la residenza e la sovranità dei dati.

Perché Hugging Face

Hugging Face è la piazza pubblica dell'AI aperta: 15 milioni di sviluppatori, 400.000 organizzazioni e oltre 3 milioni di modelli open pubblicati. Nuove capacità frontier — coding agentico, segmentazione video, parlato, embeddings — arrivano ogni settimana. I modelli open hanno colmato il divario con i modelli proprietari in benchmark dopo benchmark e sbloccano capacità che gli endpoint proprietari non possono offrire:

  • Lo stato dell'arte è ora aperto. I modelli open-weight leader sono competitivi con i migliori modelli frontier chiusi nei benchmark più utilizzati.

  • Personalizzazione profonda. I pesi completi consentono fine-tuning, distillazione, quantizzazione e adattamento LoRA.

  • Il tuo modello, il tuo hosting. I pesi girano nel tuo tenant su infrastruttura che controlli.

  • Modellazione dei costi. Paghi per gli acceleratori all'ora, scala a zero quando inattivo e dimensioni le GPU in modo appropriato.

  • Controllo delle versioni. Blocca una versione specifica del modello, valuta, distribuisci e ripristina secondo il tuo ciclo di rilascio.

Il problema è sempre stato il livello operativo: scoperta, revisione delle licenze, screening di sicurezza, selezione del runtime, dimensionamento GPU, creazione di immagini, patch CVE e messa in piedi del modello dietro un endpoint enterprise. Hugging Face da solo non è una piattaforma di servizio enterprise.

I modelli Hugging Face su Foundry sono quel livello operativo, gestito da Microsoft.

Modelli Hugging Face su Foundry

La Hugging Face Collection porta un sottoinsieme curato di modelli direttamente nel Foundry Model Catalog:

  • Aggiornata settimanalmente — i modelli di tendenza vengono aggiunti continuamente man mano che la comunità li pubblica.

  • Ogni modalità — testo, visione, audio e multimodale: LLM, VLM, ASR, traduzione vocale, embeddings, segmentazione, generazione di immagini.

  • Solo Safetensors, nessun codice non fidato — ogni modello è sottoposto a screening di sicurezza e viene fornito nel formato pesi SafeTensors, senza percorsi di esecuzione trust_remote_code a meno che non siano rigorosamente revisionati.

  • Il runtime giusto per il modello — vLLM e SGLang per LLM, TensorRT-LLM e NIM dove applicabile, TEI per embeddings, llama.cpp per CPU.

Dal tuo lato, un modello open-weight nella Hugging Face Collection appare e si comporta come qualsiasi altro modello nel Foundry Model Catalog. Ogni modello è stato sottoposto a una pipeline di pubblicazione multi-stadio prima di apparire lì.

La Pipeline di Cura

Hugging Face e Microsoft collaborano per portare i modelli open-weight più popolari su Microsoft Foundry — pronti per la produzione in ambienti enterprise — attraverso un processo di cura sistematico:

  • Identificare i modelli di tendenza nell'ecosistema Hugging Face basandosi su segnali della comunità, richieste dei partner e domanda dei clienti.

  • Screening per conformità e sicurezza — le licenze dei modelli vengono revisionate rispetto alla politica di distribuzione enterprise di Microsoft, e i repository vengono ispezionati per pattern trust_remote_code e codice eseguibile personalizzato.

  • Costruire, scansionare e pubblicare runtime — Microsoft costruisce immagini container di inferenza sui runtime supportati, le scansiona per vulnerabilità e le pubblica come offerte pronte per la distribuzione.

Questa pipeline garantisce che ogni modello nella Hugging Face Collection soddisfi gli standard enterprise per sicurezza, licenze e prestazioni. Mentre l'ecosistema AI open-source continua a evolversi, Microsoft e Hugging Face manterranno la raccolta aggiornata con le ultime innovazioni della comunità, offrendo agli sviluppatori un percorso affidabile dalla sperimentazione alla produzione.