Microsoft Foundry bietet jetzt einen kuratierten Katalog von Hugging-Face-Modellen, die auf Managed Compute mit Unternehmenssicherheit, Governance und Beobachtbarkeit bereitgestellt werden können. Die Sammlung wird wöchentlich aktualisiert, und Modelle können mit einem Klick auf Foundry Managed Compute bereitgestellt werden. Die Gewichte sind in Azure vorab bereitgestellt, die Laufzeiten werden von Microsoft erstellt und gescannt, und jedes Modell in der Sammlung unterliegt denselben Unternehmenssicherheits-, Governance-, Beobachtbarkeits- und Abrechnungsstandards wie jedes andere Modell auf Foundry.

Microsoft Foundry und Managed Compute

Microsoft Foundry ist eine Plattform zum Erstellen und Betreiben von agentischen KI-Anwendungen. Sie bietet die breiteste Modellauswahl aller Clouds – Modelle von Microsoft, OpenAI, Anthropic, Meta, Mistral, DeepSeek, Hugging Face und anderen – alle über einen einzigen Endpunkt und SDKs in Python, C#, JavaScript und Java zugänglich.

Darüber sitzt der Foundry Agent Service: Multi-Agenten-Orchestrierung mit integriertem Gedächtnis, Wissensverankerung durch Foundry IQ und einem Katalog verbindbarer Tools. Foundry bietet durchgängiges Tracing, Echtzeit-Überwachung, kontinuierliche Evaluierungen und einen Prompt-Optimierer, der das Agentenverhalten basierend auf Evaluierungsergebnissen verbessert.

Entwickler erhalten außerdem Zugriff auf:

  • Content-Sicherheitsfilter

  • Aufgabentreue-Guardrails

  • Einen KI-Red-Teaming-Agenten für adversarielle Tests

  • Einheitliche RBAC

  • Privates Netzwerk

  • Azure Policy-Integration direkt in der Plattform

Foundry Managed Compute ist die dritte Bereitstellungsoption, neben Pay-per-Token und bereitgestelltem Durchsatz. Es ist eine verwaltete GPU-Plattform-as-a-Service für Open-Source- und benutzerdefinierte Modelle. Sie stellen eine Modellinstanz bereit, die durch Parameteranzahl, Kontextlänge und Latenz- oder Durchsatzoptimierung beschrieben wird, und Foundry kümmert sich um die darunterliegende GPU-Topologie. Microsoft übernimmt Container-Updates, Laufzeit-Upgrades und Sicherheitspatches automatisch auf unterstützten Laufzeiten – vLLM, SGLang, TensorRT-LLM, NIM, TEI, llama.cpp – ohne Ihr Modell neu bereitzustellen.

Pay-per-Token, bereitgestellter Durchsatz und Managed Compute teilen sich einen einzigen Endpunkt, dieselben SDKs, dieselbe Authentifizierung, dieselbe Beobachtbarkeit und eine einzige Rechnung. Open-Source-Modelle integrieren sich auf dieselbe Weise in Foundry Agents wie Frontier-Modelle. Managed Compute bietet globale Bereitstellungen für größte Kapazität und beste Preise sowie Data Zone-Bereitstellungen für Datenresidenz und Souveränität.

Warum Hugging Face

Hugging Face ist der öffentliche Platz der offenen KI: 15 Millionen Entwickler, 400.000 Organisationen und über 3 Millionen veröffentlichte offene Modelle. Neue Frontier-Fähigkeiten – agentisches Codieren, Videosegmentierung, Sprache, Embeddings – landen wöchentlich. Offene Modelle haben die Lücke zu proprietären Modellen in Benchmark nach Benchmark geschlossen und ermöglichen Fähigkeiten, die proprietäre Endpunkte nicht bieten können:

  • State-of-the-Art ist jetzt offen. Führende Open-Weight-Modelle sind mit den besten geschlossenen Frontier-Modellen in weit verbreiteten Benchmarks konkurrenzfähig.

  • Tiefe Anpassung. Vollständige Gewichte ermöglichen Feintuning, Destillation, Quantisierung und LoRA-Adaption.

  • Ihr Modell, Ihr Hosting. Gewichte laufen in Ihrem Mandanten auf Infrastruktur, die Sie kontrollieren.

  • Kostengestaltung. Bezahlen Sie Beschleuniger pro Stunde, skalieren Sie auf Null bei Inaktivität und wählen Sie die richtige GPU-Größe.

  • Versionskontrolle. Fixieren Sie eine bestimmte Modellversion, evaluieren Sie, stellen Sie bereit und führen Sie Rollbacks in Ihrem eigenen Release-Zyklus durch.

Der Haken war immer die operative Ebene: Entdeckung, Lizenzprüfung, Sicherheitsscreening, Laufzeitauswahl, GPU-Größenbestimmung, Image-Erstellung, CVE-Patching und das Aufsetzen des Modells hinter einem unternehmensgerechten Endpunkt. Hugging Face allein ist keine Enterprise-Serving-Plattform.

Hugging-Face-Modelle auf Foundry sind diese operative Ebene, betrieben von Microsoft.

Hugging-Face-Modelle auf Foundry

Die Hugging-Face-Sammlung bringt eine kuratierte Teilmenge von Modellen direkt in den Foundry-Modellkatalog:

  • Wöchentlich aktualisiert – Trendmodelle werden kontinuierlich hinzugefügt, sobald die Community sie veröffentlicht.

  • Jede Modalität – Text, Vision, Audio und multimodal: LLMs, VLMs, ASR, Sprachübersetzung, Embeddings, Segmentierung, Bildgenerierung.

  • Nur Safetensors, kein ungeprüfter Code – jedes Modell wird sicherheitsgeprüft und im SafeTensors-Gewichtsformat ausgeliefert, ohne trust_remote_code-Ausführungspfade, es sei denn, sie wurden streng geprüft.

  • Die richtige Laufzeit für das Modell – vLLM und SGLang für LLMs, TensorRT-LLM und NIM wo anwendbar, TEI für Embeddings, llama.cpp für CPU.

Aus Ihrer Sicht sieht ein Open-Weight-Modell in der Hugging-Face-Sammlung aus und verhält sich wie jedes andere Modell im Foundry-Modellkatalog. Jedes Modell durchläuft eine mehrstufige Veröffentlichungspipeline, bevor es dort erscheint.

Die Kuratierungspipeline

Hugging Face und Microsoft arbeiten zusammen, um die beliebtesten Open-Weight-Modelle zu Microsoft Foundry zu bringen – produktionsreif für Unternehmensumgebungen – durch einen systematischen Kuratierungsprozess:

  • Identifizieren von Trendmodellen im Hugging-Face-Ökosystem basierend auf Community-Signalen, Partneranfragen und Kundennachfrage.

  • Prüfung auf Compliance und Sicherheit – Modelllizenzen werden im Hinblick auf die Enterprise-Distributionsrichtlinie von Microsoft überprüft, und Repositories werden auf trust_remote_code-Muster und benutzerdefinierten ausführbaren Code untersucht.

  • Erstellen, Scannen und Veröffentlichen von Laufzeiten – Microsoft erstellt Inferenz-Container-Images auf unterstützten Laufzeiten, scannt sie auf Schwachstellen und veröffentlicht sie als bereitstellungsbereite Angebote.

Diese Pipeline stellt sicher, dass jedes Modell in der Hugging-Face-Sammlung die Unternehmensstandards für Sicherheit, Lizenzierung und Leistung erfüllt. Während sich das Open-Source-KI-Ökosystem weiterentwickelt, werden Microsoft und Hugging Face die Sammlung mit den neuesten Community-Innovationen aktualisieren und Entwicklern einen vertrauenswürdigen Weg vom Experiment zur Produktion bieten.