Zum Hauptinhalt springen
Cloud / Azure / Produkte / Foundry Local - Lokale KI auf dem Endgerät

Foundry Local - Lokale KI auf dem Endgerät

Foundry Local: Cross-Plattform KI-Runtime, die Modelle on-device via ONNX Runtime ausführt. OpenAI-kompatible API, ohne Cloud, Latenz oder Token-Kosten.

ai-machine-learning
Preismodell Kostenlos, keine Token-Kosten
Verfügbarkeit Läuft on-device, weltweit inkl. EU, keine Azure-Region nötig
Datensouveränität Daten verlassen das Gerät nicht
Zuverlässigkeit N/A (lokale Ausführung ohne Service-SLA) SLA

Was ist Foundry Local?

Foundry Local ist eine End-to-End-Lösung von Microsoft, um KI-Anwendungen zu entwickeln, die vollständig auf dem Endgerät des Nutzers laufen. Die lokale KI-Runtime übernimmt Modellbezug, Hardware-Beschleunigung, Modellverwaltung und Inferenz über ONNX Runtime. Die Runtime fügt der Anwendung nur rund 20 MB hinzu und führt die Inferenz direkt im Prozess aus. Damit lässt sich KI dort einbetten, wo Paketgröße, Datenschutz und Offline-Fähigkeit zählen.

Foundry Local löst ein konkretes Problem: KI-Funktionen lassen sich in Client-Anwendungen integrieren, ohne dass Daten in die Cloud übertragen werden, ohne Netzwerklatenz und ohne Kosten pro Token. Eine Azure-Subscription ist nicht erforderlich. Die Antworten starten unmittelbar, und die Anwendung funktioniert auch offline. Für Inferenz auf eigener Infrastruktur im Unternehmensmaßstab mit Kubernetes-nativem Betrieb gibt es separat Foundry Local on Azure Local.

Kernfunktionen

  • Schlanke On-Device-Runtime: Die Runtime auf Basis von ONNX Runtime übernimmt Modellbezug, Hardware-Beschleunigung und Inferenz im Anwendungsprozess und fügt dem App-Paket nur etwa 20 MB hinzu.
  • OpenAI-kompatible API: Foundry Local unterstützt OpenAI-konforme Request- und Response-Formate inklusive des OpenAI Responses API-Formats, sodass bestehende OpenAI-SDK-Anwendungen mit minimalen Codeänderungen weiterverwendet werden können.
  • Automatische Hardware-Beschleunigung: Foundry Local erkennt die verfügbare Hardware und wählt den besten Execution Provider über CPU, GPU und NPU, mit nahtlosem Fallback auf die CPU. Updates für Execution Provider und Treiber werden automatisch verwaltet.
  • Kuratierter Modellkatalog: Ein versionierter Katalog quantisierter, für den On-Device-Einsatz optimierter Modelle deckt Chat-Completions (etwa GPT OSS, Qwen, DeepSeek, Mistral, Phi) und Audio-Transkription (etwa Whisper) ab. Modelle laden beim ersten Einsatz herunter und werden lokal zwischengespeichert.

Typische Anwendungsfälle

KI in Client-Anwendungen einbetten: Entwickler integrieren KI-Funktionen direkt in Desktop-Anwendungen über das SDK für C#, JavaScript, Python oder Rust. Die Inferenz läuft im Anwendungsprozess, ohne separates Backend und ohne Cloud-Abhängigkeit.

Verarbeitung sensibler Daten auf dem Gerät: Anwendungen verarbeiten Audio, Text oder Bilder lokal, sodass die Daten das Gerät nicht verlassen. Das eignet sich für Szenarien mit strengen Datenschutz- und Compliance-Anforderungen.

Offline- und Edge-Szenarien: In Umgebungen mit eingeschränkter oder fehlender Konnektivität liefert Foundry Local KI-Funktionen ohne Netzwerkzugriff. Für die eigentliche Inferenz ist nach dem ersten Modell-Download keine Verbindung nötig.

Vorteile

  • Keine Token-Kosten und keine Azure-Subscription erforderlich.
  • Daten bleiben auf dem Gerät, mit unmittelbarem Start der Antworten und ohne Netzwerklatenz.
  • Plattformübergreifend für Windows, macOS (Apple Silicon) und Linux, mit automatischer Auswahl der besten Hardware.

Integration mit innFactory

Als Microsoft Solutions Partner unterstützt innFactory Sie bei Einführung und Betrieb dieses Service.

Typische Anwendungsfälle

KI-Funktionen in Desktop-Apps ohne Cloud-Backend einbetten
Verarbeitung sensibler Daten (Audio, Text, Bilder) direkt auf dem Gerät
Offline- und Edge-Szenarien mit eingeschränkter Konnektivität
Token-Kosten cloudbasierter Inferenz senken

Häufig gestellte Fragen

Was ist Foundry Local?

Foundry Local ist eine End-to-End-Lösung von Microsoft, um KI-Modelle vollständig auf dem Endgerät des Nutzers auszuführen. Sie kombiniert eine schlanke Runtime auf Basis von ONNX Runtime, ein kuratiertes Modellkatalog und ein SDK für C#, JavaScript, Python und Rust. Daten verlassen das Gerät nicht, und es entstehen keine Token-Kosten.

Wann sollte ich Foundry Local einsetzen?

Foundry Local eignet sich, wenn sensible Daten auf dem Gerät bleiben müssen, wenn Anwendungen offline oder bei eingeschränkter Konnektivität funktionieren sollen, wenn Sie geringe Latenz für Echtzeit-Interaktionen benötigen oder wenn Sie Token-Kosten cloudbasierter Inferenz reduzieren wollen. Es ist auf Einzelnutzer-Szenarien auf Client-Geräten ausgelegt.

Was kostet Foundry Local?

Foundry Local verursacht keine Token-Kosten und benötigt keine Azure-Subscription. Die Modelle laufen vollständig auf lokaler Hardware. Für die Nutzung gelten die Produktbedingungen und Lizenzen der Software sowie der jeweils verwendeten Modelle.

Auf welchen Plattformen läuft Foundry Local und ist es OpenAI-kompatibel?

Foundry Local unterstützt Windows, macOS (Apple Silicon) und Linux und nutzt automatisch die beste verfügbare Hardware (CPU, GPU oder NPU). Die Runtime stellt eine OpenAI-kompatible API bereit, inklusive des OpenAI Responses API-Formats. Bestehende OpenAI-SDK-Anwendungen lassen sich mit minimalen Anpassungen auf einen Foundry-Local-Endpunkt umstellen.

Hinweis: Alle Produktinformationen auf dieser Seite wurden sorgfältig zusammengestellt, sind jedoch ohne Gewähr und können veraltet oder unvollständig sein. Cloud-Services entwickeln sich schnell weiter — Funktionen, Preise, SLAs und Verfügbarkeit ändern sich laufend. Verbindliche und aktuelle Informationen finden Sie ausschließlich auf der offiziellen Produktseite von Azure (offizielle Dokumentation). Diese Seite stellt kein Angebot von Azure dar.

Microsoft Solutions Partner

innFactory ist Microsoft Solutions Partner. Wir bieten Beratung, Implementierung und Managed Services für Azure.

Microsoft Solutions Partner Microsoft Data & AI

Ähnliche Produkte anderer Cloud-Anbieter

Andere Cloud-Anbieter bieten vergleichbare Services in dieser Kategorie. Als Multi-Cloud Partner helfen wir bei der richtigen Wahl.

Google Cloud

Agent Platform Workbench (ehem. Vertex AI Workbench)

Agent Platform Workbench stellt verwaltete JupyterLab-Umgebungen der Gemini Enterprise Agent Platform bereit, mit …

Preismodell Nutzungsbasiert über die Preisliste der …
SLA SLA gemäß Anbieter (siehe offizielle SLA-Seite)
Vergleichen →
Google Cloud

Cloud Talent Solution - Jobsuche mit Machine Learning

Cloud Talent Solution bringt Machine Learning in die Jobsuche und unterstützt Recruiting-Plattformen mit Job Search und …

Preismodell Preise mit Stand 5. Januar 2021: …
SLA gemäß Anbieter / siehe offizielle Dokumentation
Vergleichen →
Google Cloud

Deep Learning VM Images - Vorkonfigurierte ML-VM-Images

Deep Learning VM Images sind für Data Science und Machine Learning optimierte VM-Images mit vorinstallierten Frameworks …

Preismodell Die Images selbst sind laut Preisseite …
SLA SLA gemäß Anbieter (siehe offizielle SLA-Seite)
Vergleichen →
Google Cloud

Enterprise Knowledge Graph - Entity Reconciliation für BigQuery

Enterprise Knowledge Graph führt verteilte Daten über Entity Reconciliation zusammen und ergänzt sie über die Google …

Preismodell Für Enterprise Knowledge Graph …
SLA Pre-GA-Produkte werden laut Dokumentation "as is" bereitgestellt und können eingeschränkten Support haben; gemäß Anbieter / siehe offizielle Dokumentation
Vergleichen →
Google Cloud

Genkit - Open-Source-Framework für KI-Anwendungen

Genkit ist Googles Open-Source-Framework für den Aufbau von Full-Stack-, KI- und Agenten-Anwendungen mit TypeScript, Go, …

Preismodell Open-Source-Framework; Kosten entstehen …
SLA Für das Framework selbst besteht kein SLA; SLAs gelten für die genutzten Dienste gemäß Anbieter
Vergleichen →
Google Cloud

Model Garden - Modellkatalog der Agent Platform

Model Garden ist die Modellbibliothek der Gemini Enterprise Agent Platform zum Entdecken, Testen, Anpassen und …

Preismodell Bei Open-Source-Modellen werden Tuning …
SLA SLA gemäß Anbieter (siehe offizielle SLA-Seite)
Vergleichen →

89 vergleichbare Produkte bei anderen Cloud-Anbietern gefunden.

Bereit, mit Foundry Local - Lokale KI auf dem Endgerät zu starten?

Unsere zertifizierten Azure Experten helfen bei Architektur, Integration und Optimierung.

Beratung vereinbaren