Zum Hauptinhalt springen
Cloud / Azure / Produkte / Phi Open Models - Kleine Sprachmodelle von Microsoft

Phi Open Models - Kleine Sprachmodelle von Microsoft

Microsoft Phi Open Models sind kompakte, effiziente Sprachmodelle für KI-Anwendungen, aktuell u.a. Phi-4 und Phi-4-Reasoning-Varianten.

ai-machine-learning
Preismodell Open Weights kostenlos herunterladbar; gehostet über Microsoft Foundry nach Token-Nutzung oder Compute-Stunden
Verfügbarkeit Microsoft Foundry verfügbar
Datensouveränität EU-Regionen verfügbar
Zuverlässigkeit SLA gemäß Anbieter (siehe offizielle SLA-Seite) SLA

Was sind Microsoft Phi Modelle?

Microsoft Phi ist eine Familie kleiner Sprachmodelle (Small Language Models, SLMs), die bei kompakter Größe überraschend hohe Leistung bieten. Im Gegensatz zu großen LLMs sind Phi-Modelle für Szenarien optimiert, in denen Ressourceneffizienz, Latenz oder Datenschutz wichtiger sind als maximale Allround-Fähigkeiten.

Die aktuelle Generation umfasst Phi-4 sowie darauf aufbauende Reasoning-Varianten wie Phi-4-reasoning, Phi-4-reasoning-plus, Phi-4-mini-reasoning und Phi-4-mini-flash-reasoning für latenzkritische Edge-Szenarien sowie Phi-4-reasoning-vision für multimodale Aufgaben. Die Modelle sind als Open Weights über Hugging Face, im Microsoft-Foundry-Modellkatalog (vormals Azure AI Studio / Azure AI Foundry) sowie als lokal ausführbare Varianten über Microsoft Foundry Local verfügbar.

Die Modelle eignen sich für Edge-Deployment, mobile Apps oder Szenarien mit begrenzter GPU-Kapazität, in denen ein kompaktes, aber leistungsfähiges Modell benötigt wird.

Kernfunktionen

  • Kompakte Modellgrößen im niedrigen bis mittleren einstelligen Milliarden-Parameter-Bereich (z. B. Phi-4-mini) bis hin zu Phi-4 mit rund 14 Milliarden Parametern
  • Spezialisierte Reasoning-Varianten für Mathematik, mehrstufige Problemlösung und agentische Anwendungsfälle
  • Verfügbar im Microsoft-Foundry-Modellkatalog und als Open Weights
  • Lokale Ausführung über ONNX-Exporte und Microsoft Foundry Local
  • Multimodale Varianten für Text, Bild und visuelles Reasoning

Typische Anwendungsfälle

Edge AI: Deployment von Sprachmodellen auf Geräten mit begrenzten Ressourcen wie IoT-Gateways oder lokalen Servern.

Mobile Anwendungen: KI-Funktionen in Apps ohne Cloud-Roundtrip für bessere Latenz und Offline-Fähigkeit.

Reasoning-intensive Aufgaben: Mathematische Problemlösung, Tutoring-Anwendungen und agentische Workflows mit den Phi-4-Reasoning-Varianten bei geringerem Ressourcenbedarf als große Foundation Models.

Vorteile

  • Deutlich geringere Inference-Kosten als große LLMs
  • Schnellere Antwortzeiten durch kompakte Größe
  • Lokale Ausführung möglich für Datenschutz und Offline-Betrieb
  • Open Weights für Customization und eigenes Hosting verfügbar

Häufig gestellte Fragen

Wie unterscheiden sich Phi-Modelle von großen Foundation Models?

Phi-Modelle sind deutlich kleiner und ressourcenschonender, aber bei sehr breiten oder hochkomplexen Aufgaben tendenziell weniger vielseitig. Sie eignen sich besonders für fokussierte Anwendungsfälle wie Reasoning, Edge-Deployment oder mobile Szenarien.

Kann ich Phi-Modelle lokal ausführen?

Ja, Phi-Modelle stehen als Open Weights und ONNX-Exporte zur Verfügung und können über Microsoft Foundry Local oder eigene Infrastruktur ohne Cloud-Verbindung ausgeführt werden.

Was kostet die Nutzung von Phi-Modellen?

Die Modellgewichte können kostenlos heruntergeladen und selbst gehostet werden. Wer die Modelle über Microsoft Foundry als verwalteten Dienst nutzt, zahlt je nach Bereitstellungsart nach Token-Nutzung oder nach Compute-Stunden für dedizierte Endpoints.

Welche Modellvarianten sind aktuell verfügbar?

Die Phi-Familie umfasst aktuell u. a. Phi-4, die Reasoning-Varianten Phi-4-reasoning, Phi-4-reasoning-plus und Phi-4-mini-reasoning, das latenzoptimierte Phi-4-mini-flash-reasoning sowie Phi-4-reasoning-vision für multimodale Aufgaben. Die genaue Modellauswahl im Katalog ändert sich mit neuen Releases.

Wie nutze ich Phi in Azure?

Phi-Modelle sind über den Microsoft-Foundry-Modellkatalog verfügbar und können als Serverless-Endpoint nach Token-Nutzung oder als Managed-Compute-Deployment bereitgestellt werden.

Integration mit innFactory

Als Microsoft Solutions Partner unterstützt innFactory Sie bei Phi-Modellen: Evaluierung für Ihren Use Case, Fine-Tuning, Edge-Deployment und Integration in bestehende Anwendungen.

Typische Anwendungsfälle

Edge-KI-Anwendungen
Ressourceneffiziente Inferenz
Mobile KI-Lösungen
On-Device Language Models

Hinweis: Alle Produktinformationen auf dieser Seite wurden sorgfältig zusammengestellt, sind jedoch ohne Gewähr und können veraltet oder unvollständig sein. Cloud-Services entwickeln sich schnell weiter — Funktionen, Preise, SLAs und Verfügbarkeit ändern sich laufend. Verbindliche und aktuelle Informationen finden Sie ausschließlich auf der offiziellen Produktseite von Azure (offizielle Dokumentation). Diese Seite stellt kein Angebot von Azure dar.

Schnellzugriff

Microsoft Solutions Partner

innFactory ist Microsoft Solutions Partner. Wir bieten Beratung, Implementierung und Managed Services für Azure.

Microsoft Solutions Partner Microsoft Data & AI

Ähnliche Produkte anderer Cloud-Anbieter

Andere Cloud-Anbieter bieten vergleichbare Services in dieser Kategorie. Als Multi-Cloud Partner helfen wir bei der richtigen Wahl.

Google Cloud

Agent Platform Workbench (ehem. Vertex AI Workbench)

Agent Platform Workbench stellt verwaltete JupyterLab-Umgebungen der Gemini Enterprise Agent Platform bereit, mit …

Preismodell Nutzungsbasiert über die Preisliste der …
SLA SLA gemäß Anbieter (siehe offizielle SLA-Seite)
Vergleichen →
Google Cloud

Cloud Talent Solution - Jobsuche mit Machine Learning

Cloud Talent Solution bringt Machine Learning in die Jobsuche und unterstützt Recruiting-Plattformen mit Job Search und …

Preismodell Preise mit Stand 5. Januar 2021: …
SLA gemäß Anbieter / siehe offizielle Dokumentation
Vergleichen →
Google Cloud

Deep Learning VM Images - Vorkonfigurierte ML-VM-Images

Deep Learning VM Images sind für Data Science und Machine Learning optimierte VM-Images mit vorinstallierten Frameworks …

Preismodell Die Images selbst sind laut Preisseite …
SLA SLA gemäß Anbieter (siehe offizielle SLA-Seite)
Vergleichen →
Google Cloud

Enterprise Knowledge Graph - Entity Reconciliation für BigQuery

Enterprise Knowledge Graph führt verteilte Daten über Entity Reconciliation zusammen und ergänzt sie über die Google …

Preismodell Für Enterprise Knowledge Graph …
SLA Pre-GA-Produkte werden laut Dokumentation "as is" bereitgestellt und können eingeschränkten Support haben; gemäß Anbieter / siehe offizielle Dokumentation
Vergleichen →
Google Cloud

Genkit - Open-Source-Framework für KI-Anwendungen

Genkit ist Googles Open-Source-Framework für den Aufbau von Full-Stack-, KI- und Agenten-Anwendungen mit TypeScript, Go, …

Preismodell Open-Source-Framework; Kosten entstehen …
SLA Für das Framework selbst besteht kein SLA; SLAs gelten für die genutzten Dienste gemäß Anbieter
Vergleichen →
Google Cloud

Model Garden - Modellkatalog der Agent Platform

Model Garden ist die Modellbibliothek der Gemini Enterprise Agent Platform zum Entdecken, Testen, Anpassen und …

Preismodell Bei Open-Source-Modellen werden Tuning …
SLA SLA gemäß Anbieter (siehe offizielle SLA-Seite)
Vergleichen →

89 vergleichbare Produkte bei anderen Cloud-Anbietern gefunden.

Bereit, mit Phi Open Models - Kleine Sprachmodelle von Microsoft zu starten?

Unsere zertifizierten Azure Experten helfen bei Architektur, Integration und Optimierung.

Beratung vereinbaren