Zum Hauptinhalt springen
Cloud / Azure / Produkte / Phi Open Models - Kleine Sprachmodelle von Microsoft

Phi Open Models - Kleine Sprachmodelle von Microsoft

Microsoft Phi Open Models sind kompakte, effiziente Sprachmodelle für KI-Anwendungen, aktuell u.a. Phi-4 und Phi-4-Reasoning-Varianten.

ai-machine-learning
Preismodell Open Weights kostenlos herunterladbar; gehostet über Microsoft Foundry nach Token-Nutzung oder Compute-Stunden
Verfügbarkeit Microsoft Foundry verfügbar
Datensouveränität EU-Regionen verfügbar
Zuverlässigkeit SLA gemäß Anbieter (siehe offizielle SLA-Seite) SLA

Was sind Microsoft Phi Modelle?

Microsoft Phi ist eine Familie kleiner Sprachmodelle (Small Language Models, SLMs), die bei kompakter Größe überraschend hohe Leistung bieten. Im Gegensatz zu großen LLMs sind Phi-Modelle für Szenarien optimiert, in denen Ressourceneffizienz, Latenz oder Datenschutz wichtiger sind als maximale Allround-Fähigkeiten.

Die aktuelle Generation umfasst Phi-4 sowie darauf aufbauende Reasoning-Varianten wie Phi-4-reasoning, Phi-4-reasoning-plus, Phi-4-mini-reasoning und Phi-4-mini-flash-reasoning für latenzkritische Edge-Szenarien sowie Phi-4-reasoning-vision für multimodale Aufgaben. Die Modelle sind als Open Weights über Hugging Face, im Microsoft-Foundry-Modellkatalog (vormals Azure AI Studio / Azure AI Foundry) sowie als lokal ausführbare Varianten über Microsoft Foundry Local verfügbar.

Die Modelle eignen sich für Edge-Deployment, mobile Apps oder Szenarien mit begrenzter GPU-Kapazität, in denen ein kompaktes, aber leistungsfähiges Modell benötigt wird.

Kernfunktionen

  • Kompakte Modellgrößen im niedrigen bis mittleren einstelligen Milliarden-Parameter-Bereich (z. B. Phi-4-mini) bis hin zu Phi-4 mit rund 14 Milliarden Parametern
  • Spezialisierte Reasoning-Varianten für Mathematik, mehrstufige Problemlösung und agentische Anwendungsfälle
  • Verfügbar im Microsoft-Foundry-Modellkatalog und als Open Weights
  • Lokale Ausführung über ONNX-Exporte und Microsoft Foundry Local
  • Multimodale Varianten für Text, Bild und visuelles Reasoning

Typische Anwendungsfälle

Edge AI: Deployment von Sprachmodellen auf Geräten mit begrenzten Ressourcen wie IoT-Gateways oder lokalen Servern.

Mobile Anwendungen: KI-Funktionen in Apps ohne Cloud-Roundtrip für bessere Latenz und Offline-Fähigkeit.

Reasoning-intensive Aufgaben: Mathematische Problemlösung, Tutoring-Anwendungen und agentische Workflows mit den Phi-4-Reasoning-Varianten bei geringerem Ressourcenbedarf als große Foundation Models.

Vorteile

  • Deutlich geringere Inference-Kosten als große LLMs
  • Schnellere Antwortzeiten durch kompakte Größe
  • Lokale Ausführung möglich für Datenschutz und Offline-Betrieb
  • Open Weights für Customization und eigenes Hosting verfügbar

Häufig gestellte Fragen

Wie unterscheiden sich Phi-Modelle von großen Foundation Models?

Phi-Modelle sind deutlich kleiner und ressourcenschonender, aber bei sehr breiten oder hochkomplexen Aufgaben tendenziell weniger vielseitig. Sie eignen sich besonders für fokussierte Anwendungsfälle wie Reasoning, Edge-Deployment oder mobile Szenarien.

Kann ich Phi-Modelle lokal ausführen?

Ja, Phi-Modelle stehen als Open Weights und ONNX-Exporte zur Verfügung und können über Microsoft Foundry Local oder eigene Infrastruktur ohne Cloud-Verbindung ausgeführt werden.

Was kostet die Nutzung von Phi-Modellen?

Die Modellgewichte können kostenlos heruntergeladen und selbst gehostet werden. Wer die Modelle über Microsoft Foundry als verwalteten Dienst nutzt, zahlt je nach Bereitstellungsart nach Token-Nutzung oder nach Compute-Stunden für dedizierte Endpoints.

Welche Modellvarianten sind aktuell verfügbar?

Die Phi-Familie umfasst aktuell u. a. Phi-4, die Reasoning-Varianten Phi-4-reasoning, Phi-4-reasoning-plus und Phi-4-mini-reasoning, das latenzoptimierte Phi-4-mini-flash-reasoning sowie Phi-4-reasoning-vision für multimodale Aufgaben. Die genaue Modellauswahl im Katalog ändert sich mit neuen Releases.

Wie nutze ich Phi in Azure?

Phi-Modelle sind über den Microsoft-Foundry-Modellkatalog verfügbar und können als Serverless-Endpoint nach Token-Nutzung oder als Managed-Compute-Deployment bereitgestellt werden.

Integration mit innFactory

Als Microsoft Solutions Partner unterstützt innFactory Sie bei Phi-Modellen: Evaluierung für Ihren Use Case, Fine-Tuning, Edge-Deployment und Integration in bestehende Anwendungen.

Typische Anwendungsfälle

Edge-KI-Anwendungen
Ressourceneffiziente Inferenz
Mobile KI-Lösungen
On-Device Language Models

Hinweis: Alle Produktinformationen auf dieser Seite wurden sorgfältig zusammengestellt, sind jedoch ohne Gewähr und können veraltet oder unvollständig sein. Cloud-Services entwickeln sich schnell weiter — Funktionen, Preise, SLAs und Verfügbarkeit ändern sich laufend. Verbindliche und aktuelle Informationen finden Sie ausschließlich auf der offiziellen Produktseite von Azure (offizielle Dokumentation). Diese Seite stellt kein Angebot von Azure dar.

Schnellzugriff

Microsoft Solutions Partner

innFactory ist Microsoft Solutions Partner. Wir bieten Beratung, Implementierung und Managed Services für Azure.

Microsoft Solutions Partner Microsoft Data & AI

Ähnliche Produkte anderer Cloud-Anbieter

Andere Cloud-Anbieter bieten vergleichbare Services in dieser Kategorie. Als Multi-Cloud Partner helfen wir bei der richtigen Wahl.

Google Cloud

Agent Development Kit (ADK) - Multi-Agent-Framework

Agent Development Kit (ADK): Open-Source-Framework von Google für den Bau, das Testen und Deployment von Single- und …

Preismodell Kostenlos / Open Source (Apache 2.0); …
SLA N/A (Framework); SLA abhängig vom gewählten Deployment-Ziel
Vergleichen →
Google Cloud

Agent Search (ex Vertex AI Search) - KI-Unternehmenssuche

Agent Search, ehemals Vertex AI Search, bietet KI-gestützte Unternehmenssuche mit natürlicher Sprache und semantischem …

Preismodell Bezahlung nach Nutzung (u.a. pro Query …
SLA SLA gemäß Anbieter (siehe offizielle SLA-Seite)
Vergleichen →
Google Cloud

Agent Studio - KI-Agenten für Unternehmen (ex Agent Builder)

Agent Studio (ehemals Vertex AI Agent Builder) erstellt KI-Agenten mit RAG und Grounding auf Unternehmensdaten in der …

Preismodell Bezahlung nach Nutzung
SLA SLA gemäß Anbieter (siehe offizielle SLA-Seite)
Vergleichen →
Google Cloud

Agent Studio (ex Vertex AI) - Generative KI-Entwicklung

Agent Studio, ehemals Vertex AI Studio, ist Googles Workspace für generative KI: Prompt-Design, Model-Tuning und …

Preismodell Bezahlung nach Nutzung
SLA SLA gemäß Anbieter (siehe offizielle SLA-Seite)
Vergleichen →
AWS

Amazon Augmented AI (A2I) - Menschliche Überprüfung für ML

Amazon Augmented AI (A2I) ermöglicht menschliche Überprüfung von ML-Vorhersagen. Human-in-the-Loop-Workflows für …

Preismodell Pay-per-Use: Bezahlung pro menschlicher …
SLA SLA gemäß Anbieter (siehe offizielle SLA-Seite, A2I ist Teil von Amazon SageMaker AI)
Vergleichen →
AWS

Amazon Bedrock AgentCore - Runtime für KI-Agenten

Amazon Bedrock AgentCore: serverlose Runtime und Services, um produktive KI-Agenten sicher zu betreiben, zu skalieren …

Preismodell Pay-per-use (verbrauchsbasiert, …
SLA N/A
Vergleichen →

74 vergleichbare Produkte bei anderen Cloud-Anbietern gefunden.

Bereit, mit Phi Open Models - Kleine Sprachmodelle von Microsoft zu starten?

Unsere zertifizierten Azure Experten helfen bei Architektur, Integration und Optimierung.

Beratung vereinbaren