Ein produktiver Agent in Microsoft Foundry verursacht je nach Architektur Kosten für Modelle, Werkzeuge, Wissensquellen, Suche, Hosting, Daten, Netzwerk und Überwachung. Die Plattform ist nicht mit einem einzigen Preis pro Nutzer beschrieben.
Prüfstand: 8. September 2026. Microsoft bezeichnet Azure AI Foundry inzwischen als Microsoft Foundry. Preise sind regions-, währungs-, modell- und vertragsabhängig. Frühere feste West-Europe-Beträge, CHF-Beispiele, Personalaufwände und Einsparungsprozente in diesem Artikel waren nicht vollständig durch stabile Primärquellen belegt und wurden entfernt. Verwenden Sie die offizielle Foundry-Preisseite und den Azure-Preisrechner für Ihre Subscription.
Welche Zähler relevant sind
| Komponente | Typische Abrechnung |
|---|---|
| Modell-Inferenz | Eingabe-/Ausgabe-Tokens oder bereitgestellter Durchsatz |
| Agent Service | genutzte Modelle und Tools; gegebenenfalls gehostete Agent-Ressourcen |
| File Search | Vektorspeicher |
| Code Interpreter | Session |
| Web-/Custom Search | Transaktionen |
| Foundry IQ / Azure AI Search | gewählte Suchkapazität und Zusatzfunktionen |
| Anwendungs-Hosting | Compute-Plan oder serverloser Verbrauch |
| Daten und Netzwerk | Speicher, Datenbank, Backup und Transfer |
| Überwachung | ingestierte und aufbewahrte Telemetrie |
| Betrieb | Engineering, Evaluation, Security und Support |
Die Preisseite des Foundry Agent Service erklärt ausdrücklich, dass Modelle, Tools und Wissensverbindungen separate Kosten und teilweise separate Lizenzen auslösen können. Die Foundry-FAQ hält fest, dass für die Agent-Service-Nutzung die Modellquoten gelten.
Belastbare Formel
Monatskosten = Agent-Turns × tatsächliche Modell- und Tool-Nutzung + bereitgestellte Kapazität + Hosting + Daten + Netzwerk + Monitoring + Betriebsaufwand.
Messen Sie im Pilot mindestens:
- Eingabe- und Ausgabe-Tokens je erfolgreichem Turn,
- Zahl und Art der Tool-Aufrufe,
- Suchabfragen und Indexgrösse,
- Wiederholungen und Fehlerpfade,
- Spitzenlast und Latenz,
- Logvolumen und Aufbewahrung,
- menschlichen Aufwand für Evaluation, Freigabe und Betrieb.
Ein pauschaler «Harness-Multiplikator», Wiederholungsanteil oder Einsparungsprozentsatz ist kein Herstellerpreis und darf ohne Projektdaten nicht als Fakt in die Rechnung eingehen.
Datenresidenz und Purview
Eine Azure-Region allein beweist nicht, dass alle Daten eines Agenten dort verbleiben. Modelle, Suchdienste, verbundene Wissensquellen, Tools, Logs und globale Funktionen können unterschiedliche Verfügbarkeiten und Datenverarbeitungsbedingungen haben. Prüfen Sie jede Ressource gegen Azure Products by Region, die Produktbedingungen und Ihre Architektur.
Microsoft Purview kann Governance- und Compliance-Funktionen für Microsoft Foundry unterstützen; Umfang und Lizenzbedarf sind jedoch funktionsabhängig. Die Purview-Übersicht für generative KI ist der Startpunkt. «Foundry in West Europe» ist weder ein Purview-Nachweis noch automatisch eine Compliance-Zusage.
Kostenhebel, die gemessen werden können
- 1passendes Modell je Aufgabe statt eines Modells für alles,
- 2begrenzter Kontext und kontrollierte Antwortlänge,
- 3Tool-Aufrufe nur bei fachlichem Bedarf,
- 4Cache nur für geeignete, berechtigungsgeprüfte Antworten,
- 5Suchkapazität nach Lasttest dimensionieren,
- 6Budgets und Alerts pro Ressourcengruppe,
- 7Evaluation von Qualität und Kosten vor jeder Modell- oder Promptänderung.
Fazit
Foundry bietet feingranulare Architektur- und Verbrauchsoptionen. Genau deshalb gibt es keinen seriösen universellen Monatsbetrag für 100, 500 oder 1'000 Nutzende. Exportieren Sie echte Meterdaten und rechnen Sie Infrastruktur, Lizenzen und Personenaufwand gemeinsam.
Agentic AI Services · Kontakt aufnehmen →
Quellen, abgerufen am 8. September 2026: Microsoft Foundry Preise · Foundry Agent Service Preise · Foundry Agent Service FAQ · Azure Products by Region · Microsoft Purview für generative KI

