Claude Platform Docs
MessagesClaude auf Cloud-Plattformen

Claude in Microsoft Foundry

Greife über Microsoft Foundry mit Azure-nativen Endpunkten und Authentifizierung auf Claude-Modelle zu.

Diese Anleitung zeigt dir, wie du Claude in Microsoft Foundry einrichtest und API-Aufrufe mit einem der Client-SDKs von Anthropic oder mit direkten HTTP-Anfragen durchführst. Wenn du Claude in Microsoft Foundry nutzt, wird dir die Claude-Nutzung über den Azure Marketplace in Rechnung gestellt. Du kannst Claude-Modelle wie Claude Fable 5.1, Claude Opus 5.5, Claude Opus 5, Claude Opus 4.8, Claude Sonnet 5.5 und Claude Sonnet 5 sowie Funktionen wie das „context window" (Kontextfenster) mit 1M Token nutzen und dabei die Kosten über dein Azure-Abonnement verwalten.

Claude ist in den Bereitstellungstypen Global Standard und US Data Zone Standard in Foundry-Ressourcen verfügbar und wird in Claude Consumption Units über den Azure Marketplace abgerechnet. Details findest du unter Preise für Claude in Microsoft Foundry.

Hosting-Optionen

Claude-Modelle in Microsoft Foundry sind in zwei Hosting-Optionen verfügbar. Du wählst die Hosting-Option, wenn du das Deployment konfigurierst.

Hosted on AzureHosted on Anthropic
Wo die Inferenz läuftVon Anthropic betriebener Dienst auf Azure-InfrastrukturVon Anthropic betriebener Dienst auf Anthropic-Infrastruktur
ModellverfügbarkeitDie neuesten Modelle der Opus-, Sonnet- und Haiku-FamilienAlle auf Microsoft Foundry verfügbaren Claude-Modelle
BereitstellungstypenGlobal Standard, US Data Zone StandardGlobal Standard
Empfohlen fürDie meisten WorkloadsZugriff auf Funktionen oder Modelle, die noch nicht auf Azure gehostet werden

Claude Sonnet 5.5 unterstützt nur Global-Standard-Deployments.

Voraussetzungen

Bevor du beginnst, stelle sicher, dass du Folgendes hast:

  • Ein aktives Azure-Abonnement
  • Zugriff auf das Foundry-Portal
  • Die installierte Azure CLI (erforderlich für das Entra-ID-cURL-Beispiel, ansonsten optional)
  • Eine Azure-RBAC-Rolle, die dir die Nutzung der Ressource erlaubt, z. B. Foundry User (früher Azure AI User) oder Cognitive Services User

Ein SDK installieren

Die Client-SDKs von Anthropic unterstützen Foundry über ein plattformspezifisches Paket oder eine Client-Klasse. Die Beispiele auf dieser Seite zeigen auch Anfragen mit cURL und der ant CLI. Zur Einrichtung der CLI siehe CLI-Schnellstart.

pip install -U "anthropic"

# Für die Entra-ID-Authentifizierung installiere zusätzlich die Azure-Identity-Bibliothek
pip install azure-identity

Bereitstellung

Foundry verwendet eine zweistufige Hierarchie: Ressourcen enthalten deine Sicherheits- und Abrechnungskonfiguration, während Deployments die Modellinstanzen sind, die du über die API aufrufst. Du erstellst zuerst eine Foundry-Ressource und anschließend ein oder mehrere Claude-Deployments darin.

Foundry-Ressourcen bereitstellen

Erstelle eine Foundry-Ressource, die erforderlich ist, um Dienste in Azure zu nutzen und zu verwalten. Du kannst diesen Anweisungen folgen, um eine Foundry-Ressource zu erstellen. Alternativ kannst du mit dem Erstellen eines Foundry-Projekts beginnen, was das Erstellen einer Foundry-Ressource beinhaltet.

So stellst du deine Ressource bereit:

  1. Navigiere zum Foundry-Portal.
  2. Erstelle eine neue Foundry-Ressource oder wähle eine bestehende aus.
  3. Konfiguriere die Zugriffsverwaltung mit von Azure ausgestellten API-Keys oder Entra ID (früher Azure Active Directory) für rollenbasierte Zugriffskontrolle.
  4. Konfiguriere die Ressource optional als Teil eines privaten Netzwerks (Azure Virtual Network), um den Netzwerkzugriff auf deine Ressource einzuschränken.
  5. Notiere dir deinen Ressourcennamen. Du verwendest ihn als {resource} in API-Endpunkten (zum Beispiel https://{resource}.services.ai.azure.com/anthropic/v1/*).

Foundry-Deployments erstellen

Nachdem du deine Ressource erstellt hast, stelle ein Claude-Modell bereit, um es für API-Aufrufe verfügbar zu machen. Diese Schritte beschreiben das neue Foundry-Portal (der Schalter New Foundry ist aktiviert):

  1. Melde dich im Foundry-Portal an. Wähle auf der Startseite des Portals in der Navigation oben rechts Discover und dann im linken Bereich Models, um den Modellkatalog zu öffnen.
  2. Suche nach einem Claude-Modell und wähle es aus (zum Beispiel ). Jedes Modell erscheint nur einmal im Katalog, unabhängig davon, wie viele Hosting-Optionen es unterstützt.
  3. Wähle auf der Modellkarte Deploy und dann Custom settings, um den Bereich mit den Deployment-Einstellungen zu öffnen. Wenn du stattdessen Default settings wählst, wird das Deployment bei Modellen, die in beiden Hosting-Optionen verfügbar sind, automatisch als Hosted on Azure konfiguriert.
  4. Prüfe bei deinem ersten Claude-Deployment die Bedingungen des Azure Marketplace, wähle eine Branche aus und wähle Agree and Proceed, um die Bedingungen zu akzeptieren und das Angebot im Azure Marketplace zu abonnieren.
  5. Konfiguriere das Deployment:
    • Deployment name: Standardmäßig die Modell-ID, du kannst ihn aber anpassen (zum Beispiel my-claude-deployment). Der Deployment-Name kann nach der Erstellung nicht mehr geändert werden.
    • Region scope: Wähle Global oder, bei auf Azure gehosteten Modellen, Data Zone. Die Auswahl von Data Zone erstellt ein US-Data-Zone-Standard-Deployment, das die Inferenz innerhalb der Vereinigten Staaten hält und dem Setzen von inference_geo: "us" in der Claude API entspricht. Wähle für Claude Sonnet 5.5 Global aus.
    • Model version: Erweitere Model version settings und wähle eine Version aus dem Dropdown-Menü Model version. Jede Hosting-Option wird als separate Modellversion aufgeführt und mit ihrer Hosting-Option gekennzeichnet (zum Beispiel Version 1 für Hosted on Anthropic, Version 2 für Hosted on Azure).
  6. Wähle Deploy und warte, bis die Bereitstellung abgeschlossen ist.
  7. Wähle nach der Bereitstellung in der Navigation oben rechts Build, dann im linken Bereich Models und öffne dein Deployment. Der Tab Details zeigt die Target URI (deine Endpunkt-URL) und den Key (deinen API-Key).

Wenn der Schalter New Foundry deaktiviert ist, befindest du dich im klassischen Portal-Layout. Öffne dort im linken Bereich Model catalog, um ein Modell zu finden und bereitzustellen, und öffne Models + endpoints (unter My assets), um deine Deployments und deren Endpunktdetails anzuzeigen.

Authentifizierung

Claude in Microsoft Foundry unterstützt zwei Authentifizierungsmethoden: API-Keys und Entra-ID-Token. Beide Methoden verwenden auf Azure gehostete Endpunkte im Format https://{resource}.services.ai.azure.com/anthropic/v1/*.

Authentifizierung mit API-Key

Nachdem du deine Foundry-Claude-Ressource bereitgestellt hast, kannst du einen „API key“ (API-Key) im Foundry-Portal abrufen:

  1. Wähle im Foundry-Portal oben rechts in der Navigation Build und dann im linken Bereich Models.
  2. Öffne dein Claude-Deployment und wähle den Tab Details.
  3. Kopiere den Wert Key (und notiere dir die Target URI für deinen Endpunkt).
  4. Verwende entweder den Header api-key oder x-api-key in deinen Anfragen oder übergib ihn an das SDK.

Die Foundry-SDKs benötigen einen API-Key und entweder einen Ressourcennamen oder eine Basis-URL. Die C#-, Java-, PHP-, Python- und TypeScript-SDKs lesen diese automatisch aus den folgenden Umgebungsvariablen, sofern sie definiert sind:

  • ANTHROPIC_FOUNDRY_API_KEY - Dein API-Key
  • ANTHROPIC_FOUNDRY_RESOURCE - Dein Ressourcenname (zum Beispiel example-resource)
  • ANTHROPIC_FOUNDRY_BASE_URL - Alternative zum Ressourcennamen: die vollständige Basis-URL (zum Beispiel https://example-resource.services.ai.azure.com/anthropic/). Das C#-SDK liest diese Variable nicht: Es konstruiert die Basis-URL immer aus dem Ressourcennamen.

Beispiel mit API-Key:

import os
from anthropic import AnthropicFoundry

client = AnthropicFoundry(
    api_key=os.environ.get("ANTHROPIC_FOUNDRY_API_KEY"),
    resource="example-resource",  # your resource name
)

message = client.messages.create(
    model="claude-opus-5-5",
    max_tokens=1024,
    messages=[{"role": "user", "content": "Hello!"}],
)
print(message.content)

Microsoft-Entra-Authentifizierung

Mit der Entra-ID-Authentifizierung kannst du den Zugriff über Azure RBAC verwalten, die Identitätsverwaltung deiner Organisation integrieren und den manuellen Umgang mit API-Keys vermeiden. So verwendest du Entra-ID-Token:

  1. Aktiviere die Microsoft-Entra-ID-Authentifizierung für deine Foundry-Ressource.
  2. Rufe ein Zugriffstoken von Entra ID ab.
  3. Verwende das Token im Header Authorization: Bearer {TOKEN}.

Beispiel mit Entra ID:

from anthropic import AnthropicFoundry
from azure.identity import DefaultAzureCredential, get_bearer_token_provider

# Microsoft Entra ID-Token über das Token-Provider-Muster abrufen
token_provider = get_bearer_token_provider(
    DefaultAzureCredential(), "https://ai.azure.com/.default"
)

# Client mit Entra ID-Authentifizierung erstellen
client = AnthropicFoundry(
    resource="example-resource",  # your resource name
    azure_ad_token_provider=token_provider,  # Use token provider for Entra ID auth
)

# Anfrage senden
message = client.messages.create(
    model="claude-opus-5-5",
    max_tokens=1024,
    messages=[{"role": "user", "content": "Hello!"}],
)
print(message.content)

Korrelations-Request-IDs

Foundry fügt zur Fehlersuche und Nachverfolgung Request-Kennungen in die HTTP-Antwort-Header ein. Wenn du den Support kontaktierst, gib sowohl den Wert request-id als auch apim-request-id (Azure API Management) an, damit die Teams deine Anfrage in den Systemen von Anthropic und Azure schnell finden und untersuchen können.

Funktionsunterstützung

Claude in Microsoft Foundry unterstützt die meisten Claude-Funktionen. Alle derzeit unterstützten Funktionen findest du in der Funktionsübersicht.

Kontextfenster

Claude Fable 5.1, Claude Fable 5, Claude Opus 5.5, Claude Opus 5, Claude Opus 4.8, Claude Opus 4.7, Claude Opus 4.6, Claude Sonnet 5.5, Claude Sonnet 5 und Claude Sonnet 4.6 haben in Microsoft Foundry ein Kontextfenster mit 1M Token. Andere Claude-Modelle, einschließlich Claude Sonnet 4.5, haben ein Kontextfenster mit 200k Token.

Claude-Funktionen, die für Claude in Microsoft Foundry nicht unterstützt werden

  • Admin API
  • Advisor-Tool
  • Claude Managed Agents
  • Compliance API
  • Models API
  • Message Batches API
  • Serverseitiges Fallback (der Parameter fallbacks; verwende stattdessen das clientseitige Fallback-Muster)
  • Toolsets für Computer Use und Browser Use (computer_toolset_20260801 und browser_toolset_20260801 sind derzeit auf Microsoft Foundry nicht verfügbar; die Beta-Versionen des Computer-Use-Tools bleiben verfügbar)

Zusätzliche Funktionen, die beim Hosting auf Azure nicht unterstützt werden

Die folgenden Funktionen sind für auf Anthropic gehostete Deployments verfügbar, werden aber für auf Azure gehostete Deployments nicht unterstützt:

Anfragen, die diese Funktionen gegen ein auf Azure gehostetes Deployment verwenden, geben absichtlich einen Fehler 400 Bad Request zurück. Claude Code erkennt auf Azure gehostete Deployments und passt seinen Funktionsumfang automatisch an.

API-Antworten

API-Antworten von Claude in Microsoft Foundry folgen dem standardmäßigen Antwortformat der Claude API. Dazu gehört das Objekt usage in den Antwort-Bodys, das detaillierte Informationen zum Token-Verbrauch deiner Anfragen liefert. Das Objekt usage ist über alle Plattformen hinweg konsistent (Claude API, Amazon Bedrock, Claude Platform on AWS, Foundry und Google Cloud).

Details zu Foundry-spezifischen Antwort-Headern findest du unter Korrelations-Request-IDs.

API-Modell-IDs und Deployments

Die Lebenszyklusbegriffe („Deprecated“ (abgekündigt), „Retired“ (eingestellt)) sind unter Modell-Abkündigungen definiert. Microsoft Foundry folgt dem Lebenszyklus-Zeitplan der Claude API.

Die folgenden Claude-Modelle sind über Foundry verfügbar:

ModelDefault deployment nameHosted on AzureHosted on Anthropic
Claude Fable 5.1✓
Claude Mythos 5.1 (limited availability)✓
Claude Fable 5✓
Claude Mythos 5 (limited availability)✓
Claude Opus 5.5✓✓
Claude Opus 5✓✓
Claude Opus 4.8✓✓
Claude Opus 4.7✓
Claude Opus 4.6✓
Claude Opus 4.5✓
Claude Sonnet 5.5✓✓
Claude Sonnet 5✓✓
Claude Sonnet 4.6✓
Claude Sonnet 4.5 (deprecated)✓
Claude Haiku 4.5✓✓

Standardmäßig entsprechen die Deployment-Namen den in der obigen Tabelle gezeigten Modell-IDs. Du kannst jedoch im Foundry-Portal benutzerdefinierte Deployments mit anderen Namen erstellen, um unterschiedliche Konfigurationen, Versionen oder Ratenlimits zu verwalten. Verwende in deinen API-Anfragen den Deployment-Namen (nicht unbedingt die Modell-ID).

Abrechnung

Claude in Microsoft Foundry wird über den Azure Marketplace abgerechnet. Die Nutzung wird in Claude Consumption Units (CCUs) angegeben, stündlich gemessen und monatlich nachträglich auf deiner Azure-Rechnung ausgewiesen. CCUs sind keine vorausbezahlten Guthaben. Es gibt kein CCU-Guthaben und keine CCU-Verpflichtung.

Den CCU-Preis, die Umrechnungsmechanik und die Token-Raten pro Modell findest du unter Preise für Claude in Microsoft Foundry.

Zwischen Hosting-Optionen migrieren

So verschiebst du ein bestehendes Deployment von einer Hosting-Option zur anderen:

  1. Erstelle ein neues Deployment der anderen Hosting-Version des Modells (Hosted on Azure oder Hosted on Anthropic). Dies kann in derselben Foundry-Ressource oder in einer neuen erfolgen.
  2. Aktualisiere deine Anwendung, sodass sie den neuen Deployment-Namen im Parameter model übergibt.
  3. Lösche das alte Deployment, sobald der Traffic umgezogen ist.

Wenn sich das neue Deployment in derselben Foundry-Ressource befindet, bleiben deine Endpunkt-URL und Authentifizierung unverändert. Wenn du eine neue Ressource erstellt hast, aktualisiere den Endpunkt und die Anmeldedaten deiner Anwendung, sodass sie darauf verweisen.

Monitoring und Logging

Azure bietet Monitoring und Logging für deine Claude-Nutzung über standardmäßige Azure-Muster:

  • Azure Monitor: Verfolge API-Nutzung, Latenz und Fehlerraten
  • Azure Log Analytics: Frage Request-/Response-Logs ab und analysiere sie
  • Cost Management: Überwache und prognostiziere die mit der Claude-Nutzung verbundenen Kosten

Anthropic empfiehlt, deine Aktivität mindestens auf rollierender 30-Tage-Basis zu protokollieren, um Nutzungsmuster zu verstehen und mögliche Probleme zu untersuchen.

Fehlerbehebung

Authentifizierungsfehler

Fehler: 401 Unauthorized oder Invalid API key

  • Lösung: Überprüfe, ob dein API-Key korrekt ist. Du findest ihn im Foundry-Portal auf dem Tab Details deines Deployments (unter Build > Models).
  • Lösung: Wenn du Microsoft Entra ID verwendest, stelle sicher, dass dein Zugriffstoken gültig und nicht abgelaufen ist. Token laufen in der Regel nach 1 Stunde ab.

Fehler: 403 Forbidden

  • Lösung: Deinem Azure-Konto fehlen möglicherweise die erforderlichen Berechtigungen. Stelle sicher, dass dir die passende Azure-RBAC-Rolle zugewiesen ist (zum Beispiel Foundry User (früher Azure AI User) oder Cognitive Services User).

Ratenlimitierung

Fehler: 429 Too Many Requests

  • Lösung: Du hast dein „rate limit“ (Ratenlimit) überschritten. Implementiere exponentielles Backoff und Retry-Logik in deiner Anwendung.
  • Lösung: Erwäge, über das Azure-Portal oder den Azure-Support eine Erhöhung des Ratenlimits zu beantragen.

Ratenlimit-Header

Foundry fügt die standardmäßigen Ratenlimit-Header von Anthropic (anthropic-ratelimit-tokens-limit, anthropic-ratelimit-tokens-remaining, anthropic-ratelimit-tokens-reset, anthropic-ratelimit-input-tokens-limit, anthropic-ratelimit-input-tokens-remaining, anthropic-ratelimit-input-tokens-reset, anthropic-ratelimit-output-tokens-limit, anthropic-ratelimit-output-tokens-remaining und anthropic-ratelimit-output-tokens-reset) nicht in Antworten ein. Verwalte die Ratenlimitierung stattdessen über die Monitoring-Tools von Azure.

Modell- und Deployment-Fehler

Fehler: Model not found oder Deployment not found

  • Lösung: Überprüfe, ob du den richtigen Deployment-Namen verwendest. Wenn du kein benutzerdefiniertes Deployment erstellt hast, verwende die Standard-Modell-ID (zum Beispiel ).
  • Lösung: Stelle sicher, dass das Modell/Deployment in deiner Azure-Region verfügbar ist.

Fehler: Invalid model parameter

  • Lösung: Der Parameter model sollte deinen Deployment-Namen enthalten, der im Foundry-Portal angepasst werden kann. Überprüfe, ob das Deployment existiert und korrekt konfiguriert ist.

Nächste Schritte

Entdecke die erweiterten Funktionen und Fähigkeiten von Claude.

Erfahre mehr über die Preisstruktur von Anthropic für Modelle und Funktionen.

Wenn sicherere und leistungsfähigere Modelle erscheinen, stellt Anthropic ältere regelmäßig ein. Sieh dir alle API-Abkündigungen zusammen mit empfohlenen Nachfolgern an.

Zusätzliche Ressourcen

Durchsuche Anthropic-Modelle im Foundry-Katalog.

Sieh dir die Preisdetails von Microsoft für Azure AI Foundry an.

Sieh dir die Preisdetails von Anthropic pro Modell an.

Verwalte deine Azure-Ressourcen.

Was this page helpful?