Claude Platform Docs
MessagesClaude sur les plateformes cloud

Claude sur Google Cloud

Les modèles Claude d'Anthropic sont disponibles via Google Cloud's Agent Platform.

L'API permettant d'accéder à Claude sur Google Cloud's Agent Platform est presque identique à l'API Messages, avec deux différences clés dans le format des requêtes :

  • Sur Agent Platform, model n'est pas transmis dans le corps de la requête. Il est plutôt spécifié dans l'URL du point de terminaison Google Cloud.
  • Sur Agent Platform, anthropic_version est transmis dans le corps de la requête (plutôt que sous forme d'en-tête), et doit être défini sur la valeur vertex-2023-10-16.

Agent Platform est également pris en charge par les SDK clients officiels d'Anthropic. Ce guide vous explique comment effectuer une requête vers Claude sur Agent Platform à l'aide de l'un des SDK clients d'Anthropic.

Notez que ce guide suppose que vous disposez déjà d'un projet Google Cloud capable d'utiliser Agent Platform. Consultez Modèles Anthropic Claude sur Agent Platform pour plus d'informations sur la configuration requise et une procédure complète.

Installer un SDK pour accéder à Agent Platform

Tout d'abord, installez le SDK client d'Anthropic pour le langage de votre choix.

pip install -U "anthropic[vertex]"

Accéder à Agent Platform

Disponibilité des modèles

Notez que la disponibilité des modèles Anthropic varie selon la région. Recherchez « Claude » dans le Model Garden ou rendez-vous sur Modèles Anthropic Claude pour obtenir les informations les plus récentes.

Identifiants de modèles de l'API

Les termes relatifs au cycle de vie (Déprécié, Retiré) sont définis dans Dépréciations de modèles. Les dates de cycle de vie sur les plateformes exploitées par des partenaires sont fixées par le partenaire et peuvent différer du calendrier de l'API Claude. Pour connaître la date de retrait actuelle de tout modèle sur Agent Platform, consultez la documentation de Google Cloud pour les modèles Claude sur Agent Platform.

ModelAgent Platform API model ID
Claude Fable 5.1
Claude Mythos 5.1 (limited availability)
Claude Fable 5
Claude Mythos 5 (limited availability)
Claude Opus 5.5
Claude Opus 5
Claude Opus 4.8
Claude Opus 4.7
Claude Opus 4.6
Claude Opus 4.5
Claude Opus 4.1 (deprecated)
Claude Opus 4 (deprecated)
Claude Sonnet 5
Claude Sonnet 4.6
Claude Sonnet 4.5
Claude Sonnet 4 (deprecated)
Claude Haiku 4.5
Claude Haiku 3.5 (deprecated)

Effectuer des requêtes

Avant d'exécuter des requêtes, vous devrez peut-être exécuter gcloud auth application-default login pour vous authentifier auprès de Google Cloud.

Les exemples suivants montrent comment générer du texte à partir de Claude sur Agent Platform :

from anthropic import AnthropicVertex

project_id = "MY_PROJECT_ID"
region = "global"

client = AnthropicVertex(project_id=project_id, region=region)

message = client.messages.create(
    model="claude-opus-5-5",
    max_tokens=100,
    messages=[
        {
            "role": "user",
            "content": "Hey Claude!",
        }
    ],
)
print(message)

Consultez les SDK clients et la documentation officielle d'Agent Platform pour plus de détails.

Claude est également disponible via Amazon Bedrock, Claude Platform sur AWS et Microsoft Foundry.

Conservation des données

Le traitement des données pour cette offre est régi par Google Cloud. Pour plus de détails, consultez Agent Platform et conservation zéro des données.

Journalisation de l'activité

Agent Platform fournit un service de journalisation des requêtes et réponses qui vous permet de journaliser les prompts et les complétions associés à votre utilisation.

Anthropic vous recommande de journaliser votre activité sur une période glissante d'au moins 30 jours afin de comprendre votre activité et d'enquêter sur toute utilisation abusive potentielle.

Prise en charge des fonctionnalités

Pour la liste complète des fonctionnalités avec leur disponibilité sur Google Cloud, consultez la Vue d'ensemble des fonctionnalités.

Principales fonctionnalités prises en charge

Fonctionnalités non prises en charge

  • Sources d'entrée (sources URL pour les images et les documents, API Files)
  • Outils côté serveur (exécution de code, récupération web, advisor)
  • Infrastructure d'agents (Agent Skills, connecteur MCP, appel d'outils programmatique)
  • Points de terminaison de l'API (Message Batches, Models, Admin, Compliance, Usage and Cost)
  • Claude Managed Agents
  • Repli côté serveur (le paramètre fallbacks ; utilisez plutôt le modèle de repli côté client)

Fenêtre de contexte

Claude Fable 5.1, Claude Fable 5, Claude Opus 5.5, Claude Opus 5, Claude Opus 4.8, Claude Opus 4.7, Claude Opus 4.6, Claude Sonnet 5 et Claude Sonnet 4.6 disposent d'une « context window » (fenêtre de contexte) de 1M de tokens sur Agent Platform. Les autres modèles Claude, y compris Sonnet 4.5 et Sonnet 4 (déprécié), disposent d'une fenêtre de contexte de 200k tokens.

Agent Platform limite la charge utile des requêtes à 30 Mo. Lors de l'envoi de documents volumineux ou de nombreuses images, vous pourriez atteindre cette limite avant la limite de tokens.

Points de terminaison globaux, multirégionaux et régionaux

Agent Platform propose trois types de points de terminaison :

  • Points de terminaison globaux : routage dynamique pour une disponibilité maximale
  • Points de terminaison multirégionaux : routage dynamique au sein d'une zone géographique (par exemple, les États-Unis ou l'Union européenne) pour la résidence des données avec une haute disponibilité
  • Points de terminaison régionaux : routage des données garanti via des régions géographiques spécifiques

Les points de terminaison régionaux et multirégionaux incluent une majoration tarifaire de 10 % par rapport aux points de terminaison globaux.

Quand utiliser chaque option

Points de terminaison globaux (recommandés) :

  • Offrent une disponibilité et un temps de fonctionnement maximaux
  • Acheminent dynamiquement les requêtes vers les régions disposant de capacité disponible
  • Aucune majoration tarifaire
  • Idéaux pour les applications où la résidence des données est flexible
  • Prennent uniquement en charge le trafic à l'usage (le débit provisionné nécessite des points de terminaison régionaux)

Points de terminaison multirégionaux :

  • Acheminent dynamiquement les requêtes entre les régions d'une zone géographique (actuellement us et eu)
  • Utiles lorsque vous avez besoin d'une résidence des données au sein d'une vaste zone géographique mais souhaitez une disponibilité supérieure à celle d'une seule région
  • Majoration tarifaire de 10 % par rapport aux points de terminaison globaux
  • Prennent uniquement en charge le trafic à l'usage (le débit provisionné nécessite des points de terminaison régionaux)

Points de terminaison régionaux :

  • Acheminent le trafic via des régions géographiques spécifiques
  • Requis pour la résidence des données dans une seule région, les exigences de conformité strictes ou le débit provisionné
  • Prennent en charge à la fois le trafic à l'usage et le débit provisionné
  • La majoration tarifaire de 10 % reflète les coûts d'infrastructure liés à la capacité régionale dédiée

Implémentation

Utilisation des points de terminaison globaux (recommandé) :

Définissez le paramètre region sur "global" lors de l'initialisation du client :

from anthropic import AnthropicVertex

project_id = "MY_PROJECT_ID"
region = "global"

client = AnthropicVertex(project_id=project_id, region=region)

message = client.messages.create(
    model="claude-opus-5-5",
    max_tokens=100,
    messages=[
        {
            "role": "user",
            "content": "Hey Claude!",
        }
    ],
)
print(message)

Utilisation des points de terminaison multirégionaux :

Définissez le paramètre region sur un identifiant multirégional : "us" pour les États-Unis ou "eu" pour l'Union européenne. Le SDK achemine les requêtes vers le point de terminaison multirégional correspondant (https://aiplatform.us.rep.googleapis.com ou https://aiplatform.eu.rep.googleapis.com), qui équilibre dynamiquement le trafic entre les régions de cette zone géographique.

from anthropic import AnthropicVertex

project_id = "MY_PROJECT_ID"
region = "us"  # Multi-region identifier: "us" or "eu"

client = AnthropicVertex(project_id=project_id, region=region)

message = client.messages.create(
    model="claude-opus-5-5",
    max_tokens=100,
    messages=[
        {
            "role": "user",
            "content": "Hey Claude!",
        }
    ],
)
print(message)

Utilisation des points de terminaison régionaux :

Spécifiez une région précise telle que "us-east5" ou "europe-west1" :

from anthropic import AnthropicVertex

project_id = "MY_PROJECT_ID"
region = "us-east5"  # Specify a specific region

client = AnthropicVertex(project_id=project_id, region=region)

message = client.messages.create(
    # Certains points de terminaison régionaux prennent en charge Claude Sonnet 4.6 et versions antérieures ; les modèles plus récents utilisent les points de terminaison globaux ou multirégionaux
    model="claude-sonnet-4-6",
    max_tokens=100,
    messages=[
        {
            "role": "user",
            "content": "Hey Claude!",
        }
    ],
)
print(message)

Ressources supplémentaires

Was this page helpful?