Passer au contenu principal
Documentation
Débuter
Premiers pas avec Google Cloud
Liste des produits
Cloud Customer Care
Sélection de produits
Agent Platform
Apigee API Management
BigQuery
Compute Engine
Cloud CDN
Cloud Run
Cloud Storage
Cloud SQL
Gemini Enterprise
Google Kubernetes Engine
Looker
Outils multiproduits
Gestion des accès et des ressources
Gestion des coûts et de l'utilisation
Infrastructure as Code
SDK, langages, frameworks et outils
Domaines technologiques
IA et ML
Développement d'applications
Hébergement d'applications
Calcul
Analyses de données et pipelines
Bases de données
Solutions distribuées, hybrides et multicloud
Solutions par secteur d'activité
Migration
Mise en réseau
Observabilité et surveillance
Sécurité
Storage
/
Console
English
Deutsch
Español – América Latina
Français
Indonesia
Italiano
Português – Brasil
עברית
中文 – 简体
中文 – 繁體
日本語
한국어
AI Hypercomputer
Commencer l'essai gratuit
Aperçu
Guides
Ressources
Documentation
Plus
Aperçu
Guides
Ressources
Console
Découvrir
Aperçu
Choisir votre infrastructure d'accélérateur
Choisir un outil d'orchestration et une option de déploiement
Accélérateurs
À propos des accélérateurs GPU
GPU généraux
GPU en cluster
Infrastructure optimisée pour les performances
Services de mise en réseau
Présentation de la mise en réseau des GPU
Services réseau pour les déploiements
Bonnes pratiques de mise en réseau
Services de stockage
Ouvrir le logiciel
Images de l'OS et Docker
Sélectionner une option de consommation
Gestion des clusters
Présentation de la gestion des clusters
Configurations de gestion des clusters
Terminologie
Premiers pas
Planifier et créer votre infrastructure d'IA
Choisir entre des GPU généraux et des GPU en cluster
Concevez votre infrastructure d'IA avec Gemini
Obtenir la capacité et le quota
Aperçu
Capacité de réservation
Afficher la capacité réservée
Guides de démarrage rapide
Créer un cluster Slurm entièrement géré avec des VM A4
Créer un cluster Slurm autogéré avec des VM A4
Déployer l'infrastructure
Présentation des options de déploiement
Présentation des règles d'emplacement compact et des règles de charge de travail
Déployer des VM et des clusters optimisés pour l'IA
Créer des clusters GKE
Créer un cluster GKE optimisé pour l'IA avec Cluster Toolkit
Créer un cluster GKE optimisé pour l'IA qui utilise A4X Max
Créer un cluster GKE optimisé pour l'IA qui utilise A4X
Créer un cluster GKE optimisé pour l'IA qui utilise A4 ou A3 Ultra
Créer un cluster GKE Standard qui utilise A3 Mega ou A3 High
Créer un cluster GKE Autopilot qui utilise A3 Mega ou A3 High
Créer un cluster GKE optimisé pour l'IA qui utilise A3 Edge
Créer un cluster GKE optimisé pour l'IA qui utilise A2
Créer un cluster GKE optimisé pour l'IA qui utilise G2 ou G4
Créer un cluster GKE optimisé pour l'IA qui utilise N1
Créer des clusters Slurm
Créer un cluster entièrement géré
Créer un cluster autogéré
Créer une instance
Créer A4X Max
Créer un A4X
Créer une VM A4 ou A3 Ultra
Créer une instance A3 High ou A3 Mega
Créer une machine A3 Edge
Créer A2
Créer une propriété GA4
Créer un G2
Créer une instance N1 avec des GPU
Créer des instances de manière groupée
Créer A4X Max
Créer un A4X
Créer une VM A4 ou A3 Ultra
Créer une instance A3 High ou A3 Mega
Créer une machine A3 Edge
Créer A2
Créer une propriété GA4
Créer un G2
Créer une instance N1 avec des GPU
Créer un groupe d'instances géré
Créer A4X Max
Créer un A4X
Créer une VM A4 ou A3 Ultra
Créer une instance A3 High ou A3 Mega
Créer une machine A3 Edge
Créer A2
Créer une propriété GA4
Créer un G2
Créer une instance N1 avec des GPU
Exécuter des charges de travail
Exécuter des charges de travail avec Pathways on Cloud
Présentation des parcours sur Cloud
Créer un cluster GKE avec Pathways
Exécuter une charge de travail par lot avec Pathways
Exécuter une charge de travail interactive avec Pathways
Effectuer une inférence multihôte à l'aide de Pathways
Entraînement résilient avec Pathways
Transférer des charges de travail JAX vers Pathways
Résoudre les problèmes liés à Pathways on Cloud
Planifier des charges de travail GKE
Planifier des charges de travail avec la planification sensible à la topologie
Activer la prédiction de l'état des nœuds
Utiliser Kueue pour orchestrer les charges de travail
Tutoriels sur les charges de travail d'IA
Aperçu
GPU
Exécuter l'inférence avec vLLM sur GKE
DeepSeek V3.1
DeepSeek V3.2-Speciale
Gemma 3
GPT-OSS
Llama 4,
Qwen3
Exécuter l'affinage
Gemma 4 sur un cluster GKE
Gemma 3 sur un cluster GKE multihôte
Gemma 3 sur un cluster Slurm
Gemma 3 pour les tâches de vision sur GKE
Llama 4 sur un cluster Slurm
Mixtral-8x7b sur un cluster Slurm
Exécuter l'entraînement
Qwen2 sur un cluster Slurm
TPU
Diffuser des charges de travail
Diffuser Qwen2-7B avec vLLM sur des TPU
Diffuser Qwen2-7B-Instruct avec vLLM sur des TPU
Diffuser Qwen3-8B-Base avec vLLM sur des TPU
Diffuser Llama-3.1-8B avec vLLM sur des TPU
Exécuter l'affinage
Exécuter SFT pour Gemma 4 31B sur un TPU v6e multi-hôtes
Exécuter l'affinage supervisé sur une VM TPU avec MaxText
Exécuter l'entraînement RL sur une VM TPU v6e-8
Exécuter un entraînement RL multi-hôte pour Gemma 4 26B sur TPU v6e
Exécuter un entraînement RL multi-hôte sur Qwen3-30B-A3B sur TPU v6e
Gérer l'infrastructure
Gérer les clusters GKE
Afficher la topologie des nœuds GKE
Gérer les clusters GKE optimisés pour l'IA
Gérer les instances et les clusters Slurm
Afficher la topologie d'une instance
Gérer les événements de l'hôte
Événements hôtes dans les instances
Événements hôtes dans les réservations
Signaler un hôte défectueux
Tester et optimiser
Optimisez la mise en réseau du cluster à l'aide de NCCL/gIB
Intégrer NCCL/gIB à votre charge de travail