Passer au contenu principal
Google Cloud Documentation
Domaines technologiques
  • IA et ML
  • Développement d'applications
  • Hébergement d'applications
  • Calcul
  • Analyses de données et pipelines
  • Bases de données
  • Solutions distribuées, hybrides et multicloud
  • Solutions par secteur d'activité
  • Migration
  • Mise en réseau
  • Observabilité et surveillance
  • Sécurité
  • Storage
Outils de produits croisés
  • Gestion des accès et des ressources
  • Gestion des coûts et de l'utilisation
  • Infrastructure as Code
  • SDK, langages, frameworks et outils
/
Console
  • English
  • Deutsch
  • Español – América Latina
  • Français
  • Indonesia
  • Italiano
  • Português – Brasil
  • עברית
  • 中文 – 简体
  • 中文 – 繁體
  • 日本語
  • 한국어
Connexion
  • AI Hypercomputer
Commencer l'essai gratuit
Aperçu Guides Ressources
Google Cloud Documentation
  • Domaines technologiques
    • Plus
    • Aperçu
    • Guides
    • Ressources
  • Outils de produits croisés
    • Plus
  • Console
  • Découvrir
  • Aperçu
  • Infrastructure optimisée pour les performances
    • Machines avec GPU
    • Services de mise en réseau
      • Présentation de la mise en réseau des GPU
      • Services réseau pour les déploiements
      • Bonnes pratiques de mise en réseau
    • Services de stockage
  • Ouvrir le logiciel
    • Images de l'OS et Docker
  • Sélectionner une option de consommation
  • Gestion des clusters
    • Aperçu
    • Configurations
  • Terminologie
  • Premiers pas
  • Présentation de la création de clusters
  • Concevez votre infrastructure avec Gemini
  • Configurations recommandées
  • Obtenir la capacité et le quota
    • Aperçu
    • Capacité de réservation
    • Afficher la capacité réservée
  • Guides de démarrage rapide
    • Créer un cluster Slurm entièrement géré avec des VM A4
    • Créer un cluster Slurm autogéré avec des VM A4
  • Déployer l'infrastructure
  • Présentation des options de déploiement
  • Présentation des règles d'emplacement compact et des règles de charge de travail
  • Déployer des VM et des clusters optimisés pour l'IA
    • Créer des clusters GKE
      • Créer un cluster GKE optimisé pour l'IA avec la configuration par défaut
      • Créer un cluster GKE personnalisé optimisé pour l'IA qui utilise A4X Max
      • Créer un cluster GKE personnalisé optimisé pour l'IA qui utilise A4X
      • Créer un cluster GKE personnalisé optimisé pour l'IA qui utilise A4 ou A3 Ultra
      • Créer des clusters GKE Standard qui utilisent A3 Mega ou A3 High
      • Créer des clusters GKE Autopilot qui utilisent A3 Mega ou A3 High
    • Créer des clusters Slurm
      • Créer un cluster entièrement géré
      • Créer un cluster autogéré
    • Créer une instance
      • Créer A4X Max
      • Créer un A4X
      • Créer une VM A4 ou A3 Ultra
      • Créer une instance A3 High ou A3 Mega
    • Créer des instances de manière groupée
      • Créer A4X Max
      • Créer un A4X
      • Créer une VM A4 ou A3 Ultra
      • Créer une instance A3 High ou A3 Mega
    • Créer un groupe d'instances géré
      • Créer A4X Max
      • Créer un A4X
      • Créer une VM A4 ou A3 Ultra
      • Créer une instance A3 High ou A3 Mega
  • Exécuter des charges de travail
  • Exécuter des charges de travail avec Pathways on Cloud
    • Présentation des parcours sur Cloud
    • Créer un cluster GKE avec Pathways
    • Exécuter une charge de travail par lot avec Pathways
    • Exécuter une charge de travail interactive avec Pathways
    • Effectuer une inférence multihôte à l'aide de Pathways
    • Entraînement résilient avec Pathways
    • Transférer des charges de travail JAX vers Pathways
    • Résoudre les problèmes liés à Pathways on Cloud
  • Planifier des charges de travail GKE
    • Planifier des charges de travail avec la planification sensible à la topologie
    • Activer la prédiction de l'état des nœuds
  • Utiliser Kueue pour orchestrer les charges de travail
  • Tutoriels sur les charges de travail d'IA
    • Aperçu
    • GPU
      • Exécuter l'inférence avec vLLM sur GKE
        • DeepSeek V3.1
        • DeepSeek V3.2-Speciale
        • Gemma 3
        • GPT-OSS
        • Llama 4,
        • Qwen3
      • Exécuter l'affinage
        • Gemma 3 sur un cluster GKE
        • Gemma 3 sur un cluster Slurm
        • Gemma 3 pour les tâches de vision sur GKE
        • Llama 4 sur un cluster Slurm
        • Mixtral-8x7b sur un cluster Slurm
      • Exécuter l'entraînement
        • Qwen2 sur un cluster Slurm
    • TPU
      • Diffuser des charges de travail