Passer au contenu principal
Domaines technologiques
close
IA et ML
Développement d'applications
Hébergement d'applications
Calcul
Analyses de données et pipelines
Bases de données
Solutions distribuées, hybrides et multicloud
Solutions par secteur d'activité
Migration
Mise en réseau
Observabilité et surveillance
Sécurité
Storage
Outils de produits croisés
close
Gestion des accès et des ressources
Gestion des coûts et de l'utilisation
Infrastructure as Code
SDK, langages, frameworks et outils
/
Console
English
Deutsch
Español – América Latina
Français
Indonesia
Italiano
Português – Brasil
עברית
中文 – 简体
中文 – 繁體
日本語
한국어
Connexion
AI Hypercomputer
Commencer l'essai gratuit
Aperçu
Guides
Ressources
Domaines technologiques
Plus
Aperçu
Guides
Ressources
Outils de produits croisés
Plus
Console
Découvrir
Aperçu
Infrastructure optimisée pour les performances
Machines avec GPU
Services de mise en réseau
Présentation de la mise en réseau des GPU
Services réseau pour les déploiements
Bonnes pratiques de mise en réseau
Services de stockage
Ouvrir le logiciel
Images de l'OS et Docker
Sélectionner une option de consommation
Gestion des clusters
Aperçu
Configurations
Terminologie
Premiers pas
Présentation de la création de clusters
Concevez votre infrastructure avec Gemini
Configurations recommandées
Obtenir la capacité et le quota
Aperçu
Capacité de réservation
Afficher la capacité réservée
Guides de démarrage rapide
Créer un cluster Slurm entièrement géré avec des VM A4
Créer un cluster Slurm autogéré avec des VM A4
Déployer l'infrastructure
Présentation des options de déploiement
Présentation des règles d'emplacement compact et des règles de charge de travail
Déployer des VM et des clusters optimisés pour l'IA
Créer des clusters GKE
Créer un cluster GKE optimisé pour l'IA avec la configuration par défaut
Créer un cluster GKE personnalisé optimisé pour l'IA qui utilise A4X Max
Créer un cluster GKE personnalisé optimisé pour l'IA qui utilise A4X
Créer un cluster GKE personnalisé optimisé pour l'IA qui utilise A4 ou A3 Ultra
Créer des clusters GKE Standard qui utilisent A3 Mega ou A3 High
Créer des clusters GKE Autopilot qui utilisent A3 Mega ou A3 High
Créer des clusters Slurm
Créer un cluster entièrement géré
Créer un cluster autogéré
Créer une instance
Créer A4X Max
Créer un A4X
Créer une VM A4 ou A3 Ultra
Créer une instance A3 High ou A3 Mega
Créer des instances de manière groupée
Créer A4X Max
Créer un A4X
Créer une VM A4 ou A3 Ultra
Créer une instance A3 High ou A3 Mega
Créer un groupe d'instances géré
Créer A4X Max
Créer un A4X
Créer une VM A4 ou A3 Ultra
Créer une instance A3 High ou A3 Mega
Exécuter des charges de travail
Exécuter des charges de travail avec Pathways on Cloud
Présentation des parcours sur Cloud
Créer un cluster GKE avec Pathways
Exécuter une charge de travail par lot avec Pathways
Exécuter une charge de travail interactive avec Pathways
Effectuer une inférence multihôte à l'aide de Pathways
Entraînement résilient avec Pathways
Transférer des charges de travail JAX vers Pathways
Résoudre les problèmes liés à Pathways on Cloud
Planifier des charges de travail GKE
Planifier des charges de travail avec la planification sensible à la topologie
Activer la prédiction de l'état des nœuds
Utiliser Kueue pour orchestrer les charges de travail
Tutoriels sur les charges de travail d'IA
Aperçu
GPU
Exécuter l'inférence avec vLLM sur GKE
DeepSeek V3.1
DeepSeek V3.2-Speciale
Gemma 3
GPT-OSS
Llama 4,
Qwen3
Exécuter l'affinage
Gemma 3 sur un cluster GKE
Gemma 3 sur un cluster Slurm
Gemma 3 pour les tâches de vision sur GKE
Llama 4 sur un cluster Slurm
Mixtral-8x7b sur un cluster Slurm
Exécuter l'entraînement
Qwen2 sur un cluster Slurm
TPU
Diffuser des charges de travail