Ir al contenido principal
Áreas de tecnología
close
IA y AA
Desarrollo de aplicaciones
Hosting de aplicaciones
Procesamiento
Canalizaciones y análisis de datos
Bases de datos
Nubes distribuidas, híbridas y múltiples
Soluciones de la industria
Migración
Redes
Observabilidad y supervisión
Seguridad
Storage
Herramientas para uso entre productos
close
Administración de accesos y recursos
Administración de uso y costos
Infraestructura como código
SDK, lenguajes, frameworks y herramientas
/
Consola
English
Deutsch
Español – América Latina
Français
Indonesia
Italiano
Português – Brasil
עברית
中文 – 简体
中文 – 繁體
日本語
한국어
Acceder
AI Hypercomputer
Comenzar gratis
Descripción general
Guías
Recursos
Áreas de tecnología
Más
Descripción general
Guías
Recursos
Herramientas para uso entre productos
Más
Consola
Descubrimiento
Descripción general
Infraestructura con optimización de rendimiento
Máquinas con GPU
Servicios de Herramientas de redes
Descripción general de las redes de GPU
Servicios de red para implementaciones
Prácticas recomendadas para redes
Servicios de almacenamiento
Software abierto
Imágenes de SO y Docker
Elige una opción de consumo
Administración de clústeres
Descripción general
Configuraciones
Terminología
Comenzar
Descripción general de la creación de clústeres
Diseña tu infraestructura con Gemini
Parámetros de configuración recomendados
Obtén capacidad y cuota
Descripción general
Reservar capacidad
Cómo ver la capacidad reservada
Guías de inicio rápido
Crea un clúster de Slurm completamente administrado con VMs A4
Crea un clúster de Slurm autoadministrado con VMs A4
Implementa la infraestructura
Descripción general de las opciones de Deployment
Descripción general de la política de posición compacta y la política de cargas de trabajo
Implementa VMs y clústeres optimizados para IA
Crea clústeres de GKE
Crea un clúster de GKE optimizado para IA con la configuración predeterminada
Crea un clúster de GKE personalizado y optimizado para IA que use A4X Max
Crea un clúster de GKE personalizado y optimizado para la IA que use A4X
Crea un clúster de GKE personalizado y optimizado para IA que use A4 o A3 Ultra
Crea clústeres de GKE Standard que usen A3 Mega o A3 High
Crea clústeres de GKE Autopilot que usen A3 Mega o A3 High
Crea clústeres de Slurm
Crea un clúster completamente administrado
Crea un clúster autoadministrado
Crea una instancia
Crear A4X Max
Crea un A4X
Crea una VM A4 o A3 Ultra
Crea un A3 High o A3 Mega
Crea instancias de forma masiva
Crear A4X Max
Crea un A4X
Crea una VM A4 o A3 Ultra
Crea un A3 High o A3 Mega
Crea un grupo de instancias administrado (MIG).
Crear A4X Max
Crea un A4X
Crea una VM A4 o A3 Ultra
Crea un A3 High o A3 Mega
Ejecuta cargas de trabajo
Ejecuta cargas de trabajo con Pathways on Cloud
Introducción a las rutas de aprendizaje en Cloud
Crea un clúster de GKE con Pathways
Ejecuta una carga de trabajo por lotes con Pathways
Ejecuta una carga de trabajo interactiva con Pathways
Realiza la inferencia multihost con Pathways
Entrenamiento resiliente con Rutas
Cómo portar cargas de trabajo de JAX a Pathways
Soluciona problemas de Pathways on Cloud
Programa cargas de trabajo de GKE
Programa cargas de trabajo con la programación consciente de la topología (TAS)
Habilita la predicción del estado del nodo
Usa Kueue para organizar cargas de trabajo
Instructivos sobre cargas de trabajo de IA
Descripción general
GPU
Ejecuta la inferencia con vLLM en GKE
DeepSeek V3.1
DeepSeek V3.2-Speciale
Gemma 3
GPT-OSS
Llama 4
Qwen3
Ejecuta el ajuste
Gemma 3 en un clúster de GKE
Gemma 3 en un clúster de Slurm
Gemma 3 para tareas de visión en GKE
Llama 4 en un clúster de Slurm
Mixtral-8x7b en un clúster de Slurm
Ejecuta el entrenamiento
Qwen2 en un clúster de Slurm
TPU
Entrega de cargas de trabajo
Entrega Qwen2-7B con vLLM en TPU
Entrega Qwen2-7B-Instruct con vLLM en TPU
Entrega Qwen3-8B-Base con vLLM en TPU
Entrega Llama-3.1-8B con vLLM en TPU
Ejecuta el ajuste
Ejecuta el ajuste supervisado en una VM de TPU con MaxText
Ejecuta el entrenamiento de RL en una VM de TPU v6e-8
Administra la infraestructura