Ir para o conteúdo principal
Google Cloud Documentation
Áreas de tecnologia
  • IA e ML
  • Desenvolvimento de aplicativos
  • Hospedagem de aplicativos
  • Computação
  • Pipelines e análises de dados
  • Bancos de dados
  • Distribuído, híbrido e multicloud
  • Soluções por setor
  • Migração
  • Rede
  • Observabilidade e monitoramento
  • Segurança
  • Storage
Ferramentas de vários produtos
  • Gerenciamento de recursos e acesso
  • Gerenciamento de custos e uso
  • Infraestrutura como código
  • SDK, linguagens, frameworks e ferramentas
/
Console
  • English
  • Deutsch
  • Español – América Latina
  • Français
  • Indonesia
  • Italiano
  • Português – Brasil
  • עברית
  • 中文 – 简体
  • 中文 – 繁體
  • 日本語
  • 한국어
Fazer login
  • AI Hypercomputer
Comece sem custos financeiros
Visão geral Guias Recursos
Google Cloud Documentation
  • Áreas de tecnologia
    • Mais
    • Visão geral
    • Guias
    • Recursos
  • Ferramentas de vários produtos
    • Mais
  • Console
  • Descoberta
  • Visão geral
  • Infraestrutura com desempenho otimizado
    • Máquinas de GPU
    • Serviços de redes
      • Visão geral da rede de GPU
      • Serviços de rede para implantações
      • Práticas recomendadas de rede
    • Serviços de armazenamento
  • Software aberto
    • Imagens do SO e do Docker
  • Escolha uma opção de consumo
  • Gerenciamento de clusters
    • Visão geral
    • Configurações
  • Terminologia
  • Começar
  • Visão geral da criação de cluster
  • Projete sua infraestrutura com o Gemini
  • Configurações recomendadas
  • Obter capacidade e cota
    • Visão geral
    • Capacidade de reserva
    • Ver capacidade reservada
  • Guias de início rápido
    • Criar um cluster Slurm totalmente gerenciado com VMs A4
    • Criar um cluster Slurm autogerenciado com VMs A4
  • Implantar infraestrutura
  • Visão geral das opções de implantação
  • Visão geral das políticas de posicionamento compacto e de carga de trabalho
  • Implante VMs e clusters otimizados para IA
    • Criar clusters do GKE
      • Criar um cluster do GKE otimizado para IA com configuração padrão
      • Criar um cluster do GKE personalizado otimizado para IA que usa o A4X Max
      • Criar um cluster do GKE personalizado otimizado para IA que usa o A4X
      • Criar um cluster personalizado do GKE otimizado para IA que usa A4 ou A3 Ultra
      • Criar clusters do GKE Standard que usam A3 Mega ou A3 High
      • Criar clusters do GKE Autopilot que usam A3 Mega ou A3 High
    • Criar clusters do Slurm
      • Criar um cluster totalmente gerenciado
      • Criar um cluster autogerenciado
    • Criar uma instância
      • Criar A4X Max
      • Criar A4X
      • Criar A4 ou A3 Ultra
      • Criar A3 High ou A3 Mega
    • Criar instâncias em massa
      • Criar A4X Max
      • Criar A4X
      • Criar A4 ou A3 Ultra
      • Criar A3 High ou A3 Mega
    • Criar um grupo gerenciado de instâncias (MIG, na sigla em inglês)
      • Criar A4X Max
      • Criar A4X
      • Criar A4 ou A3 Ultra
      • Criar A3 High ou A3 Mega
  • Executar cargas de trabalho
  • Executar cargas de trabalho com os programas de aprendizado no Cloud
    • Introdução aos programas no Cloud
    • Criar um cluster do GKE com o Pathways
    • Executar uma carga de trabalho em lote com os programas
    • Executar uma carga de trabalho interativa com os programas
    • Fazer inferência multihost usando o Pathways
    • Treinamento resiliente com programas de aprendizado
    • Portar cargas de trabalho do JAX para o Pathways
    • Resolver problemas do Pathways on Cloud
  • Agendar cargas de trabalho do GKE
    • Programar cargas de trabalho com o Agendamento com reconhecimento de topologia (TAS, na sigla em inglês)
    • Ativar a previsão de integridade do nó
  • Usar o Kueue para orquestrar cargas de trabalho
  • Tutoriais sobre cargas de trabalho de IA
    • Visão geral
    • GPU
      • Executar inferência com vLLM no GKE
        • DeepSeek V3.1
        • DeepSeek V3.2-Speciale
        • O Gemma 3
        • GPT-OSS
        • o Llama 3
        • Qwen3
      • Executar ajuste
        • Gemma 3 em um cluster do GKE
        • Gemma 3 em um cluster do Slurm
        • Gemma 3 para tarefas de visão no GKE
        • Llama 4 em um cluster do Slurm
        • Mixtral-8x7b em um cluster Slurm
      • Executar o treinamento
        • Qwen2 em um cluster Slurm
    • TPU
      • Disponibilizar cargas de trabalho
        • Disponibilizar o Qwen2-7B com o vLLM em TPUs
        • Disponibilizar o Qwen2-7B-Instruct com vLLM em TPUs
        • Disponibilizar o Qwen3-8B-Base com vLLM em TPUs
        • Disponibilizar o Llama-3.1-8B com o vLLM em TPUs
      • Executar ajuste
        • Executar o ajuste supervisionado em uma VM da TPU com o MaxText
        • Executar treinamento de RL em uma VM da TPU v6e-8
  • Gerenciar infraestrutura
  • Gerenciar clusters do GKE
    • Ver a topologia de nós do GKE
    • Gerenciar clusters do GKE otimizados para IA
  • Gerenciar instâncias e clusters do Slurm
    • Ver a topologia de uma instância
    • Gerenciar eventos do organizador
      • Eventos de host em instâncias
      • Eventos de host em reservas
    • Denunciar um host com falha
  • Testar e otimizar
  • Otimizar a rede de computadores do cluster usando NCCL/gIB
  • Integrar o NCCL/gIB à sua carga de trabalho
    • Instalar plug-ins NCCL do gIB
    • Usar plug-ins gIB NCCL em contêineres NVIDIA NGC
  • Executar testes da NCCL
    • Executar o NCCL em instâncias do Compute Engine
    • Executar o NCCL em clusters do GKE que usam a configuração padrão
    • Executar o NCCL em clusters personalizados do GKE que usam o A4X Max
    • Executar o NCCL em clusters personalizados do GKE que usam A4X
    • Executar o NCCL em clusters personalizados do GKE que usam A4 ou A3 Ultra
    • Executar o NCCL em clusters personalizados do GKE com A3 Mega ou A3 High
    • Executar o NCCL em clusters Slurm
  • Coletar e entender registros do NCCL para solução de problemas
  • Testar cargas de trabalho com receitas
    • Receitas de comparativo de mercado
    • Receitas de otimização de Goodput
  • Clusters de teste
  • Notas da versão do NCCL/gIB
    • Notas da versão do NCCL/gIB (x86 de 64 bits)
    • Notas da versão do NCCL/gIB (ARM de 64 bits)
  • Monitoramento
  • Monitorar VMs e clusters do Slurm
  • Gerenciar como o CoMMA coleta a telemetria do NCCL
    • Analisador de comunicação coletiva (CoMMA, na sigla em inglês)
    • Ativar, desativar e configurar o CoMMA
  • Resolver problemas
  • Problemas conhecidos
  • Resolver problemas de lentidão
  • Resolver problemas ao reportar um host com falha
  • Resolver problemas do CoMMA
  • IA e ML
  • Desenvolvimento de aplicativos
  • Hospedagem de aplicativos
  • Computação
  • Pipelines e análises de dados
  • Bancos de dados
  • Distribuído, híbrido e multicloud
  • Soluções por setor
  • Migração
  • Rede
  • Observabilidade e monitoramento
  • Segurança
  • Storage
  • Gerenciamento de recursos e acesso
  • Gerenciamento de custos e uso
  • Infraestrutura como código
  • SDK, linguagens, frameworks e ferramentas
O Google usa tecnologia de IA na tradução de conteúdos para seu idioma de preferência. As traduções com IA podem ter erros.
  • Home
  • Documentation