Passa ai contenuti principali
Documentazione
close
Inizia
Inizia a utilizzare Google Cloud
Elenco prodotti
Assistenza clienti Google Cloud
Prodotti in primo piano
Agent Platform
Gestione delle API Apigee
BigQuery
Compute Engine
Cloud CDN
Cloud Run
Cloud Storage
Cloud SQL
Gemini Enterprise
Google Kubernetes Engine
Looker
Strumenti per più prodotti
Gestione di accessi e risorse
Gestione di costi e utilizzo
Infrastructure as Code (IaC)
SDK, linguaggi, framework e strumenti
Aree tecnologiche
AI e ML
Sviluppo di applicazioni
Hosting di applicazioni
Computing
Analisi dei dati e pipeline
Database
Distribuito, ibrido e multi-cloud
Soluzioni di settore
Migrazione
Networking
Osservabilità e monitoraggio
Sicurezza
Storage
/
Console
English
Deutsch
Español – América Latina
Français
Indonesia
Italiano
Português – Brasil
עברית
中文 – 简体
中文 – 繁體
日本語
한국어
Accedi
AI Hypercomputer
Inizia gratuitamente
Panoramica
Guide
Risorse
Documentazione
Altro
Panoramica
Guide
Risorse
Console
Scopri
Panoramica
Scegliere l'infrastruttura dell'acceleratore
Scegli un orchestratore e un'opzione di deployment
Acceleratori
Informazioni sugli acceleratori GPU
GPU generiche
GPU in cluster
Infrastruttura ottimizzata per le prestazioni
Servizi di networking
Panoramica del networking GPU
Servizi di rete per i deployment
Best practice di networking
Servizi di archiviazione
Apri software
Immagini sistema operativo e Docker
Scegli un'opzione di consumo
Gestione dei cluster
Panoramica della gestione del cluster
Configurazioni di gestione del cluster
Terminologia
Per iniziare
Pianifica e crea la tua infrastruttura AI
Scegliere tra GPU generiche e GPU in cluster
Progettare l'infrastruttura AI con Gemini
Ottenere capacità e quota
Panoramica
Prenota la capacità
Visualizzare la capacità riservata
Guide rapide
Crea un cluster Slurm completamente gestito con VM A4
Crea un cluster Slurm autogestito con VM A4
Esegui il deployment dell'infrastruttura
Panoramica delle opzioni di deployment
Panoramica della policy di posizionamento compatto e della policy workload
Esegui il deployment di VM e cluster ottimizzati per l'AI
Crea cluster GKE
Crea un cluster GKE ottimizzato per l'AI con la configurazione predefinita
Crea un cluster GKE personalizzato ottimizzato per l'AI che utilizza A4X Max
Crea un cluster GKE personalizzato ottimizzato per l'AI che utilizza A4X
Crea un cluster GKE personalizzato ottimizzato per l'AI che utilizza A4 o A3 Ultra
Crea un cluster GKE Standard che utilizza A3 Mega o A3 High
Crea un cluster GKE Autopilot che utilizza A3 Mega o A3 High
Crea un cluster GKE personalizzato ottimizzato per l'AI che utilizza A3 Edge
Crea un cluster GKE personalizzato ottimizzato per l'AI che utilizza A2
Crea un cluster GKE personalizzato ottimizzato per l'AI che utilizza G2 o G4
Crea un cluster GKE personalizzato ottimizzato per l'AI che utilizza N1
Crea cluster Slurm
Crea un cluster completamente gestito
Crea un cluster autogestito
Crea un'istanza
Crea A4X Max
Crea A4X
Crea A4 o A3 Ultra
Crea A3 High o A3 Mega
Crea A3 Edge
Crea A2
Crea G4
Crea G2
Crea N1 con GPU
Creare istanze collettivamente
Crea A4X Max
Crea A4X
Crea A4 o A3 Ultra
Crea A3 High o A3 Mega
Crea A3 Edge
Crea A2
Crea G4
Crea G2
Crea N1 con GPU
Creazione di un gruppo di istanze gestite (MIG)
Crea A4X Max
Crea A4X
Crea A4 o A3 Ultra
Crea A3 High o A3 Mega
Crea A3 Edge
Crea A2
Crea G4
Crea G2
Crea N1 con GPU
Esegui carichi di lavoro
Esegui i workload con Pathways on Cloud
Introduzione ai percorsi su Cloud
Crea un cluster GKE con Pathways
Esegui un carico di lavoro batch con Pathways
Esegui un carico di lavoro interattivo con Pathways
Esegui l'inferenza multihost utilizzando Pathways
Formazione resiliente con Pathways
Portare i carichi di lavoro JAX su Pathways
Risolvi i problemi di Pathways on Cloud
Pianifica i workload GKE
Pianificare i workload con Topology Aware Scheduling (TAS)
Abilita la previsione dello stato di integrità dei nodi
Utilizza Kueue per orchestrare i workload
Tutorial sui workload AI
Panoramica
GPU
Esegui l'inferenza con vLLM su GKE
DeepSeek V3.1
DeepSeek V3.2-Speciale
Gemma 3
GPT-OSS
Llama 4
Qwen3
Esegui l'ottimizzazione
Gemma 3 su un cluster GKE
Gemma 3 su un cluster GKE multi-host
Gemma 3 su un cluster Slurm
Gemma 3 per attività di visione su GKE
Llama 4 su un cluster Slurm
Mixtral-8x7b su un cluster Slurm
Allenamento di corsa
Qwen2 su un cluster Slurm
TPU
Pubblica workload
Gestisci Qwen2-7B con vLLM su TPU
Gestisci Qwen2-7B-Instruct con vLLM su TPU
Gestisci Qwen3-8B-Base con vLLM su TPU
Gestisci Llama-3.1-8B con vLLM su TPU
Esegui l'ottimizzazione
Esegui SFT per Gemma 4 31B su TPU v6e multi-host
Esegui il fine-tuning supervisionato su una VM TPU con MaxText
Esegui l'addestramento RL su una VM TPU v6e-8