Zum Hauptinhalt springen
Dokumentation
close
Jetzt starten
Erste Schritte mit Google Cloud
Produktliste
Cloud Customer Care
Vorgestellte Produkte
Agent Platform
API-Verwaltung mit Apigee
BigQuery
Compute Engine
Cloud CDN
Cloud Run
Cloud Storage
Cloud SQL
Gemini Enterprise
Google Kubernetes Engine
Looker
Produktübergreifende Tools
Zugriffs- und Ressourcenverwaltung
Kosten- und Nutzungsmanagement
Infrastruktur als Code
SDK, Sprachen, Frameworks und Tools
Technologiebereiche
KI und ML
Anwendungsentwicklung
Anwendungshosting
Compute
Datenanalyse und Pipelines
Datenbanken
Verteilt, Hybrid und Multi-Cloud
Branchenlösungen
Migration
Netzwerk
Beobachtbarkeit und Monitoring
Sicherheit
Storage
/
Console
English
Deutsch
Español – América Latina
Français
Indonesia
Italiano
Português – Brasil
עברית
中文 – 简体
中文 – 繁體
日本語
한국어
Anmelden
AI Hypercomputer
Jetzt kostenlos testen
Übersicht
Leitfäden
Ressourcen
Dokumentation
Mehr
Übersicht
Leitfäden
Ressourcen
Console
Erste Schritte
Übersicht
Accelerator-Infrastruktur auswählen
Orchestrator und Bereitstellungsoption auswählen
Beschleuniger
GPU-Beschleuniger
Allgemeine GPUs
Clustered GPUs
Leistungsoptimierte Infrastruktur
Netzwerkdienste
GPU-Netzwerkübersicht
Netzwerkdienste für Bereitstellungen
Netzwerke/Best Practices
Speicherdienste
Offene Software
Betriebssystem- und Docker-Images
Eine Option für die Aufnahme auswählen
Clusterverwaltung
Übersicht über die Clusterverwaltung
Konfigurationen für die Clusterverwaltung
Terminologie
Los gehts
KI-Infrastruktur planen und erstellen
Zwischen allgemeinen und gruppierten GPUs auswählen
KI-Infrastruktur mit Gemini entwerfen
Kapazität und Kontingent abrufen
Übersicht
Kapazität reservieren
Reservierte Kapazität ansehen
Kurzanleitungen
Vollständig verwalteten Slurm-Cluster mit A4-VMs erstellen
Selbstverwalteten Slurm-Cluster mit A4-VMs erstellen
Infrastruktur bereitstellen
Übersicht über die Bereitstellungsoptionen
Richtlinie für kompakte Platzierung und Arbeitslastrichtlinie – Übersicht
KI-optimierte VMs und Cluster bereitstellen
GKE-Cluster erstellen
KI-optimierten GKE-Cluster mit Standardkonfiguration erstellen
Benutzerdefinierten KI-optimierten GKE-Cluster erstellen, der A4X Max verwendet
Benutzerdefinierten KI-optimierten GKE-Cluster erstellen, der A4X verwendet
Benutzerdefinierten KI-optimierten GKE-Cluster erstellen, der A4 oder A3 Ultra verwendet
GKE Standard-Cluster erstellen, der A3 Mega oder A3 High verwendet
GKE Autopilot-Cluster mit A3 Mega oder A3 High erstellen
Benutzerdefinierten KI-optimierten GKE-Cluster erstellen, der A3 Edge verwendet
Benutzerdefinierten KI-optimierten GKE-Cluster erstellen, der A2 verwendet
Benutzerdefinierten KI-optimierten GKE-Cluster erstellen, der G2 oder G4 verwendet
Benutzerdefinierten KI-optimierten GKE-Cluster mit N1 erstellen
Slurm-Cluster erstellen
Vollständig verwalteten Cluster erstellen
Selbstverwalteten Cluster erstellen
Instanz erstellen
A4X Max erstellen
A4X erstellen
A4- oder A3-Ultra-Cluster erstellen
A3 High- oder A3 Mega-Cluster erstellen
A3 Edge erstellen
A2 erstellen
G4 erstellen
G2 erstellen
N1-VM mit GPUs erstellen
Instanzen im Bulk erstellen
A4X Max erstellen
A4X erstellen
A4- oder A3-Ultra-Cluster erstellen
A3 High- oder A3 Mega-Cluster erstellen
A3 Edge erstellen
A2 erstellen
G4 erstellen
G2 erstellen
N1-VM mit GPUs erstellen
Eine verwaltete Instanzgruppe (MIG) erstellen
A4X Max erstellen
A4X erstellen
A4- oder A3-Ultra-Cluster erstellen
A3 High- oder A3 Mega-Cluster erstellen
A3 Edge erstellen
A2 erstellen
G4 erstellen
G2 erstellen
N1-VM mit GPUs erstellen
Arbeitslasten ausführen
Arbeitslasten mit Pathways on Cloud ausführen
Einführung in Pathways in der Cloud
GKE-Cluster mit Pathways erstellen
Batcharbeitslast mit Pathways ausführen
Interaktive Arbeitslast mit Pathways ausführen
Inferenz auf mehreren Hosts mit Pathways durchführen
Resilienztraining mit Pathways
JAX-Arbeitslasten zu Pathways portieren
Fehlerbehebung bei Pathways on Cloud
GKE-Arbeitslasten planen
Arbeitslasten mit Topology Aware Scheduling (TAS) planen
Knotenstatusvorhersage aktivieren
Arbeitslasten mit Kueue orchestrieren
Tutorials zu KI-Arbeitslasten
Übersicht
GPU
Inferenz mit vLLM in GKE ausführen
DeepSeek V3.1
DeepSeek V3.2-Speciale
Gemma 3
GPT-OSS
Llama 4
Qwen3
Feinabstimmung ausführen
Gemma 3 in einem GKE-Cluster
Gemma 3 in einem GKE-Cluster mit mehreren Hosts
Gemma 3 in einem Slurm-Cluster
Gemma 3 für Vision-Aufgaben in GKE
Llama 4 in einem Slurm-Cluster
Mixtral-8x7b in einem Slurm-Cluster
Training ausführen
Qwen2 in einem Slurm-Cluster
TPU
Arbeitslasten bereitstellen
Qwen2-7B mit vLLM auf TPUs bereitstellen
Qwen2-7B-Instruct mit vLLM auf TPUs bereitstellen
Qwen3-8B-Base mit vLLM auf TPUs bereitstellen
Llama-3.1-8B mit vLLM auf TPUs bereitstellen
Feinabstimmung ausführen
SFT für Gemma 4 31B auf einer TPU v6e mit mehreren Hosts ausführen
Überwachte Feinabstimmung auf einer TPU-VM mit MaxText ausführen
RL-Training auf einer TPU v6e-8-VM ausführen
Führe Multi-Host-RL-Training für Gemma 4 26B auf TPU v6e durch
Führe Multi-Host-RL-Training auf Qwen3-30B-A3B auf TPU v6e durch
Infrastruktur verwalten
GKE-Cluster verwalten
GKE-Knotentopologie ansehen
KI-optimierte GKE-Cluster verwalten
Instanzen und Slurm-Cluster verwalten
Topologie einer Instanz ansehen
Host-Events verwalten