Zum Hauptinhalt springen
Google Cloud Documentation
Dokumentation
  • Jetzt starten
  • Erste Schritte mit Google Cloud
  • Produktliste
  • Cloud Customer Care
  • Vorgestellte Produkte
  • Agent Platform
  • API-Verwaltung mit Apigee
  • BigQuery
  • Compute Engine
  • Cloud CDN
  • Cloud Run
  • Cloud Storage
  • Cloud SQL
  • Gemini Enterprise
  • Google Kubernetes Engine
  • Looker
  • Produktübergreifende Tools
  • Zugriffs- und Ressourcenverwaltung
  • Kosten- und Nutzungsmanagement
  • Infrastruktur als Code
  • SDK, Sprachen, Frameworks und Tools
  • Technologiebereiche
  • KI und ML
  • Anwendungsentwicklung
  • Anwendungshosting
  • Compute
  • Datenanalyse und Pipelines
  • Datenbanken
  • Verteilt, Hybrid und Multi-Cloud
  • Branchenlösungen
  • Migration
  • Netzwerk
  • Beobachtbarkeit und Monitoring
  • Sicherheit
  • Storage
/
Console
  • English
  • Deutsch
  • Español – América Latina
  • Français
  • Indonesia
  • Italiano
  • Português – Brasil
  • עברית
  • 中文 – 简体
  • 中文 – 繁體
  • 日本語
  • 한국어
Anmelden
  • AI Hypercomputer
Jetzt kostenlos testen
Übersicht Leitfäden Ressourcen
Google Cloud Documentation
  • Dokumentation
    • Mehr
    • Übersicht
    • Leitfäden
    • Ressourcen
  • Console
  • Erste Schritte
  • Übersicht
  • Accelerator-Infrastruktur auswählen
  • Orchestrator und Bereitstellungsoption auswählen
  • Beschleuniger
    • GPU-Beschleuniger
    • Allgemeine GPUs
    • Clustered GPUs
  • Leistungsoptimierte Infrastruktur
    • Netzwerkdienste
      • GPU-Netzwerkübersicht
      • Netzwerkdienste für Bereitstellungen
      • Netzwerke/Best Practices
    • Speicherdienste
  • Offene Software
    • Betriebssystem- und Docker-Images
  • Eine Option für die Aufnahme auswählen
  • Clusterverwaltung
    • Übersicht über die Clusterverwaltung
    • Konfigurationen für die Clusterverwaltung
  • Terminologie
  • Los gehts
  • KI-Infrastruktur planen und erstellen
  • Zwischen allgemeinen und gruppierten GPUs auswählen
  • KI-Infrastruktur mit Gemini entwerfen
  • Kapazität und Kontingent abrufen
    • Übersicht
    • Kapazität reservieren
    • Reservierte Kapazität ansehen
  • Kurzanleitungen
    • Vollständig verwalteten Slurm-Cluster mit A4-VMs erstellen
    • Selbstverwalteten Slurm-Cluster mit A4-VMs erstellen
  • Infrastruktur bereitstellen
  • Übersicht über die Bereitstellungsoptionen
  • Richtlinie für kompakte Platzierung und Arbeitslastrichtlinie – Übersicht
  • KI-optimierte VMs und Cluster bereitstellen
    • GKE-Cluster erstellen
      • KI-optimierten GKE-Cluster mit Standardkonfiguration erstellen
      • Benutzerdefinierten KI-optimierten GKE-Cluster erstellen, der A4X Max verwendet
      • Benutzerdefinierten KI-optimierten GKE-Cluster erstellen, der A4X verwendet
      • Benutzerdefinierten KI-optimierten GKE-Cluster erstellen, der A4 oder A3 Ultra verwendet
      • GKE Standard-Cluster erstellen, der A3 Mega oder A3 High verwendet
      • GKE Autopilot-Cluster mit A3 Mega oder A3 High erstellen
      • Benutzerdefinierten KI-optimierten GKE-Cluster erstellen, der A3 Edge verwendet
      • Benutzerdefinierten KI-optimierten GKE-Cluster erstellen, der A2 verwendet
      • Benutzerdefinierten KI-optimierten GKE-Cluster erstellen, der G2 oder G4 verwendet
      • Benutzerdefinierten KI-optimierten GKE-Cluster mit N1 erstellen
    • Slurm-Cluster erstellen
      • Vollständig verwalteten Cluster erstellen
      • Selbstverwalteten Cluster erstellen
    • Instanz erstellen
      • A4X Max erstellen
      • A4X erstellen
      • A4- oder A3-Ultra-Cluster erstellen
      • A3 High- oder A3 Mega-Cluster erstellen
      • A3 Edge erstellen
      • A2 erstellen
      • G4 erstellen
      • G2 erstellen
      • N1-VM mit GPUs erstellen
    • Instanzen im Bulk erstellen
      • A4X Max erstellen
      • A4X erstellen
      • A4- oder A3-Ultra-Cluster erstellen
      • A3 High- oder A3 Mega-Cluster erstellen
      • A3 Edge erstellen
      • A2 erstellen
      • G4 erstellen
      • G2 erstellen
      • N1-VM mit GPUs erstellen
    • Eine verwaltete Instanzgruppe (MIG) erstellen
      • A4X Max erstellen
      • A4X erstellen
      • A4- oder A3-Ultra-Cluster erstellen
      • A3 High- oder A3 Mega-Cluster erstellen
      • A3 Edge erstellen
      • A2 erstellen
      • G4 erstellen
      • G2 erstellen
      • N1-VM mit GPUs erstellen
  • Arbeitslasten ausführen
  • Arbeitslasten mit Pathways on Cloud ausführen
    • Einführung in Pathways in der Cloud
    • GKE-Cluster mit Pathways erstellen
    • Batcharbeitslast mit Pathways ausführen
    • Interaktive Arbeitslast mit Pathways ausführen
    • Inferenz auf mehreren Hosts mit Pathways durchführen
    • Resilienztraining mit Pathways
    • JAX-Arbeitslasten zu Pathways portieren
    • Fehlerbehebung bei Pathways on Cloud
  • GKE-Arbeitslasten planen
    • Arbeitslasten mit Topology Aware Scheduling (TAS) planen
    • Knotenstatusvorhersage aktivieren
  • Arbeitslasten mit Kueue orchestrieren
  • Tutorials zu KI-Arbeitslasten
    • Übersicht
    • GPU
      • Inferenz mit vLLM in GKE ausführen
        • DeepSeek V3.1
        • DeepSeek V3.2-Speciale
        • Gemma 3
        • GPT-OSS
        • Llama 4
        • Qwen3
      • Feinabstimmung ausführen
        • Gemma 3 in einem GKE-Cluster
        • Gemma 3 in einem GKE-Cluster mit mehreren Hosts
        • Gemma 3 in einem Slurm-Cluster
        • Gemma 3 für Vision-Aufgaben in GKE
        • Llama 4 in einem Slurm-Cluster
        • Mixtral-8x7b in einem Slurm-Cluster
      • Training ausführen
        • Qwen2 in einem Slurm-Cluster
    • TPU
      • Arbeitslasten bereitstellen
        • Qwen2-7B mit vLLM auf TPUs bereitstellen
        • Qwen2-7B-Instruct mit vLLM auf TPUs bereitstellen
        • Qwen3-8B-Base mit vLLM auf TPUs bereitstellen
        • Llama-3.1-8B mit vLLM auf TPUs bereitstellen
      • Feinabstimmung ausführen
        • SFT für Gemma 4 31B auf einer TPU v6e mit mehreren Hosts ausführen
        • Überwachte Feinabstimmung auf einer TPU-VM mit MaxText ausführen
        • RL-Training auf einer TPU v6e-8-VM ausführen
        • Führe Multi-Host-RL-Training für Gemma 4 26B auf TPU v6e durch
        • Führe Multi-Host-RL-Training auf Qwen3-30B-A3B auf TPU v6e durch
  • Infrastruktur verwalten
  • GKE-Cluster verwalten
    • GKE-Knotentopologie ansehen
    • KI-optimierte GKE-Cluster verwalten
  • Instanzen und Slurm-Cluster verwalten
    • Topologie einer Instanz ansehen
    • Host-Events verwalten