メイン コンテンツにスキップ
Google Cloud Documentation
テクノロジー分野
  • AI と ML
  • アプリケーション開発
  • アプリケーションのホスティング
  • コンピューティング
  • データ分析とパイプライン
  • データベース
  • 分散型クラウド、ハイブリッド クラウド、マルチクラウド
  • 業種別ソリューション
  • 移行
  • ネットワーキング
  • オブザーバビリティとモニタリング
  • セキュリティ
  • Storage
プロダクト横断型のツール
  • アクセスとリソースの管理
  • 費用と使用量の管理
  • Infrastructure as code
  • SDK、言語、フレームワーク、ツール
/
コンソール
  • English
  • Deutsch
  • Español – América Latina
  • Français
  • Indonesia
  • Italiano
  • Português – Brasil
  • עברית
  • 中文 – 简体
  • 中文 – 繁體
  • 日本語
  • 한국어
ログイン
  • AI Hypercomputer
無料で利用開始
概要 ガイド リソース
Google Cloud Documentation
  • テクノロジー分野
    • その他
    • 概要
    • ガイド
    • リソース
  • プロダクト横断型のツール
    • その他
  • コンソール
  • Discover
  • 概要
  • パフォーマンス最適化インフラストラクチャ
    • GPU マシン
    • ネットワーク サービス
      • GPU ネットワーキングの概要
      • デプロイ用のネットワーク サービス
      • ネットワーキングのベスト プラクティス
    • ストレージ サービス
  • オープン ソフトウェア
    • OS イメージと Docker イメージ
  • 使用オプションを選択する
  • クラスタ管理
    • 概要
    • 構成
  • 用語
  • 使ってみる
  • クラスタ作成の概要
  • Gemini を使用してインフラストラクチャを設計する
  • 推奨構成
  • 容量と割り当てを取得する
    • 概要
    • 容量の予約
    • 予約済みの容量を表示する
  • クイックスタート
    • A4 VM を使用してフルマネージド Slurm クラスタを作成する
    • A4 VM を使用してセルフマネージド Slurm クラスタを作成する
  • インフラストラクチャをデプロイする
  • デプロイ オプションの概要
  • コンパクト プレースメント ポリシーとワークロード ポリシーの概要
  • AI 最適化 VM とクラスタをデプロイする
    • GKE クラスタを作成する
      • デフォルト構成で AI に最適化された GKE クラスタを作成する
      • A4X Max を使用するカスタム AI 最適化 GKE クラスタを作成する
      • A4X を使用するカスタム AI 最適化 GKE クラスタを作成する
      • A4 または A3 Ultra を使用するカスタム AI 最適化 GKE クラスタを作成する
      • A3 Mega または A3 High を使用する GKE Standard クラスタを作成する
      • A3 Mega または A3 High を使用する GKE Autopilot クラスタを作成する
    • Slurm クラスタを作成する
      • フルマネージド クラスタを作成する
      • セルフマネージド クラスタを作成する
    • インスタンスを作成する
      • A4X Max を作成する
      • A4X を作成する
      • A4 または A3 Ultra を作成する
      • A3 High または A3 Mega を作成する
    • インスタンスを一括作成する
      • A4X Max を作成する
      • A4X を作成する
      • A4 または A3 Ultra を作成する
      • A3 High または A3 Mega を作成する
    • マネージド インスタンス グループ(MIG)を作成する
      • A4X Max を作成する
      • A4X を作成する
      • A4 または A3 Ultra を作成する
      • A3 High または A3 Mega を作成する
  • ワークロードを実行
  • Pathways on Cloud でワークロードを実行する
    • Pathways on Cloud の概要
    • Pathways を使用して GKE クラスタを作成する
    • Pathways でバッチ ワークロードを実行する
    • Pathways でインタラクティブなワークロードを実行する
    • Pathways を使用してマルチホスト推論を実行する
    • Pathways を使用した復元力のあるトレーニング
    • JAX ワークロードを Pathways に移植する
    • Pathways on Cloud のトラブルシューティング
  • GKE ワークロードをスケジュールする
    • トポロジ対応スケジューリング(TAS)でワークロードをスケジュールする
    • ノードの健全性予測を有効にする
  • Kueue を使用してワークロードをオーケストレートする
  • AI ワークロードのチュートリアル
    • 概要
    • GPU
      • GKE で vLLM を使用して推論を実行する
        • DeepSeek V3.1
        • DeepSeek V3.2-Speciale
        • Gemma 3
        • GPT-OSS
        • Llama 4
        • Qwen3
      • ファインチューニングを実行する
        • GKE クラスタ上の Gemma 3
        • Slurm クラスタ上の Gemma 3
        • GKE のビジョン タスク用の Gemma 3
        • Slurm クラスタ上の Llama 4
        • Slurm クラスタ上の Mixtral-8x7b
      • トレーニングを実行
        • Slurm クラスタ上の Qwen2
    • TPU
      • ワークロードをサービングする