기본 콘텐츠로 건너뛰기
문서
close
시작하기
Google Cloud 시작하기
제품 목록
Cloud Customer Care
추천 제품
Agent Platform
Apigee API 관리
BigQuery
Compute Engine은
Cloud CDN
Cloud Run
Cloud Storage
Cloud SQL
Gemini Enterprise
Google Kubernetes Engine
Looker
크로스 프로덕트 도구
액세스 및 리소스 관리
비용 및 사용량 관리
코드형 인프라
SDK, 언어, 프레임워크, 도구
기술 분야
AI 및 ML
애플리케이션 개발
애플리케이션 호스팅
컴퓨팅
데이터 분석 및 파이프라인
데이터베이스
분산, 하이브리드, 멀티 클라우드
업종별 솔루션
이전
네트워킹
모니터링 가능성 및 모니터링
보안
Storage
/
콘솔
English
Deutsch
Español – América Latina
Français
Indonesia
Italiano
Português – Brasil
עברית
中文 – 简体
中文 – 繁體
日本語
한국어
로그인
AI Hypercomputer
무료로 시작하기
개요
가이드
리소스
문서
더보기
개요
가이드
리소스
콘솔
Discover
개요
액셀러레이터 인프라 선택
조정자 및 배포 옵션 선택
가속기
GPU 가속기 정보
일반 GPU
클러스터링된 GPU
성능 최적화 인프라
네트워킹 서비스
GPU 네트워킹 개요
배포를 위한 네트워크 서비스
네트워킹 권장사항
스토리지 서비스
오픈 소프트웨어
OS 및 Docker 이미지
소비 옵션 선택
클러스터 관리
클러스터 관리 개요
클러스터 관리 구성
용어
시작하기
AI 인프라 계획 및 만들기
일반 GPU와 클러스터링된 GPU 중에서 선택
Gemini로 AI 인프라 설계
용량 및 할당량 가져오기
개요
용량 예약
예약된 용량 보기
빠른 시작
A4 VM으로 완전 관리형 Slurm 클러스터 만들기
A4 VM으로 자체 관리형 Slurm 클러스터 만들기
인프라 배포
배포 옵션 개요
압축 배치 정책 및 워크로드 정책 개요
AI 최적화 VM 및 클러스터 배포
GKE 클러스터 만들기
기본 구성으로 AI에 최적화된 GKE 클러스터 만들기
A4X Max를 사용하는 맞춤 AI 최적화 GKE 클러스터 만들기
A4X를 사용하는 맞춤 AI 최적화 GKE 클러스터 만들기
A4 또는 A3 Ultra를 사용하는 맞춤 AI 최적화 GKE 클러스터 만들기
A3 Mega 또는 A3 High를 사용하는 GKE Standard 클러스터 만들기
A3 Mega 또는 A3 High를 사용하는 GKE Autopilot 클러스터 만들기
A3 Edge를 사용하는 맞춤 AI 최적화 GKE 클러스터 만들기
A2를 사용하는 맞춤 AI 최적화 GKE 클러스터 만들기
G2 또는 G4를 사용하는 맞춤 AI 최적화 GKE 클러스터 만들기
N1을 사용하는 맞춤 AI 최적화 GKE 클러스터 만들기
Slurm 클러스터 만들기
완전 관리형 클러스터 만들기
자체 관리형 클러스터 만들기
인스턴스 만들기
A4X Max 만들기
A4X 만들기
A4 또는 A3 Ultra 만들기
A3 High 또는 A3 Mega 만들기
A3 Edge 만들기
A2 만들기
G4 만들기
G2 만들기
GPU가 포함된 N1 만들기
인스턴스 일괄 생성
A4X Max 만들기
A4X 만들기
A4 또는 A3 Ultra 만들기
A3 High 또는 A3 Mega 만들기
A3 Edge 만들기
A2 만들기
G4 만들기
G2 만들기
GPU가 포함된 N1 만들기
관리형 인스턴스 그룹(MIG) 만들기
A4X Max 만들기
A4X 만들기
A4 또는 A3 Ultra 만들기
A3 High 또는 A3 Mega 만들기
A3 Edge 만들기
A2 만들기
G4 만들기
G2 만들기
GPU가 포함된 N1 만들기
워크로드 실행
Cloud에서 Pathways로 워크로드 실행
Cloud의 학습 과정 소개
경로로 GKE 클러스터 만들기
Pathways로 일괄 워크로드 실행
경로를 사용하여 대화형 워크로드 실행
경로를 사용하여 멀티 호스트 추론 실행
학습 과정을 통한 탄력적인 학습
JAX 워크로드를 Pathways로 포팅
Pathways on Cloud 문제 해결
GKE 워크로드 예약
Topology Aware Scheduling (TAS)으로 워크로드 예약
노드 상태 예측 사용 설정
Kueue를 사용하여 워크로드 조정
AI 워크로드 튜토리얼
개요
GPU
GKE에서 vLLM으로 추론 실행