기본 콘텐츠로 건너뛰기
문서
시작하기
Google Cloud 시작하기
제품 목록
Cloud Customer Care
추천 제품
Agent Platform
Apigee API 관리
BigQuery
Compute Engine은
Cloud CDN
Cloud Run
Cloud Storage
Cloud SQL
Gemini Enterprise
Google Kubernetes Engine
Looker
크로스 프로덕트 도구
액세스 및 리소스 관리
비용 및 사용량 관리
코드형 인프라
SDK, 언어, 프레임워크, 도구
기술 분야
AI 및 ML
애플리케이션 개발
애플리케이션 호스팅
컴퓨팅
데이터 분석 및 파이프라인
데이터베이스
분산, 하이브리드, 멀티 클라우드
업종별 솔루션
이전
네트워킹
모니터링 가능성 및 모니터링
보안
Storage
/
콘솔
English
Deutsch
Español – América Latina
Français
Indonesia
Italiano
Português – Brasil
עברית
中文 – 简体
中文 – 繁體
日本語
한국어
AI Hypercomputer
무료로 시작하기
개요
가이드
리소스
문서
더보기
개요
가이드
리소스
콘솔
Discover
개요
액셀러레이터 인프라 선택
조정자 및 배포 옵션 선택
가속기
GPU 가속기 정보
일반 GPU
클러스터링된 GPU
성능 최적화 인프라
네트워킹 서비스
GPU 네트워킹 개요
배포를 위한 네트워크 서비스
네트워킹 권장사항
스토리지 서비스
오픈 소프트웨어
OS 및 Docker 이미지
소비 옵션 선택
클러스터 관리
클러스터 관리 개요
클러스터 관리 구성
용어
시작하기
AI 인프라 계획 및 만들기
일반 GPU와 클러스터링된 GPU 중에서 선택
Gemini로 AI 인프라 설계
용량 및 할당량 가져오기
개요
용량 예약
예약된 용량 보기
빠른 시작
A4 VM으로 완전 관리형 Slurm 클러스터 만들기
A4 VM으로 자체 관리형 Slurm 클러스터 만들기
인프라 배포
배포 옵션 개요
압축 배치 정책 및 워크로드 정책 개요
AI 최적화 VM 및 클러스터 배포
GKE 클러스터 만들기
Cluster Toolkit으로 AI 최적화 GKE 클러스터 만들기
A4X Max를 사용하는 AI 최적화 GKE 클러스터 만들기
A4X를 사용하는 AI 최적화 GKE 클러스터 만들기
A4 또는 A3 Ultra를 사용하는 AI 최적화 GKE 클러스터 만들기
A3 Mega 또는 A3 High를 사용하는 GKE Standard 클러스터 만들기
A3 Mega 또는 A3 High를 사용하는 GKE Autopilot 클러스터 만들기
A3 Edge를 사용하는 AI 최적화 GKE 클러스터 만들기
A2를 사용하는 AI 최적화 GKE 클러스터 만들기
G2 또는 G4를 사용하는 AI 최적화 GKE 클러스터 만들기
N1을 사용하는 AI 최적화 GKE 클러스터 만들기
Slurm 클러스터 만들기
완전 관리형 클러스터 만들기
자체 관리형 클러스터 만들기
인스턴스 만들기
A4X Max 만들기
A4X 만들기
A4 또는 A3 Ultra 만들기
A3 High 또는 A3 Mega 만들기
A3 Edge 만들기
A2 만들기
G4 만들기
G2 만들기
GPU가 포함된 N1 만들기
인스턴스 일괄 생성
A4X Max 만들기
A4X 만들기
A4 또는 A3 Ultra 만들기
A3 High 또는 A3 Mega 만들기
A3 Edge 만들기
A2 만들기
G4 만들기
G2 만들기
GPU가 포함된 N1 만들기
관리형 인스턴스 그룹(MIG) 만들기
A4X Max 만들기
A4X 만들기
A4 또는 A3 Ultra 만들기
A3 High 또는 A3 Mega 만들기
A3 Edge 만들기
A2 만들기
G4 만들기
G2 만들기
GPU가 포함된 N1 만들기
워크로드 실행
Cloud에서 Pathways로 워크로드 실행
Cloud의 학습 과정 소개
경로로 GKE 클러스터 만들기
Pathways로 일괄 워크로드 실행
경로를 사용하여 대화형 워크로드 실행
경로를 사용하여 멀티 호스트 추론 실행
학습 과정을 통한 탄력적인 학습
JAX 워크로드를 Pathways로 포팅
Pathways on Cloud 문제 해결
GKE 워크로드 예약
Topology Aware Scheduling (TAS)으로 워크로드 예약
노드 상태 예측 사용 설정
Kueue를 사용하여 워크로드 조정
AI 워크로드 튜토리얼
개요
GPU
GKE에서 vLLM으로 추론 실행
DeepSeek V3.1
DeepSeek V3.2-Speciale
Gemma 3는
GPT-OSS
Llama 4
Qwen3
미세 조정 실행
GKE 클러스터의 Gemma 4
멀티 호스트 GKE 클러스터의 Gemma 3
Slurm 클러스터의 Gemma 3
GKE의 비전 작업을 위한 Gemma 3
Slurm 클러스터의 Llama 4
Slurm 클러스터의 Mixtral-8x7b
학습 실행
Slurm 클러스터의 Qwen2
TPU
워크로드 제공
TPU에서 vLLM으로 Qwen2-7B 서빙
TPU에서 vLLM으로 Qwen2-7B-Instruct 서빙
TPU에서 vLLM으로 Qwen3-8B-Base 서빙
TPU에서 vLLM으로 Llama-3.1-8B 서빙
미세 조정 실행
멀티 호스트 TPU v6e에서 Gemma 4 31B의 SFT 실행
MaxText를 사용하여 TPU VM에서 지도 미세 조정 실행
v6e-8 TPU VM에서 RL 학습 실행
TPU v6e에서 Gemma 4 26B에 대한 멀티 호스트 RL 학습을 실행합니다.
TPU v6e에서 Qwen3-30B-A3B에 대한 멀티 호스트 RL 학습을 실행합니다.
인프라 관리
GKE 클러스터 관리
GKE 노드 토폴로지 보기
AI 최적화 GKE 클러스터 관리
인스턴스 및 Slurm 클러스터 관리
인스턴스의 토폴로지 보기
호스트 이벤트 관리
인스턴스에서 이벤트 호스팅
예약의 호스트 이벤트
오작동하는 호스트 신고
테스트 및 최적화
NCCL/gIB를 사용하여 클러스터 네트워킹 최적화
워크로드에 NCCL/gIB 통합
gIB NCCL 플러그인 설치
NVIDIA NGC 컨테이너에서 gIB NCCL 플러그인 사용
NCCL 테스트 실행
Compute Engine 인스턴스에서 NCCL 실행
Cluster Toolkit을 사용하는 GKE 클러스터에서 NCCL 실행
A4X Max를 사용하는 GKE 클러스터에서 NCCL 실행
A4X를 사용하는 GKE 클러스터에서 NCCL 실행
A4 또는 A3 Ultra를 사용하는 GKE 클러스터에서 NCCL 실행
A3 Mega 또는 A3 High를 사용하는 GKE 클러스터에서 NCCL 실행
A3 Edge를 사용하는 GKE 클러스터에서 NCCL 실행
Slurm 클러스터에서 NCCL 실행
문제 해결을 위해 NCCL 로그 수집 및 이해
레시피로 워크로드 테스트
벤치마킹 레시피
Goodput 최적화 레시피
NCCL/gIB 출시 노트
NCCL/gIB 출시 노트 (x86 64비트)
NCCL/gIB 출시 노트 (ARM 64비트)
모니터링
VM 및 Slurm 클러스터 모니터링
CoMMA에서 NCCL 원격 분석을 수집하는 방식 관리
집단 커뮤니케이션 분석기 (CoMMA)
CoMMA 사용 설정, 사용 중지, 구성
문제 해결
알려진 문제
느린 성능 문제 해결
오작동하는 호스트 신고 문제 해결
CoMMA 문제 해결
시작하기
Google Cloud 시작하기
제품 목록
Cloud Customer Care
추천 제품
Agent Platform
Apigee API 관리
BigQuery
Compute Engine은
Cloud CDN
Cloud Run
Cloud Storage
Cloud SQL
Gemini Enterprise
Google Kubernetes Engine
Looker
크로스 프로덕트 도구
액세스 및 리소스 관리
비용 및 사용량 관리
코드형 인프라
SDK, 언어, 프레임워크, 도구
기술 분야
AI 및 ML
애플리케이션 개발
애플리케이션 호스팅
컴퓨팅
데이터 분석 및 파이프라인
데이터베이스
분산, 하이브리드, 멀티 클라우드
업종별 솔루션
이전
네트워킹
모니터링 가능성 및 모니터링
보안
Storage
Google은 AI 기술을 사용하여 콘텐츠를 사용자의 기본 언어로 번역합니다. AI 번역에는 오류가 있을 수 있습니다.