メイン コンテンツにスキップ
ドキュメント
開始する
Google Cloud を使ってみる
商品リスト
Cloud カスタマーケア
注目のプロダクト
Agent Platform
Apigee API 管理
BigQuery
Compute Engine
Cloud CDN
Cloud Run
Cloud Storage
Cloud SQL
Gemini Enterprise
Google Kubernetes Engine
Looker
プロダクト横断型のツール
アクセスとリソースの管理
費用と使用量の管理
Infrastructure as code
SDK、言語、フレームワーク、ツール
テクノロジー分野
AI と ML
アプリケーション開発
アプリケーションのホスティング
コンピューティング
データ分析とパイプライン
データベース
分散型クラウド、ハイブリッド クラウド、マルチクラウド
業種別ソリューション
移行
ネットワーキング
オブザーバビリティとモニタリング
セキュリティ
Storage
/
コンソール
English
Deutsch
Español – América Latina
Français
Indonesia
Italiano
Português – Brasil
עברית
中文 – 简体
中文 – 繁體
日本語
한국어
AI Hypercomputer
無料で利用開始
概要
ガイド
リソース
ドキュメント
その他
概要
ガイド
リソース
コンソール
Discover
概要
アクセラレータ インフラストラクチャを選択する
オーケストレーターとデプロイ オプションを選択する
アクセラレータ
GPU アクセラレータについて
汎用 GPU
クラスタ化された GPU
パフォーマンス最適化インフラストラクチャ
ネットワーク サービス
GPU ネットワーキングの概要
デプロイ用のネットワーク サービス
ネットワーキングのベスト プラクティス
ストレージ サービス
オープン ソフトウェア
OS イメージと Docker イメージ
使用オプションを選択する
クラスタ管理
クラスタ管理の概要
クラスタ管理の構成
用語
使ってみる
AI インフラストラクチャを計画して作成する
汎用 GPU とクラスタ化された GPU のどちらかを選択する
Gemini を使用して AI インフラストラクチャを設計する
容量と割り当てを取得する
概要
容量の予約
予約済みの容量を表示する
クイックスタート
A4 VM を使用してフルマネージド Slurm クラスタを作成する
A4 VM を使用してセルフマネージド Slurm クラスタを作成する
インフラストラクチャをデプロイする
デプロイ オプションの概要
コンパクト プレースメント ポリシーとワークロード ポリシーの概要
AI 最適化 VM とクラスタをデプロイする
GKE クラスタを作成する
Cluster Toolkit を使用して AI 最適化 GKE クラスタを作成する
A4X Max を使用する AI 最適化 GKE クラスタを作成する
A4X を使用する AI 最適化 GKE クラスタを作成する
A4 または A3 Ultra を使用する AI 最適化 GKE クラスタを作成する
A3 Mega または A3 High を使用する GKE Standard クラスタを作成する
A3 Mega または A3 High を使用する GKE Autopilot クラスタを作成する
A3 Edge を使用する AI 最適化 GKE クラスタを作成する
A2 を使用する AI 最適化 GKE クラスタを作成する
G2 または G4 を使用する AI 最適化 GKE クラスタを作成する
N1 を使用する AI 最適化 GKE クラスタを作成する
Slurm クラスタを作成する
フルマネージド クラスタを作成する
セルフマネージド クラスタを作成する
インスタンスを作成する
A4X Max を作成する
A4X を作成する
A4 または A3 Ultra を作成する
A3 High または A3 Mega を作成する
A3 Edge を作成する
A2 を作成する
G4 を作成する
Create G2
GPU を使用して N1 を作成する
インスタンスを一括作成する
A4X Max を作成する
A4X を作成する
A4 または A3 Ultra を作成する
A3 High または A3 Mega を作成する
A3 Edge を作成する
A2 を作成する
G4 を作成する
Create G2
GPU を使用して N1 を作成する
マネージド インスタンス グループ(MIG)を作成する
A4X Max を作成する
A4X を作成する
A4 または A3 Ultra を作成する
A3 High または A3 Mega を作成する
A3 Edge を作成する
A2 を作成する
G4 を作成する
Create G2
GPU を使用して N1 を作成する
ワークロードを実行
Pathways on Cloud でワークロードを実行する
Pathways on Cloud の概要
Pathways を使用して GKE クラスタを作成する
Pathways でバッチ ワークロードを実行する
Pathways でインタラクティブなワークロードを実行する
Pathways を使用してマルチホスト推論を実行する
Pathways を使用した復元力のあるトレーニング
JAX ワークロードを Pathways に移植する
Pathways on Cloud のトラブルシューティング
GKE ワークロードをスケジュールする
トポロジ対応スケジューリング(TAS)でワークロードをスケジュールする
ノードの健全性予測を有効にする
Kueue を使用してワークロードをオーケストレートする
AI ワークロードのチュートリアル
概要
GPU
GKE で vLLM を使用して推論を実行する
DeepSeek V3.1
DeepSeek V3.2-Speciale
Gemma 3
GPT-OSS
Llama 4
Qwen3
ファインチューニングを実行する
GKE クラスタ上の Gemma 4
マルチホスト GKE クラスタ上の Gemma 3
Slurm クラスタ上の Gemma 3
GKE のビジョン タスク用の Gemma 3
Slurm クラスタ上の Llama 4
Slurm クラスタ上の Mixtral-8x7b
トレーニングを実行
Slurm クラスタ上の Qwen2
TPU
ワークロードをサービングする
TPU で vLLM を使用して Qwen2-7B をサービングする
TPU で vLLM を使用して Qwen2-7B-Instruct をサービングする
TPU で vLLM を使用して Qwen3-8B-Base をサービングする
TPU で vLLM を使用して Llama-3.1-8B をサービングする
ファインチューニングを実行する
マルチホスト TPU v6e で Gemma 4 31B の SFT を実行する
MaxText を使用して TPU VM で教師ありファインチューニングを実行する
v6e-8 TPU VM で RL トレーニングを実行する
TPU v6e 上で Gemma 4 26B のマルチホスト RL トレーニングを実行する
TPU v6e 上の Qwen3-30B-A3B でマルチホスト RL トレーニングを実行する
インフラストラクチャの管理
GKE クラスタを管理する
GKE ノード トポロジを表示する
AI 向けに最適化された GKE クラスタを管理する
インスタンスと Slurm クラスタを管理する
インスタンスのトポロジを表示する
ホストイベントを管理する
インスタンスでイベントをホストする
予約内のホスト イベント
障害のあるホストを報告する
テストと最適化
NCCL/gIB を使用してクラスタ ネットワーキングを最適化する
ワークロードへの NCCL/gIB の統合
gIB NCCL プラグインをインストールする
NVIDIA NGC コンテナで gIB NCCL プラグインを使用する
NCCL テストを実行する
Compute Engine インスタンスで NCCL を実行する
Cluster Toolkit を使用する GKE クラスタで NCCL を実行する
A4X Max を使用する GKE クラスタで NCCL を実行する
A4X を使用する GKE クラスタで NCCL を実行する
A4 または A3 Ultra を使用する GKE クラスタで NCCL を実行する
A3 Mega または A3 High を使用する GKE クラスタで NCCL を実行する
A3 Edge を使用する GKE クラスタで NCCL を実行する
Slurm クラスタで NCCL を実行する
トラブルシューティングのために NCCL ログを収集して理解する