跳至主要内容
技术领域
close
AI 和机器学习
应用开发
应用托管
计算
数据分析和流水线
数据库
分布式云、混合云和多云
行业解决方案
迁移
网络
可观测性和监控
安全
Storage
跨产品工具
close
访问权限和资源管理
费用和用量管理
基础设施即代码
SDK、语言、框架和工具
/
控制台
English
Deutsch
Español – América Latina
Français
Indonesia
Italiano
Português – Brasil
עברית
中文 – 简体
中文 – 繁體
日本語
한국어
登录
AI Hypercomputer
免费开始使用吧
概览
指南
资源
技术领域
更多
概览
指南
资源
跨产品工具
更多
控制台
Discover
概览
选择加速器基础设施
选择编排器和部署选项
加速器
GPU 加速器简介
通用 GPU
集群 GPU
性能优化型基础架构
GPU 机器
网络服务
GPU 网络概览
部署的网络服务
网络最佳实践
存储服务
开源软件
操作系统映像和 Docker 映像
选择使用选项
集群管理
集群管理概览
集群管理配置
术语
开始使用
规划和创建 AI 基础架构
在通用 GPU 和集群 GPU 之间进行选择
获取容量和配额
概览
预留容量
查看预留容量
快速入门
创建具有 A4 虚拟机的全代管式 Slurm 集群
创建具有 A4 虚拟机的自行管理的 Slurm 集群
部署基础架构
部署选项概览
紧凑布置政策和工作负载政策概览
部署 AI 优化型虚拟机和集群
创建 GKE 集群
创建具有默认配置的 AI 优化型 GKE 集群
创建使用 A4X Max 的自定义 AI 优化型 GKE 集群
创建使用 A4X 的自定义 AI 优化型 GKE 集群
创建使用 A4 或 A3 Ultra 的自定义 AI 优化型 GKE 集群
创建使用 A3 Mega 或 A3 High 的 GKE Standard 集群
创建使用 A3 Mega 或 A3 High 的 GKE Autopilot 集群
创建 Slurm 集群
创建全代管式集群
创建自行管理的集群
创建实例
创建 A4X Max
创建 A4X
创建 A4 或 A3 Ultra
创建 A3 High 或 A3 Mega
创建 A3 Edge
创建 A2
创建 G4
创建 G2
创建具有 GPU 的 N1
批量创建实例
创建 A4X Max
创建 A4X
创建 A4 或 A3 Ultra
创建 A3 High 或 A3 Mega
创建 A3 Edge
创建 A2
创建 G4
创建 G2
创建具有 GPU 的 N1
创建一个托管式实例组 (MIG)
创建 A4X Max
创建 A4X
创建 A4 或 A3 Ultra
创建 A3 High 或 A3 Mega
创建 A3 Edge
创建 A2
创建 G4
创建 G2
创建具有 GPU 的 N1
运行工作负载
通过 Cloud 上的 Pathway 运行工作负载
Pathways on Cloud 简介
通过 Pathway 创建 GKE 集群
使用 Pathways 运行批量工作负载
使用 Pathways 运行交互式工作负载
使用 Pathways 执行多主机推理
通过 Pathways 进行弹性训练
将 JAX 工作负载移植到 Pathways
排查 Pathways on Cloud 问题
调度 GKE 工作负载
使用拓扑感知调度 (TAS) 安排工作负载
启用节点健康状况预测
使用 Kueue 编排工作负载
AI 工作负载教程
概览
GPU
在 GKE 上使用 vLLM 运行推理
DeepSeek V3.1
DeepSeek V3.2-Speciale