GPT中文GPT中文论坛社区AI工具软件大全 GPT.CC Claude Fable 5 · GPT-5.6 直连,不用连国际网 去看看 →
AI工具软件大全
首页 / Skill 技能 / GKE 计算类调度优化

GKE 计算类调度优化gke-compute-classesGoogle官方放心用

自动配置 GKE ComputeClass,按成本和加速器偏好调度 Pod。

作者:Google 仓库 google/skills ★ 15,198 核对于 2026-07-24
01

GKE 计算类调度优化 是干什么的

GKE ComputeClasses 是 GKE 用来封装节点配置与调度策略的抽象资源。装上这个 Skill 后,AI 能帮你创建、优化和排查 ComputeClass:比如为无状态负载配置 Spot VM 并保留按需回退策略,为 AI/ML 任务指定 L4、H100 等 GPU 或 v5p TPU 与特定机型家族(c3、c4、n4),利用 nodePoolAutoCreation 让 GKE 自动创建节点池而无需开启集群级 Node Auto Provisioning,还能处理 Pod 卡在 Pending、noScaleUp 等调度问题。生成 YAML 时会自动规避幻字段(如 spec.description、gvnic),使用 bootDiskSize 而非 bootDiskSizeGb,并提醒你将 machineFamily 与现有 CUD/Reservations 对齐。

适合场景:需要优化成本但又怕 Spot 中断、需要给 GPU/TPU 工作负载指定加速器、想通过 ComputeClass 做租户隔离或多团队共享限制等。坑点:手动节点池必须同时打 `cloud.google.com/compute-class=<NAME>` 标签和污点;自动节点池不要再重复加这个污点;GPU Pod 必须容忍 `nvidia.com/gpu`、Spot Pod 必须容忍 `cloud.google.com/gke-spot`,否则必 Pending。Stateful 工作负载还要注意不同代际磁盘的兼容问题。

配置 Spot 与回退策略指定 GPU/TPU 机型自动创建节点池排查 Pod 调度阻塞
02

怎么装 — 一行命令

在下面找到你用的工具,复制命令粘进终端就装好了:

其他兼容 Agent
npx skills add google/skills
通用安装器,列表里选 gke-compute-classes
03

装完第一句话怎么说

装好后不用任何配置,直接在对话里说:

帮我写一个 ComputeClass:优先 Spot,失败切到 N4 按需实例。

AI 检测到任务匹配时会自动加载这个 Skill,不需要手动开关。

04

安全体检 — 放心用

官方或可信来源出品,无危险脚本,按说明用即可。
装进来的是这些文件:
SKILL.mdassets/references/
想装前先看一眼?去仓库读源码 →
05

配这些工具用

06

常见问题

这个 Skill 还要开集群级 Node Auto Provisioning 吗?

不需要。GKE 1.33.3-gke.1136000 起,ComputeClass 自身的 `nodePoolAutoCreation.enabled: true` 就能在该 ComputeClass 范围内自动创建节点池,和集群级 NAP 是两回事。Skill 会帮你区分。

为什么 GPU/Spot Pod 一直 Pending?

GKE 会自动给 GPU 节点打 `nvidia.com/gpu:NoSchedule`,给 Spot 节点打 `cloud.google.com/gke-spot=true:NoSchedule`。AI 会提示你在 PodSpec 里加对应 toleration,而不是只加 ComputeClass 的容忍。

N4/C4 机型示例可以直接部署吗?

不能。那只是通用最佳实践,最终机型必须和你已有的 CUD 或 Reservations 对齐。Skill 会在 YAML 注释里提醒,部署前请按实际采购情况替换。

回 Skill 技能市集,或看 Claude Code 档案 了解宿主工具。