gke-observabilityGoogle官方放心用一键开启 GKE 集群的日志、监控与 Prometheus 指标采集。
本技能用于为 GKE 集群配置可观测性:自动启用 Cloud Logging 记录系统组件与工作负载日志、Cloud Monitoring 采集节点/工作负载/控制面指标,并开启 Google Managed Prometheus 抓取 PromQL 指标。它会通过 MCP 工具查看集群信息、事件、日志和资源详情,再通过 gcloud 命令更新集群的 logging、monitoring 及 dataplane observability 开关,最终覆盖 API Server、Scheduler 和 Controller Manager 等关键控制面指标。
适合在新建或运维 GKE 集群时统一开启监控与日志、排查调度延迟或 API 响应慢等集群级问题。前提是你已有 GKE 集群及 gcloud 操作权限,并启用了 Cloud Logging/Monitoring API。注意:它不能替代本地应用日志框架(如 logback、winston)或 Datadog 等外部 APM 的配置。
在下面找到你用的工具,复制命令粘进终端就装好了:
npx skills add google/skills 装好后不用任何配置,直接在对话里说:
帮我把这个 GKE 集群的日志、监控和 Managed Prometheus 全部打开。 AI 检测到任务匹配时会自动加载这个 Skill,不需要手动开关。
SKILL.md 不能。本技能只配置 GKE 集群层面的 Cloud Logging、Cloud Monitoring 和 Managed Prometheus,不会改动容器内本地日志框架或外部 APM。
需要对该 GKE 集群有 container.clusters.update 权限,并启用 Cloud Logging/Monitoring API。部分控制面指标可能要求特定 GKE 版本或机型。
控制面指标包括 API Server、Scheduler、Controller Manager,需额外开启;它们用于诊断集群级问题,如 API 响应慢、调度延迟或控制器卡死。