agent-platform-inferenceGoogle官方放心用让 AI 帮你生成代码并调试 Google Agent Platform 上大模型调用。
该技能用于连接 Google Cloud Agent Platform 的 GenAI 服务并执行模型推理。它覆盖两类模型:Google 自研 Gemini 模型,以及 OpenMaaS 第三方开源模型(如 Llama、DeepSeek、Qwen)。根据你指定的模型家族和 SDK(GenAI SDK、OpenAI SDK 或 legacy Vertex AI SDK),AI 会生成对应的调用代码,指导你完成 gcloud 登录、ADC 认证、启用 aiplatform API、创建 Python 虚拟环境并安装依赖。它还会帮你配置 global 或 regional endpoint、base URL,并诊断 429 Resource Exhausted、400 User Validation、404 Not Found 等常见报错。执行实际推理前,AI 会停下来让你确认模型 ID、SDK 和输入提示等关键信息,不会悄悄跑请求。
适合需要在 GCP Agent Platform 上调用 Gemini 或开源大模型的开发者,尤其是不知道该用哪个 SDK、如何配认证,或者遇到 429/400/404 报错时。前提是你已有 Google Cloud 项目、能执行 gcloud 命令,并已开启 Vertex AI / Agent Platform API。注意它只负责推理调用和排错,不能部署模型或跑评估;模型 ID 和可用区域经常变化,务必以官方文档为准;每次运行 Python 脚本前都要先激活虚拟环境。
在下面找到你用的工具,复制命令粘进终端就装好了:
npx skills add google/skills 装好后不用任何配置,直接在对话里说:
我要用 GenAI SDK 调用 gemini-2.5-pro,帮我写一段 Python 代码并告诉我怎么认证。 AI 检测到任务匹配时会自动加载这个 Skill,不需要手动开关。
SKILL.mdscripts/ 它面向 Google Cloud Agent Platform,既支持 Gemini,也支持 OpenMaaS 第三方模型(Llama/DeepSeek/Qwen),会帮你处理 GCP 认证、端点配置、SDK 选择和错误排查,而不只是发一个 HTTP 请求。
调用云端模型会消耗配额和费用。Skill 规定执行推理脚本前必须展示模型 ID、SDK 和输入提示,等你回复 Yes 后再运行,避免误操作或意外开销。
Skill 里的模型 ID 只是示例,可能过时。Gemini 模型请查看 Gemini Models 官方文档,OpenMaaS 模型查看 Use Open Models on Agent Platform 文档,按实际区域和可用性选择。