搜索
搜索结果
48 results for "google agents cli eval"

google-agents-cli-eval
当用户想要“运行评估”、“评估我的ADK智能体”、“编写评估数据集”、“分析评估失败原因”、“比较评估结果”、“优化智能体”,或需要Agent Platform评估方法论和质量飞轮方面的指导时,应使用此技能。涵盖评估指标、数据集模式、LLM作为评判的评分以及常见失败原因。不要用于API代码模式(使用google-agents-cli-adk-code)、部署(使用google-agents-cli-deploy)或项目脚手架(使用google-agents-cli-scaffold)。
google
google-agents-cli-deploy
当用户想要“部署 Agent”、“部署 ADK Agent”、“配置 CI/CD”、“配置 Secret 密钥”、“排查部署故障”,或需要关于 Agent Runtime、Cloud Run 或 GKE 部署目标的指导时,应使用此 Skill。 涵盖部署工作流、服务账号、版本回滚和生产基础设施。 属于 Google ADK (Agent Development Kit) Skill 套件的一部分。 切勿用于 API 代码模式(请使用 google-agents-cli-adk-code)、评估测试(请使用 google-agents-cli-eval)或项目脚手架搭建(请使用 google-agents-cli-scaffold)。
google
google-agents-cli-scaffold
当用户想要“创建 Agent 项目”、“启动新的 ADK 项目”、“帮我构建一个新 Agent”、“为项目添加 CI/CD”、“添加部署配置”、“增强现有项目”或“升级项目”时,应当使用此 Skill。 本 Skill 属于 Google ADK(Agent Development Kit)Skill 套件的一部分。 涵盖 `agents-cli scaffold create`、`scaffold enhance` 和 `scaffold upgrade` 命令、模板选项、部署目标以及原型优先(prototype-first)工作流。 请勿用于编写 Agent 代码(请使用 google-agents-cli-adk-code)或部署运维操作(请使用 google-agents-cli-deploy)。
google
google-agents-cli-observability
当用户想要“设置追踪”、“监控我的ADK代理”、“配置日志记录”、“添加可观测性”、“调试生产流量”,或需要关于监控已部署的ADK(Agent Development Kit)代理的指导时,应使用此技能。涵盖Cloud Trace、提示-响应日志记录、BigQuery Agent Analytics、第三方集成(AgentOps、Phoenix、MLflow等)以及故障排除。属于Google ADK(Agent Development Kit)技能套件的一部分。不要用于部署设置(使用google-agents-cli-deploy)或API代码模式(使用google-agents-cli-adk-code)。
google
agent-platform-eval-flywheel
使用“评估质量飞轮(Eval Quality Flywheel)”方法论,评估并持续提升 Google Cloud 上的 AI 模型与 Agent 质量。适用于:评估 Agent 或模型、构建评估数据集、挑选或编写评估指标、分析失败归因、对比修复前后的效果,以及需要 Agent Platform 评估方法论指导(包含数据集 Schema、LLM 裁判打分/LLM-as-judge 机制、常见失败原因)的场景。如果是模型微调需求,请使用 agent-platform-tuning;如果是通用生产部署,请使用 agent-platform-deploy。
google
google-agents-cli-adk-code
当用户想要“编写智能体代码”、“使用ADK构建智能体”、“添加工具”、“创建回调”、“定义智能体”、“使用状态管理”,或需要ADK(智能体开发工具包)Python API模式和代码示例时,应使用此技能。它是Google ADK技能套件的一部分。它提供了智能体类型、工具定义、编排模式、回调和状态管理的快速参考。不要用于创建新项目(使用google-agents-cli-scaffold)或部署(使用google-agents-cli-deploy)。
google
gws-people
Google People:管理联系人和个人资料。
googleworkspace
persona-exec-assistant
管理高管的日程、收件箱和通信。
googleworkspace
agent-eval
在自定义任务上对编码智能体(Claude Code、Aider、Codex 等)进行两两对比,包含通过率、成本、时间和一致性指标
affaan-m
agent-eval
Head-to-head comparison of coding agents (Claude Code, Aider, Codex, etc.) on custom tasks with pass rate, cost, time, and consistency metrics
affaan-m
google-agents-cli-workflow
此技能应在用户想要“开发智能体”、“使用 ADK 构建智能体”、“本地运行智能体”、“调试智能体代码”、“测试智能体”、“部署智能体”、“发布智能体”、“监控智能体”,或需要 ADK(智能体开发工具包)开发生命周期和编码指南时使用。构建 ADK 智能体的入口点。始终处于活动状态——提供完整的工作流程(脚手架、构建、评估、部署、发布、观察)、代码保留规则、模型选择指南以及 ADK 或任何智能体开发的故障排除步骤。
google
data-scraper-agent
Build a fully automated AI-powered data collection agent for any public source — job boards, prices, news, GitHub, sports, anything. Runs on a schedule, enriches data with a free LLM (Gemini Flash), stores results in Notion/Sheets/Supabase, and learns from user feedback. Runs 100% free on GitHub Actions. Use when the user wants to monitor, collect, or track any public data automatically.
affaan-m
agent-platform-inference
连接到 Google Cloud Agent Platform GenAI 模型并执行推理,包括第一方 Gemini 模型和第三方 OpenMaaS 模型(Llama、DeepSeek、Qwen 等)。当你需要生成调用 Gemini 或 OpenMaaS 模型的代码、使用 GenAI SDK、OpenAI SDK 或旧版 Agent Platform SDK 进行身份验证、配置基础 URL 和全局/区域端点,或排查 429 Resource Exhausted (DSQ)、400 User Validation 或 404 Not Found 错误时使用。不要用于将模型部署到端点或运行模型评估。
google
recipe-label-and-archive-emails
为匹配的邮件应用 Gmail 标签并归档,以保持收件箱整洁。
googleworkspace
google-agents-cli-publish
当用户想要“发布智能体”、“发布我的ADK智能体”、“向Gemini Enterprise注册智能体”、“发布到Gemini Enterprise”,或需要关于agents-cli publish gemini-enterprise命令的指导时,应使用此技能。当用户想要“在Agent Registry中管理智能体”或“列出/更新/删除已注册的智能体”时,也应使用此技能。涵盖ADK与A2A注册模式、编程式和交互式用法、标志参考、从部署元数据自动检测、Agent Registry集群管理以及故障排除。属于Google ADK(Agent Development Kit)技能套件的一部分。请勿用于部署(请使用google-agents-cli-deploy)。
google
seo-google
Google SEO API:Search Console(搜索分析、网址检查、站点地图)、PageSpeed Insights v5、CrUX 现场数据(含25周历史)、Indexing API v3 和 GA4 自然流量。提供真实的 Google 现场数据,涵盖核心网页指标、索引状态、搜索表现和自然流量趋势。当用户提到“搜索控制台”、“GSC”、“PageSpeed”、“CrUX”、“现场数据”、“索引 API”、“GA4 自然流量”、“网址检查”或“真实 CWV 数据”时使用。
agricidaniel
persona-sales-ops
管理销售工作流——跟踪交易、安排通话、客户沟通。
googleworkspace
ads-google
审计 Google Ads 的衡量、搜索、购物、效果最大化、需求生成、YouTube 关联库存、关键字和搜索词、否定关键字生成或审核、创意资产、出价、预算、设置和政策。用于 Google Ads、AdWords、搜索广告系列、搜索词报告、广泛否定、购物、效果最大化、PMax、需求生成、GAQL、Google 转化跟踪或 Google 广告系列优化。
agricidaniel
persona-it-admin
管理IT — 监控安全并配置Workspace。
googleworkspace
agent-platform-skill-registry
与 Gemini Enterprise Agent 平台技能注册表交互,创建和搜索可用技能。使用此技能让代理注册功能或发现新能力。
google
agent-platform-alert-configuration
基于 OpenTelemetry (OTel) 指标为 AI Agent 配置最佳实践告警策略。适用于分析、编写或部署告警策略,以监控 Agent 的延迟、错误率、Token 消耗及质量指标。注意:可靠性(Reliability)、成本(Cost)、安全防护(Safety)和系统安全(Security)告警使用通用 OTel 指标,支持跨运行时生效(如 Cloud Run、Vertex AI 等);而质量(Quality)告警依赖 Vertex AI Online Monitors,仅适用于 Vertex AI 部署环境。
google
evaluation-methodology
PluginEval 质量方法论——维度、评分标准、统计方法和评分公式。当需要理解插件质量如何衡量、解读某个维度的低分、决定如何提高技能的触发准确性或编排适配性、为市场校准评分阈值,或向 Neon 等外部合作伙伴解释质量徽章时,使用此技能。
wshobson
agentic-eval
评估和改进AI智能体输出的模式与技术。使用此技能的场景: - 实现自我批评与反思循环 - 构建评估器-优化器流水线以进行质量关键型生成 - 创建测试驱动的代码优化工作流 - 设计基于评分标准或LLM作为评判的评估系统 - 为智能体输出(代码、报告、分析)添加迭代改进 - 衡量并提升智能体响应质量
github
agent-platform-tuning
Agent Platform 模型微调。当需要使用 Agent Platform 基础设施微调开源模型(Open Models)或 Gemini 模型时使用此 Skill。请勿用于 Agent Platform 之外的模型训练、将模型部署到 Endpoint(请使用 `agent-platform-deploy`),或管理推理服务 Endpoint(请使用 `agent-platform-endpoint-management`)。
google