ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

如何10分钟生成生产级Agent蓝图:agents-best-practices的MVP Builder模式实战详解

如何10分钟生成生产级Agent蓝图:agents-best-practices的MVP Builder模式实战详解 如何10分钟生成生产级Agent蓝图agents-best-practices的MVP Builder模式实战详解【免费下载链接】agents-best-practicesProvider-neutral Agent Skill for Codex, Claude Code, and agentic harness design.项目地址: https://gitcode.com/gh_mirrors/ag/agents-best-practicesagents-best-practices是一个不依赖特定模型厂商的 Agent 技能Agent Skill能帮你在 10 分钟内为任意业务域生成一份生产级 Agent MVP 蓝图。它面向 Codex、Claude Code 等编码 Agent 设计核心模式MVP Builder会自动把帮我做一个 XX 助手这类模糊需求转化为包含核心循环、工具注册表、权限矩阵、安全审批、评测标准与上线检查清单的完整架构蓝图而不只是一段空泛的最佳实践建议。为什么你需要 MVP Builder 模式新手做 Agent 最常踩的坑是把一个大提示词 一个万能工具当作产品。结果 Agent 要么跑飞、要么越权、要么上下文一压缩就失忆。agents-best-practices 的核心理念是模型只负责提案运行时Harness负责校验、授权、执行、记录和返回观测。当你请求构建一个 Agent时技能会默认进入 MVP Builder 模式见 SKILL.md 中的MVP Builder Mode章节遵循 6 条纪律从你的领域和约束中推断合理的首版而不是反复追问用简短的假设声明代替阻塞式提问只设计最小但安全的可用版本蓝图必须覆盖核心循环、工具注册表、权限矩阵、上下文压缩、规划模式、可观测性、评测与上线路径高危动作默认标记为仅起草或需人工审批保持最小可靠的单循环架构除非你明确要求更复杂的形态一键安装3 种方式任选其一方式 A一条命令推荐适用于任意兼容 Agentnpx skills add DenisSergeevitch/agents-best-practices -g-g表示全局安装所有项目都能发现这个技能。方式 B让 AI Agent 帮你装直接把安装指令粘贴给 Codex 或 Claude Code让它把仓库克隆到用户级技能目录如~/.codex/skills/或~/.claude/skills/并校验SKILL.md和references/目录齐全。方式 C手动克隆git clone https://gitcode.com/gh_mirrors/ag/agents-best-practices.git ~/.claude/skills/agents-best-practices安装完成后技能会在对话涉及 Agent 架构、工具权限、上下文压缩、评测等话题时自动激活。第 1 步一句话描述业务场景不需要写需求文档直接用自然语言描述你要做的 Agent。比如帮我做一个客户续约风险 Agent能读 CRM、工单和使用量数据然后起草续约建议。技能会按 references/mvp-agent-blueprint.md 中的Domain Intake领域采集框架自动补齐 11 个关键维度领域、主要用户、核心任务、输入输出、数据源、风险等级、允许/禁止/需审批的动作、完成信号等。关键特性如果信息不足它会给出合理默认假设例如首版对不可逆动作采用审批门控Agent 只能读已授权的数据源不能未经审批执行高危操作——不会卡在反复确认上10 分钟节奏由此而来。第 2 步选定最低足够的自主级别蓝图会强制你从 5 个自主级别中选一个默认选 Level 1 或 Level 2级别行为适用场景L0 仅回答只读上下文并回答问答助手L1 仅起草产出建议/草稿人来提交报告、文案类 AgentL2 审批门控提动作 → 暂停 → 人批准 → 执行多数业务 Agent 的默认选择L3 策略内自主在明确策略内执行低风险动作需强日志与回滚L4 长期目标跨检查点、带预算追可量化目标基础运行时已稳定后这直接回答了新手最常被忽略的问题我的 Agent 到底能自己做主到什么程度第 3 步产出 16 章蓝图而非一句建议MVP Builder 的最终交付物是一份 16 章的MVP Agent Harness Blueprint覆盖从目标定义到首版检查清单的全部内容。以客户续约风险 Agent为例蓝图核心长这样核心循环用户任务 → 上下文构建 → 模型调用 → 工具提案 → Schema 校验 → 权限判定 → 执行或暂停 → 结构化观测 → 下一步或最终简报最小工具集只保留 5 个窄而带类型的工具如read_account_profile读私有数据、draft_customer_email起草外部消息、request_approval审批门——绝不暴露send_message、write_database这类万能工具发布门槛Launch Gate跑 20 个历史账户做轨迹审查确认无未审批的外部发送人类对至少 80% 的草稿动作表示认可完整的输出结构模板、权限矩阵模板、上下文组装顺序稳定前缀在前、易变状态在后利于提示词缓存都写在 references/mvp-agent-blueprint.md 中。如果你的场景是代码仓库 Agent读代码、改代码、开 PR蓝图会自动切换为编码 Agent 特化档案——起草 验证 解释而不是合并 部署 接管生产详见 references/coding-agents.md。第 4 步安全基线自动内置新手最不需要担心的部分MVP Builder 已经替你想好了每次工具调用必有结果拒绝、超时、参数错误、中止都作为结构化观测返回给模型循环不会卡死起草与提交分离draft_customer_email和send_customer_email是两个独立工具高危副作用必须有提示词之外的审批记录上下文压缩不失忆长会话压缩时保留的是活动计划、审批状态、待办和目标而不是聊天流水账可观测性每次运行的 trace 包含模型版本、暴露的工具、权限判定、成本与耗时用于复盘与审计更多护栏、威胁模型与上线安全门见 references/security-observability.md。第 5 步用清单验收再小范围上线蓝图自带一份首版发布检查清单例如Agent 只有一个核心任务每个工具有 Schema、风险等级、超时和输出上限循环有步数/Token/时间/成本预算密钥对模型不可见评测覆盖提示词注入、审批绕过、连接器故障与上下文溢出上线采用影子模式或受监控用户。全部条目可在 references/checklists.md 找到评测策略与轨迹评分细则在 references/evals.md。对照清单逐项打勾就能避免演示很惊艳、上线就翻车。常见误区速查 ⚡别在单循环跑通前就上多 Agent先让单 Agent 在评测中可测量地失败再谈拆分别把所有连接器一次挂满技能与外部工具应渐进披露先给名称描述用到再加载详情别用目标循环跑模糊待办清单目标模式只适合单一目标 预算 可验证完成条件别把安全押在提示词上必须靠运行时策略强制的代码就不能只靠提示词小结agents-best-practices 的 MVP Builder 模式把生产级 Agent从玄学变成了流水线一句话场景 → 自动假设 → 16 章蓝图 → 清单验收 → 小范围上线全程 10 分钟级。仓库内 20 篇参考文档references/目录覆盖了从循环不变量到评测体系的完整知识按需加载即可。下次要做一个业务 Agent 时不妨先让技能生成一份蓝图再决定怎么写代码。【免费下载链接】agents-best-practicesProvider-neutral Agent Skill for Codex, Claude Code, and agentic harness design.项目地址: https://gitcode.com/gh_mirrors/ag/agents-best-practices创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表