ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

【唤醒实战笔记】2026-09-29 | 智能体提示词迭代史(v1 → v8)

【唤醒实战笔记】2026-09-29 | 智能体提示词迭代史(v1 → v8) 【唤醒实战笔记】2026-09-29 | 智能体提示词迭代史v1 → v8date: 2026-09-29tags: [HarmonyOS, 提示词工程, 小艺开放平台, 智能体, LLM, 端云协作, 迭代]type: 实战笔记一、先看两张对比同一个智能体同一个分析模型角色两个月前和现在的提示词开头几乎认不出是同一个东西v1 开头你是「唤醒」的大脑在一个三人系统中工作你大脑→ FC模型手→ 你大脑→ FC模型手→ … → 聊天模型嘴v8 开头你是「唤醒」的决策者在一个多模型协作系统中工作。工具模型FC翻译者。它把你的意图声明翻译成结构化调用参数JSON……它不再转述结果。v1 的核心规则最多 5 轮你→FC→你→FC 最多循环 5 轮仍不足则输出【信息足够】v8 的核心规则同一件事续轮三段式铁律禁止从用户消息重新推理复述最新执行 → 2. 对照目标评估 → 3. 决策三选一两相对照最大的变化不是更长了而是角色变了、推进方式变了、刹车方式变了。而这三个变化没有一个是我想优化一下主动写出来的——每一个都是被一个具体的线上故障逼出来的。这个智能体的提示词从 v1 到 v8 迭代了八个版本跨四个模型角色分析 / FC / 存储分析 / 聊天。这篇笔记不准备把八个版本逐一列一遍而是讲清楚一件事每一版升级的背后都躺着一个具体的故障。二、v1一个靠定计划硬推的决策者最初的 v1 分析模型本质是一个写步骤清单的规划器收到任务先输出计划1. [步骤1] → 2. [步骤2] → 3. [步骤3]然后当前调 [工具名] [action][参数] 填 [值]循环继续时输出已完成1. [步骤1] → 2. [步骤2]下一步调 [工具]推进靠计划 步骤编号刹车靠硬编码的最多 5 轮。工具表里有 8 个工具InfoManage、GoalManage、ActionManage、BlockStore、OutlineUpdate、OutlineRead、CurrentTime、LogRetrieve。这个版本最大的隐患其实已经埋下了——它把走到哪一步这个状态完全交给了模型自己在每轮重新生成的计划里维护。模型没有真实的内存它每轮都是从头开始想。一个靠我记得我做到第 3 步了来推进的系统迟早会循环。这一点就是下面第三节要讲的循环问题最多 5 轮这个硬刹车也正是在那里被证明是无效的。三、第一代进化v2/v3从提取信息到方法论8 月 3 日产品方向迎来一次根本转折唤醒方法论完整确立条件池 目标树 递归拆解从信息提取升级为条件挖掘 目标拆解。在这之前端侧做的是信息提取实体识别、分词、事件提取智能体的定位是把用户的话记下来。这一天之后定位变成了规划——核心循环定目标 → 列出达成目标需要的条件 → 条件池检索 → 找缺口 → 缺口变子目标 → 递归 → 直到明天可行支撑它的一句话哲学是没有约束只有代价。AI 展开代价人决定走不走。提示词在这一代经历的是定位升级它不再是提取字段而是规划对话。相应地提示词里开始出现条件池“缺口”递归这些概念工具也从单纯的信息存取扩展出 GoalManage目标树、条件池这套体系。这一代最大的价值不是技术是把提示词从说明书升级成了世界观——后面所有迭代都是在让模型更准确地执行这套世界观。四、第二代进化v6/v7主循环的三场病方法论确立后智能体真正跑起来了然后循环问题开始集中爆发。两天之内连续暴露了三个。病一循环根因——v7 缺续轮模板现象多段轮次日志里模型像卡带一样重复——相同的 search 连发 4 次用户打断另一次连发 4 次后第 5 轮才自纠。根因v7 提示词只有从用户消息起手的首轮模板没有续轮模板。于是模型每一轮都从用户消息重新推理确定性地产出同样的结论——逐字重复。之前观察到的自纠只是碰巧从历史起手的轮次纯概率不可依赖。修复v8 加入续轮三段式——复述最新执行 → 对照目标评估 → 三选一决策并规定思考历史末尾已有 [调用]/[返回] 记录就是续轮禁止再从用户消息重新推导。这就是 v1 那个靠计划硬推隐患的正式爆发。它证明了我做到第几步了不能靠模型记必须靠外部给它的已执行记录来判断当前位置。病二放弃平台的提问节点——时间限制 撑爆上下文现象提示词里最初写了大量提问路径——遇到模糊指令就反问用户。根因平台其实有提问节点但不好用。一是提问节点有时间限制卡在等待用户回答上用户体验太差二是它可能让当前轮次无限扩展上下文容易把上下文撑爆。权衡之后选择了放弃提问节点。替代方案需要用户确认时分析模型直接结束当前轮退出循环交付摘要写明需要用户决定[事项与候选]由聊天模型转述给用户用户下轮回答再执行。教训平台的某个节点能用和好用是两回事。提问节点解决的是要不要问用户但代价是时间限制和上下文膨胀——当这个代价超过收益放弃它、自己设计一条更可控的路径比硬套平台能力更划算。病三零工具轮次却宣称已完成现象分析模型没调任何工具直答路径却回复用户已经完成了。修复双向约束——分析模型侧“完成类措辞必须有思考历史里的工具返回支撑”聊天模型侧“无工具返回支撑的完成宣称不可信零工具轮回复禁止完成类表述”。教训这是LLM 假装干活的变体。模型的文字里说完成了不代表它真的调过工具。必须在**产出端分析模型和转述端聊天模型**同时加约束因为模型会自己说服自己。五、第三代进化v8规则精细化到了 v8主循环的框架稳了问题从跑不起来变成了细节上跑错。这一代的特点是一堆精细规则每条都对应一个具体故障。复合关键词查空现象模型把多个关键词塞进一个 query如 query“淮南费用”端插件按整串子串匹配必然查空 → 触发空结果即最终答案 → 向用户误报确实没有。修复单关键词铁律——金力和费用必须写成两行意图。因为端插件不支持分隔符决定插件不动改提示词。查改混批现象“查询某任务详情”更新该任务为完成同批发出。模型思考里明明制定了先确认再更新的串行计划却拍平成批量——更新在查询返回前就执行了。若查询证伪了前提错误写入不可逆。修复意图声明规则新增决策依赖定义——后一步是否执行、取决于前一步结果的必须拆轮等待。并加自检反问“若前一条的返回与预期完全不同这条还照做吗不确定或否 拆轮。”两步确认闭环现象信息写操作需要先亮方案、用户确认、再执行但确认链要经聊天模型转述——转述版是唯一存世的方案文本转述稍有偏差存储的就不是用户确认的那份。修复聊天模型加方案保真规则逐字转述分析模型执行轮以对话历史中被确认的方案文本为准。用户确认的和实际存储的必须是同一份文本。越界提取撞车现象同一轮内同一条认知被创建了两次——存储流程建一条、分析模型又建一条cognition/keywords逐字相同。根因存储流程越界提取了两步闭环内容。而原规则经用户确认的写操作由分析模型处理只停留在身份描述没有可执行规则。修复防护规则——两步闭环内容不提取分析模型只写闭环内容、存储流程只写非闭环内容两写者内容集互斥。整理机制功能存储分析模型每次收尾对照目录扫关键词重合簇重复/同义合并、keywords 规范化、可疑项报告作为上面越界提取残留的兜底收敛。六、反直觉认知这八版教会我的几件事把 v1 到 v8 摊开有几条认知是反复被证实的值得单独拎出来1. 模型无法自数轮次——最多 N 轮是无效的v1 写着最多 5 轮v8 把它删了。原因是模型每轮从头生成它根本数不清自己跑到第几轮。最多 N 轮这条规则模型既看不到也执行不了。你以为你在给模型设上限其实它无法自数。真正的刹车不能靠模型自己数要靠外部路由输出含标记才退出。2. 提示词里的示例会变成模型的事实模型会拿提示词里的示例数据当真实结果回复——比凭空编造更隐蔽因为内容有出处看起来更真实。所以示例要写清这是示例、不是事实可观测标记_source/_timestamp才是判断真执行的物理证据。3. 规则必须是可执行动作不是身份描述“越界提取的坑就是典型“经用户确认的写操作由分析模型处理这句话说了跟没说一样——它描述了谁该负责”却没给出遇到这种情况具体怎么做”。真正有用的规则是两步闭环内容不提取这种能直接落到一个判断上的指令。4. 有些问题提示词救不了上面这些都是改提示词能解决的。但 v8 还有一个更大的变化是我刻意没展开的——FC 从执行者变成了参数生成器数据从转写三遍变成一遍。那不是提示词迭代是架构重构。这个问题单独成篇下一篇笔记因为它的教训是另一回事当问题出在架构上再会写提示词也没用。学习小结一个智能体的提示词不是写出来的是被真实故障逼出来的——v1 靠计划 步骤编号硬推被循环问题证明模型记不住自己走到哪v7 缺续轮模板导致逐字循环逼出了续轮三段式放弃平台的提问节点时间限制 撑爆上下文后改用退出循环 聊天模型转述的澄清方式“说完成了不等于真执行了”逼出双向约束v8 的一堆精细规则单关键词、决策依赖拆轮、两步确认、写者互斥每一条背后都是一个具体故障。最反直觉的三条模型无法自数轮次“最多 N 轮无效、提示词示例会变成模型的事实、规则必须是可执行动作而非身份描述。而 FC 从执行者变参数生成器”则说明提示词的天花板在架构——那是下一篇的事。懿路向前 · AI辅助整理2026-09-29
返回列表