ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

Kimi 浏览器扩展升级:把网页操作录成可复用的 Skill

Kimi 浏览器扩展升级:把网页操作录成可复用的 Skill Kimi WebBridge 发布约 4 个月后被改头换面重新命名为Kimi 浏览器扩展并在原有能力之上做了两处关键升级在浏览器侧边栏可以直接登录对话让 Kimi 操作当前网页新增将网页操作录制成 Skill 的能力方便下次一键复用。 从产品形态看新版延续了「网页桥梁」的设计——一头连接本地 Agent一头连接 Chrome 或 Edge 扩展。Agent 发出指令后扩展在用户真实浏览器中跳转页面、执行操作并回传结果。改版之后旧版由本地 Agent 调用扩展的链路继续保留新版侧栏入口则让普通用户不用配置本地环境就能直接上手。这次升级改了什么改名Kimi WebBridge → Kimi 浏览器扩展新增侧边栏入口登录 Kimi 账号即可直接对话操作当前网页免去本地 Agent 配置新增 Skill 录制演示一遍操作AI 提炼成技能下次输入/直接调用复用新增网页 → 指令把常用网站的操作拆成 CLI 式命令保留本地 Agent 链路Claude Code / Codex / Cursor / Kimi Work 等照常远程驱动Skill 录制是怎么工作的它不是录像回放式的 RPA 录制而是AI 提炼像平常一样手动操作一遍Kimi 记录每一步点击「停止并生成」Kimi 把过程提炼成技能确认技能的名称、步骤和参数后保存密码等敏感信息可设为保密参数回放时再填写之后输入/选择该技能Kimi 就会照着做一遍技能的步骤和内容随时可以修改。 本质是把「一次性操作」变成「流程资产」——浏览器自动化的竞争焦点正在从「能不能执行」转向「能不能沉淀」。对用户的核心价值第一降低 Agent 操作浏览器的使用门槛。旧版依赖本地 Agent 调用扩展新版在浏览器侧边栏直接可用省去客户端配置步骤普通用户登录账号即可使用。第二把一次性操作变成可复用流程。例如每天打开同一个站点查询新闻并导出数据下次直接调用即可省去重复描述步骤。顺利完成的会话本身也能保存为 Skill。第三与 Kimi Code Desktop 形成互补。Code Desktop 为 Agent 提供项目工作台与内置浏览器适合改完网页立刻查看效果浏览器扩展则面向用户日常使用的 Chrome / Edge处理跨站点的常规网页任务。两者结合覆盖了 Agent 在桌面端项目工作与浏览器端日常操作两类场景。适用场景重复性网页流程每天、每周固定在某些网站执行相同步骤例如抓取公开数据、填写固定表单、汇总页面信息这类任务最能从 Skill 录制中受益跨站点信息处理在多个网站之间跳转、对比或汇总信息的轻量任务例如竞品价格对比、商品信息归档个人浏览器的轻量自动化不想专门搭建脚本或 RPA只希望用对话方式让浏览器替自己完成一些机械操作配合 Kimi Code Desktop 做项目验证开发或修改网页项目时让 Agent 在内置浏览器里预览效果再用扩展在用户日常浏览器中验证真实站点。什么情况下值得用任务高度重复且步骤相对固定Skill 的价值在于复用任务越规律收益越大如果每次任务目标和路径都不同录制 Skill 的意义有限目标网站结构稳定页面改版、动态加载、登录态变化都会让操作中断遇到复杂页面时可能需要截图确认页面状态再调整指令对实时性与准确性要求适中浏览器自动化天然受限于网络与页面渲染遇到反爬或风控严格的站点成功率会下降已有 Kimi 账号与日常使用的 Chrome / Edge扩展依赖 Kimi 账号登录浏览器侧的兼容性目前以 Chrome 和 Edge 为主。挤进了一个什么赛道当前浏览器自动化分三个流派云端 AgentOpenAI Operator、Manus、Perplexity Comet云侧虚拟浏览器并行能力强桌面 Computer UseClaude Computer Use操作整个操作系统桌面级操作浏览器扩展Claude in Chrome、Kimi、Browser Use 生态住在用户真实浏览器里复用真实登录态。Kimi 的差异有两个关键点一是不绑模型对 Claude Code、Codex、Cursor 全部开放定位是「浏览器的 Agent 中间层」二是把 Skill 录制做成核心卖点——竞品普遍有执行、没沉淀。亮点与隐忧亮点双入口同时吃大众侧边栏与开发者本地 Agent两类人群基本盘和增量都不丢隐私设计有意识保密参数避免技能库变成密码库官方也提示失败时先截图确认页面状态与 Kimi Code Desktop 形成「开发验证 日常使用」闭环覆盖 Agent 的两大高频场景。隐忧确定性与弹性的悖论Skill 是刚性步骤页面改版、动态加载、登录态过期都会打断官方让「失败先截图再调指令」其实是承认了这个张力跨站可移植性存疑录制的步骤若依赖选择器或页面结构换个站点即失效Skill 库的复用价值会被站点多样性稀释隐私暴露面比表面更大保密参数只保护密码输入运行在真实浏览器里Cookie、浏览痕迹、已登录账号全在 Agent 触达范围内涉资金、权限、对外发布的操作人工复核不能省平台锁定效应侧边栏绑定 Kimi 账号Skill 库绑定 Kimi 生态用户沉淀的流程资产越多离开成本越高——这既是护城河也是用户要承担的绑定成本反爬与风控是硬边界验证码、风控严格的站点成功率下降这条边界短期难突破决定了它不适合所有网页任务 落地建议从最痛的一两个重复任务开始先挑一两个每天都在做、机械步骤最多的网页流程试着录成 Skill 跑几次再逐步扩展遇到失败先截图再调整页面结构变化或动态加载是常见卡点失败时先截图确认页面状态再调整指令Skill 命名与归档要规范随着录制的 Skill 数量增加建议按业务或网站命名并打标签便于后续检索关键任务保留人工复核浏览器自动化对验证码、登录态、页面改版都比较敏感涉及资金、权限或对外发布的操作建议保留人工确认环节关注成本与隐私边界任务在真实浏览器中执行浏览器里已登录的账号、Cookie、缓存都会被涉及使用前应确认不会触碰到敏感系统或受合规约束的数据。结论把这次升级看作「把 Agent 的一项技能变成用户的一份资产」。它更适合结构稳定、步骤规律的轻量场景当成能慢慢积累的「网页流程库」比指望它一次解决所有网页任务更现实。对开发者而言浏览器自动化的竞争焦点正在从「执行能力」转向「沉淀能力」——谁能让用户的操作变成可复用、可积累的流程资产谁就握住了下一个增长点。
返回列表