ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

一键抓网页+知识库自动填表:obsidian-wiki浏览器扩展完全使用指南

一键抓网页+知识库自动填表:obsidian-wiki浏览器扩展完全使用指南 一键抓网页知识库自动填表obsidian-wiki浏览器扩展完全使用指南【免费下载链接】obsidian-wikiFramework for AI agents to build and maintain a digital brain through Obsidian wiki | Memory System for Agents项目地址: https://gitcode.com/gh_mirrors/obs/obsidian-wikiobsidian-wiki 是一款让 AI 智能体构建和维护数字大脑的开源框架而它的浏览器扩展 Brain 更是亮点一键抓取网页存入 Obsidian 知识库再让知识库里的知识反过来自动填表——读取页面表单、调用你已有的 Claude Code / Codex 订阅作答、校验后填回全程本地优先、永不提交表单。本指南带新手 2 分钟装好它并跑通抓取 → 入库 → 自动填表的完整闭环。先认识一下这个扩展能做什么Brain 是 extensions/brain/ 目录下的一个零构建 Chrome 扩展连接浏览器与你的 Obsidian 仓库vault打通双向数据流方向功能说明 网页 → 知识库Capture抓取把当前网页或选中文本存成 Markdown 到_raw/暂存区 知识库 → 网页Fill form填表用仓库里已有的知识回答当前页面的表单抓取功能装完即用填表功能额外需要注册一个本地原生消息宿主因为推理模型无法跑在浏览器扩展里。官方商店页的宣传语也很直接把网页和选中文本直接存入你的数字大脑。2 分钟安装加载扩展 注册宿主第一步加载扩展抓取功能即可用打开chrome://extensions打开右上角的Developer mode开发者模式点击Load unpacked加载已解压的扩展程序选择extensions/brain目录。如果你是通过 PyPI 安装的pip install obsidian-wiki扩展也打包在安装包里运行一条命令即可找到路径obsidian-wiki info # → extension: …/obsidian_wiki/_data/extension然后加载这个文件夹即可不需要 clone 仓库。第二步注册填表宿主仅 Fill form 需要extensions/brain/host/install.sh之后完全退出 Chrome⌘Q只关窗口不够再重新打开让浏览器读到新的宿主配置。扩展内置了固定的公钥扩展 ID 稳定宿主可以提前注册。 想不经过 Chrome 直接测试填表链路运行python3 extensions/brain/host/test_host.py claude即可。一键抓网页从网页到知识库只需 3 步第 1 步选好_raw落点。点开扩展弹窗点击Choose vault/_raw选定你仓库的_raw文件夹可点击路径旁的?按钮它会生成一条命令帮你打印出该路径。第 2 步抓取。三种方式任选点击弹窗里的Capture current page网页上右键 →Capture page to brain raw整页右键选中文本 →Capture selection to brain raw仅选中部分。每次抓取都会写入一个YYYY-MM-DD-页面标题.md文件自动带上 YAML frontmatter标题、来源 URL、抓取时间戳、你随手写的备注、选中文本以及最多 140,000 字符的正文——脚本、样式、广告区都会被清洗掉。第 3 步把暂存内容转正。抓取只是暂存区还不是正式知识页。让智能体把它们提升为正式条目/wiki-ingest promote my raw pages这样网页知识就进入了 obsidian-wiki 的记忆面index / log / hot 缓存 / 个人档案可以被后续查询和填表复用。知识库自动填表让 AI 替你答问卷打开一个表单页面点击扩展图标切到Fill form标签页Answer from作答来源选择用哪个仓库的知识作答Reasoning engine推理引擎选 Claude Code 或 Codex用的是你已有的订阅点击Fill from brain等待几秒。背后的分工很巧妙检索从不调用模型——context-pack命令对仓库做确定性排序取回相关页面模型只干一件事把事实映射到表单字段上。每个填回的值都经过宿主按真实表单 schema 二次校验字段旁会显示绿色描边置信度 ≥ 0.7可放心参考红色描边置信度较低值得人工复核悬停任意字段还能看到知识来源页面。两个让人安心的设计它永远不会提交表单——填完就停提交永远由你决定每个答案都能在弹窗列表里追溯置信度和出处。多仓库作答Answer from下拉框会列出所有 vault 配置文件~/.obsidian-wiki/config.name。投简历的问卷用personal仓库答供应商问卷用work仓库答互不干扰选择会按浏览器 profile 记住。它绝不会填什么安全边界检索页面不支持的内容——留空绝不瞎猜姓名、邮箱、电话、地址等身份字段——除非仓库里明确存有该值密码框和文件上传——根本不会进入表单 schema校验失败的值如选项不在下拉列表里——宿主在写入页面前就丢弃。一个字段问多项姓名、邮箱和公司名称时会填仓库支持的部分并降低置信度而不是整个跳过。想让填表更准两个关键写法检索质量几乎决定一切记住两条把重要的放页面顶部。多个页面竞争 token 预算时context-pack只压缩保留每页的开篇块。把可填写的事实写进summary:frontmatter 和首段。建一个个人档案页。例如entities/你的名字.md打上visibility/pii标签避免进入对外查询开头用文字写清各字段值未知字段留空而不是写TODO占位符——占位符会被模型当真填进真实表单。仓库没覆盖到的问题表单大部分留空——这不是故障而是系统在正常工作与其提交一份貌似合理的虚构答案空白反而是保护。成本、隐私与故障排查成本检索完全免费每次填表 一次claude -p或codex exec调用走你现有订阅计费。收紧--budget、保持页面摘要精炼填表会更便宜也更准。隐私除模型调用本身经由你终端里同一套 CLI 和同一账号外没有任何数据离开你的机器。vault 摘录和表单标签都被视为不可信输入页面内容只当数据、不当指令。出问题先看日志~/.obsidian-wiki/brain-fill.log每次运行都有── start/── exit包裹。症状大概率原因与修复Native host has exited且无新── startChrome 根本没启动进程重跑install.shSpecified native messaging host not found宿主未注册跑install.sh→ ⌘Q → 重开 Chromeclaude: Not logged in启动器缺环境变量重跑install.shRead N pages, but none of them answer these fields检索正常但仓库没覆盖该问题参考上文写法延伸阅读与源码路径完整官方文档架构、安全模型、疑难杂症docs/browser-extension.md扩展全部源码manifest、弹窗、背景脚本、宿主extensions/brain/填表宿主实现extensions/brain/host/brain_fill_host.py项目主文档安装、技能、记忆面README.md、docs/installation.md、docs/memory.md抓住好页面、让它们住进大脑、再让大脑替你办事——这就是 obsidian-wiki 浏览器扩展的全部闭环。【免费下载链接】obsidian-wikiFramework for AI agents to build and maintain a digital brain through Obsidian wiki | Memory System for Agents项目地址: https://gitcode.com/gh_mirrors/obs/obsidian-wiki创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表