
WeKnora本地部署3步跑起免联网的知识问答【免费下载链接】WeKnoraOpen-source LLM knowledge platform: turn raw documents into a queryable RAG, an autonomous reasoning agent, and a self-maintaining Wiki.项目地址: https://gitcode.com/GitHub_Trending/we/WeKnoraWeKnora把原始文档变成可检索的RAG知识库。本文用Lite单二进制在单机上跑通全链路数据只落在本地磁盘。跑完即得到一个带引用溯源的问答实例也清楚出问题该看哪里。先选形态Lite还是标准版WeKnora提供两种部署形态差异直接决定你要装多少东西维度Lite标准版依赖单二进制 Ollama无外部服务Docker Compose 多容器栈资源需求4核8GB20GB磁盘8核16GB建议8GB以上显存工具链Node.js Go构建用Docker Compose数据落点./data/weknora.db单文件Docker 数据卷适用人群个人、单机试用多人协作、完整解析引擎个人或小团队验证场景选Lite需要共享空间、多成员协作时再上标准版。两种形态共用同一条处理链文档解析、语义分块、向量化、模型作答替换任一组件互不影响。最短路径Lite单机实例 ️获取代码。克隆仓库到本地工作目录git clone https://gitcode.com/GitHub_Trending/we/WeKnora cd WeKnora成功标志目录里能看到Makefile与.env.lite.example。生成本地配置。复制模板并改三处字段OLLAMA_BASE_URL默认已指向127.0.0.1:11434远程Ollama时改成对应地址、TENANT_AES_KEY、JWT_SECRET后两者必须换成自己的随机值。cp .env.lite.example .env.lite成功标志.env.lite存在且两处密钥不再是CHANGE-ME占位值。构建并启动。一条命令先构建前端、再产出 Go 二进制随后加载.env.lite启动make run-lite成功标志终端输出本机访问地址浏览器打开出现注册页。默认仅本机可访问。接入本地模型。启动 Ollama 并准备好一个对话模型与一个向量模型然后在设置页完成模型测试ollama serve成功标志ollama list能看到模型设置页模型测试通过。标准版一句带过cp .env.example .env后执行docker compose pull docker compose up -d前端在http://localhost后端 API 在http://localhost:8080。验收3个最小验证动作 ✅动作1传一份文档。把docreader/testdata/test.md上传到新建知识库等状态从处理中变为完成。上传时的目录结构会保留成文件夹树浏览方式接近文件管理器。动作2提问并核对引用。切到知识库问答模式提一个只能从文档里找到答案的问题例如文档中的某个具体数值。回答下方应出现来源引用点开能定位到原文段落。动作3确认数据不出本机。停止服务后检查落盘位置ls -l ./data/weknora.db ./data/files成功标志数据库文件与解析出的图片都在这两个路径下推理请求只发往127.0.0.1:11434的 Ollama。整条链路相当于把资料室搬进机房请求和文档一个字节都不出门。常见问题速查现象可能原因处理方法Web页面打不开端口被占或容器未就绪核对.env端口字段docker compose ps看状态模型测试失败Ollama 未启动或地址错先跑ollama serveLite 指向127.0.0.1:11434标准版容器内指向host.docker.internal:11434文档一直处理中解析任务积压或超时docker compose logs -f docreader app查日志对照 docs/QA.md图片显示无效链接存储后端对外不可达改本地存储STORAGE_TYPElocal或修正MINIO_PUBLIC_ENDPOINT刚保存的配置消失空间归属不一致或代理干扰确认当前空间关浏览器代理参考 docs/QA.md 第7条调优参数 ⚡参数改法理由BATCH_EMBED_SIZE设为64批量入库时减少与 Ollama 的往返DOCREADER_GRPC_MAX_WORKERS设为 CPU 核数解析是 CPU 密集并行度直接缩短排队CONCURRENCY_POOL_SIZE取 3 到 8防止任务突进占满内存拖慢问答模型参数num_ctx在模型配置里写大长文档不被截断检索片段更完整权衡在于想提高单条回答质量就加大上下文想提高并发吞吐就压低并发、分批入库两头不能同时拉满。延伸资料docs/QA.md日志查看、上传失败、图片链接等高频排障项docs/LITE.mdLite 与标准版的完整差异清单website-docs/README.md完整产品文档六大板块client/example.goGo 客户端上传与检索示例docs/RBAC说明.md多人使用前先读的空间角色模型下一步先导入 10 到 20 份高频文档用 5 个真实问题校准答案带引用且能定位到原文段落即可投入使用。达标后再评估是否升级到标准版多容器部署。【免费下载链接】WeKnoraOpen-source LLM knowledge platform: turn raw documents into a queryable RAG, an autonomous reasoning agent, and a self-maintaining Wiki.项目地址: https://gitcode.com/GitHub_Trending/we/WeKnora创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考