ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

存量文档怎么搬进 Docmost:单文件、Notion 与 Confluence 迁移实操指南

存量文档怎么搬进 Docmost:单文件、Notion 与 Confluence 迁移实操指南 存量文档怎么搬进 Docmost单文件、Notion 与 Confluence 迁移实操指南【免费下载链接】docmostDocmost is an open-source collaborative wiki and documentation software. It is an open-source alternative to Confluence and Notion.项目地址: https://gitcode.com/GitHub_Trending/do/docmostDocmost 是一款开源的协作 Wiki 与文档工具也是 Confluence 和 Notion 的开源替代方案。它内置的文档导入能力可以接收 Markdown、HTML 单文件也支持把整个目录或平台导出包ZIP批量搬进来文件夹结构会自动变成页面树。这篇指南按你想完成的事来组织先讲怎么选导入方式再给逐步操作最后整理失败排查和参数边界方便照着做。先判断你的场景再选导入方式Docmost 的导入入口分两条路径对应两种工作量你的情况推荐方式说明手里是 1 份 md / html / docx / pdf 文件单文件导入同步处理提交后立刻生成页面一整个目录的 Markdown / HTMLZIP 批量导入generic文件夹层级映射为页面层级附件一起迁移从 Notion 导出的整个工作区ZIP 批量导入notion针对 Notion 导出包的文件命名和 ID 做了专门处理从 Confluence 导出的站点包ZIP 批量导入confluence解析 Confluence 的 XML 导出需要企业版授权判断标准很简单文件少就传单文件一旦涉及目录结构、页面间链接、附件就走 ZIP 批量导入否则层级和链接都要手工重建。单文件导入上传后直接出页面适合把某一篇文章搬过来的轻量场景。操作步骤进入目标空间找到新建页面的导入入口选择文件.md、.html、.docx、.pdf并指定目标空间提交后系统解析文件页面出现在空间根目录下。几个直接影响结果的细节页面标题怎么来如果正文第一个节点是标题任意级别它会直接作为页面标题并从正文中移除没有标题时用文件名兜底格式转换链路Markdown 先转 HTML 再统一解析HTML 直接解析为编辑器的结构化内容两者最终走同一条管道所以两种格式的表现基本一致.docx和.pdf属于企业版功能如果当前构建没有带对应模块导入会明确报需要企业版授权不会静默失败单文件有大小上限超限会直接返回文件过大错误拆分成多个小文件即可。注意单文件导入生成的页面固定挂在空间根目录不会继承任何层级关系所以它不适合承担整站迁移的任务。ZIP 批量导入文件夹结构如何变成页面树批量导入是整个功能的重点。它把 ZIP 里的目录关系翻译成 Docmost 的页面树核心规则如下文件即页面包内每个.md/.html文件对应一个页面同级页面默认按名称字母序排列文件夹变父页面docs/api/overview.md中的api目录会成为包含overview的父页面。如果某个目录没有同名文件例如api/下只有子文件没有api.md系统会自动生成一个占位页作为容器保证层级不丢单一根文件夹会被跳过如果你的整个 ZIP 只包含一个顶层目录且根目录没有其他文件这层外壳目录会被自动省略页面直接挂在空间根下内部链接自动重写页面之间指向包内其他文档的链接会被转换为 Docmost 的内部页面链接并记录回链关系backlinks导入后反向链接功能是可用的附件随行迁移正文中引用的图片、文件会被提取并存储为 Docmost 附件正文引用同步改写不会出现裂图。导入 Notion 导出包时有什么特殊处理Notion 导出的 ZIP 结构和普通目录导出不同Docmost 针对它做了额外适配Notion 导出文件会在文件名后附加 32 位 UUID例如page-a1b2c3...f.md页面命名时会自动剥离这段 ID你看到的是干净的页面标题同名页面场景下 Notion 会给文件夹附加前 4 位 后 4 位的部分 UUID 用于区分导入逻辑会用它精确匹配同目录下的对应文件避免重名页面挂错层级文件夹与文件的对应关系、占位页生成规则与普通批量导入一致选notion来源即可不需要手工改文件。另外值得一提的是Docmost 自己导出的 ZIP 里会带一份docmost-metadata.json记录了页面顺序和图标等信息。用它回迁时页面会按原顺序恢复而不只是字母序——这在备份再恢复的场景下很有用。Confluence 导入企业版能力Confluence 走的是独立的处理分支解析其 XML 导出格式把空间和页面结构映射到 Docmost。该能力打包在企业版模块EE中社区版构建没有内置请求会直接提示需要授权。如果你的迁移来源是 Confluence先确认部署版本包含对应模块再开始打包导出。批量任务在哪里看进度ZIP 导入是异步任务文件上传后先进入队列处理界面立即返回一个任务处理过程包括解压、逐层建页、附件迁移最后整体在一个数据库事务内写入——要么全部成功要么整体回滚不会出现搬了一半的脏数据。任务有 processing / success / failed 三种状态失败任务会记录错误信息工作区管理员可以在后台的文件任务列表里查看历史导入记录按空间过滤游标分页成功的任务会自动清理临时文件源 ZIP 也会被删除磁盘不会持续膨胀。批量任务的处理大小由环境变量FILE_IMPORT_SIZE_LIMIT控制默认 200MB。包超过这个上限会直接报文件过大建议按空间space拆包分批导入既绕过限制也方便验证每一批。常见失败原因与处理办法现象可能原因处理办法上传直接报文件过大超过单文件或 ZIP 上限拆分文件ZIP 调大FILE_IMPORT_SIZE_LIMIT报无效的导入来源ZIP 来源选错generic/notion/confluence按包的实际来源重新选择docx / pdf 报需要企业版授权当前构建未包含 EE 模块升级为企业版或先转成 HTML 再导入页面层级和预期不符顶层只有一个目录外壳或目录里缺同名文件理解单一根目录被跳过和目录自动生成占位页两条规则后重新打包导入后找不到页面权限不足导入需要目标空间的页面编辑权限无权限会返回 403导入前两个小习惯能减少大部分问题确认文件用 UTF-8 编码图片用相对路径引用相对于文件所在目录不要写绝对路径或file://地址。开始之前推荐的文件结构以通用 ZIP 为例按下面这种结构打包最不容易出问题docs/ ├── introduction.md ├── getting-started/ │ ├── installation.md │ └── configuration.md ├── api/ │ ├── api.md # 与目录同名会作为该层级的正文页 │ ├── overview.md │ └── reference.md └── assets/ └── images/打包时排除掉系统垃圾文件zip -r docs.zip docs/ -x *.DS_Store导入完成后建议做一轮快速验证抽查三层页面层级是否正确、点几个内部链接、打开一两张迁移过来的图片。确认无误后原目录就可以归档了。相关代码位置想深入看实现导入相关逻辑集中在服务端integrations/import目录单文件与 ZIP 入口import.controller.ts内容转换md/html 解析、标题提取import.service.ts批量任务处理层级、链接、事务写入file-import-task.service.tsNotion 文件名处理等工具函数import.utils.ts功能细节可能随版本调整具体行为以当前版本为准。下一步建议先用一个小的 Markdown 目录10 页以内走一遍 ZIP 导入确认层级、链接和附件都符合预期再处理全量文档。这样即使规则理解有偏差代价也最小。【免费下载链接】docmostDocmost is an open-source collaborative wiki and documentation software. It is an open-source alternative to Confluence and Notion.项目地址: https://gitcode.com/GitHub_Trending/do/docmost创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表