采集素材

采集素材

把网页、文件、收藏与手动输入安全地送入正确知识库。

采集的目标不是“存一个链接”,而是把真实材料变成以后找得到、看得懂、能引用的来源。第一次采集只用一篇熟悉的网页或一个短文件,先确认结果,再批量导入。

开始前先决定放在哪里

确认当前工作区和目标知识库。工作区决定数据位置与成员范围,知识库决定这份素材以后参与哪些搜索和创作。暂时无法归类时,可以先留在收集箱

支持的入口

  • Web 与 Browser Extension 采集当前网页。
  • 上传 Markdown、文本、图片、音视频与常见办公文件。
  • 从 Cubox、飞书或 Obsidian 等来源导入。
  • 在收集箱中直接粘贴文本并补充来源说明。

用哪种方式

输入推荐入口适合情况
当前浏览器页面Browser Extension需要登录、动态加载或先看预览
公开网页地址粘贴 URL页面无需登录且正文稳定
本地文档或媒体上传文件自有报告、访谈、Markdown 等
短笔记或会议片段手动输入可以补充时间和来源说明
外部收藏或文档库集成导入少量内容验证通过以后

完成一次采集

  1. 打开收集箱,选择添加素材。
  2. 选择输入方式,确认当前工作区和知识库。
  3. 核对标题、来源地址和来源说明。
  4. 查看正文预览,确认不是登录页、导航、评论区或空白内容。
  5. 提交后等待解析状态变化。

每次采集都要确认

  1. 工作区和知识库是否正确。
  2. 是否有权保存和使用该内容。
  3. 标题、来源与正文预览是否完整。
  4. 是否包含敏感信息或不应进入云端的本地资料。

看懂状态

  • 处理中:正文或媒体仍在解析。大文件会更久,不要连续重复提交。
  • 可用:可以打开预览、加入知识库并用于创作。
  • 失败:DraPub 保留错误原因,没有把空内容伪装成成功素材。

状态可用、预览正确、来源完整,才算采集完成。打开素材抽查开头、中间和结尾,再把它加入正确知识库。

网页只得到标题时,打开完整页面后改用浏览器扩展;任务一直处理中时,先检查格式和大小,不要重复上传同一个大文件。更多处理方法见文件、网页与手动输入