分享
【知识管理必看】让 Agent 读懂 PDF 的两个免费工具
输入“/”快速插入内容
【知识管理必看】让 Agent 读懂 PDF 的两个免费工具
用户4242
用户4242
7月22日修改
🔗 原文链接:
https://mp.weixin.qq.com/s/-c84j93F...
原创 艾笑 teacherAi 艾笑 teacherAi 艾笑AI
2026年7月22日 10:49 美国
AI 时代,一份 PDF 怎样才能发挥最大价值?
现在处理 PDF 的工具很多,但归根结底,主要有两种形态。
第一种是
远程 RAG 知识库
。把 PDF 上传到 ima、NotebookLM 等云端平台,就能直接提问、摘要,有的平台还把音频、视频等能力一并做好。它的优势是功能现成;不足是资料需要上传云端,工作流受平台能力限制,也不会自动和 OB 里的本地笔记建立关系。
第二种是
本地 Markdown
。把 PDF 转成保存在自己电脑里的 Markdown,涉及隐私和数据安全的文档也可以留在本机,由本地 Agent 读取、修改,并按自己的需要继续开发 Skill。它的优势是隐私可控、自由度高;不足是受上下文窗口限制,音频、视频等能力通常要自己搭建。
这两种方式都可以马上用,也都可以长期用。区别不在使用时间,而在技术形态和控制权:
远程 RAG 提供现成功能,本地 Markdown 提供本地安全与自由定制。
今天这篇文章只聚焦第二条路线:
你手上已经有一份 PDF,想在本机把它处理成可用的 Markdown,怎么做?
真正麻烦的是:当 PDF 很多,而且既有普通文档,也有扫描件和复杂报告时,怎样稳定地处理?
今天介绍两个免费开源工具:
MarkItDown 和 MinerU
。下面讲清楚三件事:为什么要转、两个工具怎样自动分工,以及最后怎样安装。
「PDF 被保存,不等于 PDF 已经能被 Agent 使用。」
01
为什么 PDF 进入知识库前,要先转成 Markdown
上一篇讲
【OB用户必看】Obsidian 多媒体附件太难管?这个插件一键打通
时,我介绍过一种做法:图片、音频、视频和 PDF 上传到 OSS,本地只保留轻量的内容。
这解决了大文件的存储问题,却没有真正处理 PDF 里的正文。
PDF 仍然是一份附件。你可以打开它阅读,但不方便直接修改、添加双链,也不方便让本地 Agent 持续搜索和整理其中的内容。
所以,一份 PDF 进入 OB 知识库时,最好同时走两条线:
代码块
Plain Text
PDF 原件 → OSS 或附件目录:负责保存和回看
PDF 内容 → Markdown:负责搜索、编辑和 AI 处理
PDF 上传解决的是“文件放在哪里”,转成 Markdown 解决的是“内容怎样被使用”。