MCP PDF 工具
文档工具
简介
使用 PyPDF2 的 MCP 实现 PDF 处理:合并 PDF、提取页面、搜索 PDF、按顺序合并、查找相关 PDF 文件。
标签
PDF
PyPDF2
文档处理
合并
提取
核心功能
合并 PDF
提取页面
搜索 PDF
按顺序合并
查找相关 PDF
使用场景
1
办公人员让 AI 将多个合同 PDF 合并为一个文件
2
研究者让 AI 从大型 PDF 论文中提取特定页面
3
律师让 AI 搜索合同 PDF 中的关键条款
4
学生让 AI 将课件 PDF 按章节拆分
5
档案管理员让 AI 批量处理 PDF 文档的元数据
快速开始
第一步:确保系统已安装 Python 3.8+ 和 pip 包管理器。第二步:在终端执行 pip install mcp-pdf-tools 安装依赖。第三步:在 MCP 客户端配置文件中添加 PDF MCP 配置,使用 Python 命令启动。第四步:确保 PDF 文件路径可被 MCP Server 访问。第五步:重启客户端,在对话中描述 PDF 处理需求。
安装命令
$ pip install mcp-pdf-tools
配置示例
{
"mcpServers": {
"pdf": {
"command": "python",
"args": ["-m", "mcp_pdf_tools"]
}
}
}
使用技巧
•
处理大文件 PDF 时可能会消耗较多内存,建议分批处理
•
合并 PDF 前确认文件顺序,避免页面错乱
•
搜索 PDF 时可以使用正则表达式进行高级匹配
•
提取页面时使用页码序号,从 1 开始计数
•
配合 MCP-Doc 工具可以实现 PDF 与 Word 文档之间的转换
平台支持
Claude Desktop, Cursor, Continue