PDF 与文档处理 精选AI Agent技能库
PDF 与文档处理分类下的高质量技能
pdf-poppler-utils
一套为 AI 代理提供的全面工具集,利用行业标准的 Poppler 库以编程方式从 PDF 文件中提取文本、图像和元数据。
Markdown 转 PDF (支持中日韩)
一个轻量级的 Python 工具,可将 Markdown 文件转换为支持中日韩字符的专业 PDF 文档。
OfdReader
一个基于 Python 的实用工具,用于从中国国家标准 OFD 文件中提取内容并将其转换为干净的 Markdown 或纯文本。
GemBox Skill
一个全面的开发人员工具,用于构建使用 GemBox 组件处理 Excel、Word、PDF 和电子邮件文件的 .NET 应用程序。
pdf2markdown
一款高性能的文档转换工具,可将 PDF 和图像转换为整洁、结构化的 Markdown 或 JSON 数据。
MinerU CLI 文档提取
一款先进的 CLI 工具,利用 AI 驱动的提取技术将复杂的文档和网页转换为结构化的 Markdown、LaTeX 和 DOCX 格式。
Product Doc Reader
一款先进的工程图纸提取器,采用 pdftotext 与 Vision API 混合方案,将 PDF 技术文档转换为结构化数据。
PDF OCR 布局保留
一种高保真 OCR 流水线,可将扫描的 PDF 转换为可搜索文件,同时保持原始文本位置和字体比例。
HTML to PDF 转换器
一个专业级的转换工具,利用 headless Chromium 将 HTML 内容转换为高保真 PDF 文档。
Doc2MD - 快速 Office 解析器
一个极速的 CLI 工具,可将 Word 文档、PowerPoint 演示文稿和 Excel 表格转换为纯净的 Markdown 格式。
Dianju OFD Tools
一款专业的文档处理实用工具,用于 PDF/OFD 双向转换和高保真文本提取。
pdf2md
一个精简的 CLI 工具,可从 PDF 文件中提取文本、表格和公式,并将其转换为整洁、结构化的 Markdown。
PDF Utils
一个专门用于本地 PDF 处理的工具集,包括扫描文档的 OCR 和自动化的 arXiv 参考文献提取。
vRain 古籍制作器
一个专门基于 Perl 的工具集,用于将纯文本和 Markdown 转换为正宗的繁体中文木刻风格竖排 PDF。
PDF Skill
一个全面的文档处理引擎,用于使用基于 Python 的工具创建、编辑、合并 PDF 文件并从中提取结构化数据。
pdf2jpg
一个专门用于将 PDF 页面转换为 JPEG 图像,并利用高性能系统实用程序将其打包成归档文件的工具。
PDF 压缩工具
一款高性能 PDF 压缩引擎,利用三阶段流水线将文件大小缩减至特定目标或百分比。
PDF Parser Agent
一个高性能的本地代理,可将 PDF 文档转换为结构化的 Markdown 和 JSON 格式,实现无缝数据集成。
交通法规文档解析器
一个专门用于解析中国交通事故法律文档,并利用 Word COM 集成生成结构化考试答案的专业工具。
DOCX Footnote Reader
一个专门用于从 Microsoft Word 文档中提取结构化脚注、尾注和正文的 Node.js 实用工具。