PDF 与文档处理 精选AI Agent技能库
PDF 与文档处理分类下的高质量技能
Regulation Extractor
一个专业级流水线,用于从复杂的建筑工程 PDF 中提取、清洗并同步结构化监管条款至云端数据库。
Everything2Markdown
一个由 Microsoft MarkItDown 驱动的多功能文档转换技能,可将几乎任何文件格式转换为针对 AI 代理和 LLM 优化的结构化 Markdown。
OpenClaw PDF Supercharger with OpenDataLoader
一个高性能的本地 PDF 提取技能,旨在将复杂的文档转换为干净、可直接用于 RAG 的 Markdown 和 JSON 格式。
LAS-AI 文档解析
由字节跳动 LAS-AI 驱动的专业级文档解析器,可将 PDF 和复杂图像转换为结构化 Markdown。
Nutrient Document Processing
一个原生的 Openclaw 技能,提供全面的文档处理能力,包括 PDF 转换、OCR 和 AI 驱动的 PII 脱敏。
PDFMonkey
一个安全的、CLI 驱动的 PDFMonkey 连接器,用于通过 AI 工作流从 HTML/CSS 模板生成高质量 PDF。
EasyPaper
利用强大的多智能体 Python SDK 和 LaTeX 工具链,从元数据生成专业的、结构化的学术论文。
PDF OCR Extractor
一个注重隐私的本地工具,使用 Tesseract OCR 和 Python 将基于图像的 PDF 转换为可搜索文本。
MinerU OCR Local API
一种高性能文档解析技能,使用 MinerU 引擎将复杂的 PDF 和图像转换为感知布局的 Markdown。
PDFExtract 从 PDFs 中提取文本
一个本地提取实用程序,可在不使用外部服务的情况下,将复杂的 PDF 文档转换为适用于 AI agents 的干净、结构化的 markdown。
PDF-API.io
一个为 PDF-API.io 提供的 AI 驱动集成,使代理能够通过统一的 REST API 接口生成、操作和转换 PDF 文档。
Adobe PDF Services
一个强大的 AI agent 集成工具,使用 Adobe 行业标准 API 以编程方式创建、转换、压缩和操作 PDF 文档。
xparse-parse
一个强大的基于 CLI 的工具,用于将 PDF、图像和 Office 文件等复杂文档转换为整洁的 Markdown 或结构化 JSON,以供 AI 工作流使用。
文档相似度
一项通过 PDFAPIHub 云 API 比较两个文档或图片视觉相似度的强大技能。
OCR2Markdown
一个高性能的文档解析流水线,通过 Modal 使用 GPU 加速的 OCR 将复杂的 PDF 和图像转换为结构化的 Markdown。
PDF Translate BabelOCR
一款通过提取文本并利用 Agent 原生语言能力进行高保真输出,从而在本地翻译 PDF 的专业技能。
PDF Translator
一款先进的翻译引擎,通过利用 LaTeX 重构和直接集成 arXiv 源码,保留复杂的文档布局。
MarkItDown
一款由微软构建的多功能实用程序,用于将各种文档格式、图像和音频转换为结构化 Markdown,以供 LLM 分析。
EasyLink EasyDoc Mask
一种自动化 AI agent skill,利用 EasyLink 异步 masking API 安全地对文档中的敏感个人或医疗数据进行脱敏和掩码处理。
Code-to-Skill:建筑规范转换器
将建筑规范 PDF 和法规转换为可审计、可搜索的 AI skills,支持条款索引、法律原文保留、结构化表格和标准间交叉引用。