PDF 与文档处理 精选AI Agent技能库
PDF 与文档处理分类下的高质量技能
MinerU PDF 提取器
一款高性能的 PDF 转 Markdown 提取工具,支持通过 MinerU API 进行 OCR、公式识别和复杂表格布局处理。
Stirling-PDF
一个全面的自托管 PDF 处理套件,通过强大的 REST API 提供超过 60 种文档处理工具。
使用 Gemini LLM 的 PDF OCR
一款由 AI 驱动的高级工具,利用 Google Gemini 对扫描或基于图像的 PDF 文档执行高精度 OCR。
GLM-OCR 多模态文档深度分析
一个高精度的文档解析流水线,用于提取布局元素并对表格和图表进行深度多模态分析。
MinerU PDF 处理器
一款本地文档解析工具,可将 PDF 转换为机器可读的 Markdown 和 JSON,同时保留公式和表格等复杂结构。
MinerU
一款先进的文档解析工具,可将复杂的 PDF、Word 文档和 PPT 转换为支持 AI 的 Markdown,并完整支持公式和表格。
LLMWhisperer
一个强大的 Openclaw Skills 文本提取工具,可保留布局并从复杂的 PDF 和图像中捕捉手写内容。
PaddleOCR 文档解析
一种复杂的文档处理技能,通过 PaddleOCR API 将图像和 PDF 转换为保留布局的结构化 Markdown。
docstream
docstream 是一款高性能文档处理技能,支持自动化文本提取、AI 摘要和格式转换。
雅思考试数据提取技能
一项专门设计的技能,旨在通过编程方式将剑桥 PDF 材料中的雅思阅读文章和题目集提取为结构化的 JSON 格式。
Azure 文档智能 OCR
一个高性能 OCR 技能,利用 Azure 文档智能从文档中提取文本、表格和结构化数据。
PDF 对话
一种先进的 AI 技能,用于 PDF 文档的智能对话、数据提取和自动化总结。
数据提取器
使用统一的文档处理技术,从 PDF、Word 文档和电子邮件中提取并结构化数据。
版面分析器
使用 surya 文档理解系统分析和检测文档结构、文本块、表格和阅读顺序。
通用 PDF 视觉解析器
一款高性能文档数字化工具,利用多模态视觉能力将多语言 PDF 和复杂布局转换为结构完美的 Markdown。
Zerox 文档转换器
一款先进的文档转换工具,利用 GPT-4o vision 将复杂的 PDF 和图像转换为整洁、结构化的 Markdown。
Nano PDF Edit
一款 AI 驱动的命令行工具,允许开发人员使用自然语言指令以可视化方式编辑和更新 PDF 文档。
OpenOCR 技能
一款智能 OCR 与文档解析引擎,可高精度地从图像和 PDF 中提取文本、数学公式和表格。
PDF 提取
一个将 PDF 文档转换为纯文本的工具,专门为 LLM 处理和 AI 代理工作流进行了优化。
PDF 工具包
一套全面的文档处理套件,供 AI 智能体操作 PDF、进行 OCR 并生成文本转语音音频。