Custom PDF MCP Server
Un servidor para procesar archivos PDF, que permite la extracción de texto y tablas, la recuperación de metadatos y la lista de archivos dentro de un directorio específico.
GitHubPrueba este MCPPatrocinado
Documentación
Custom PDF MCP Server
Servidor de procesamiento de PDF personalizado construido con FastMCP, diseñado específicamente para el procesamiento de literatura de tesis de grado.
Características
- Leer texto de PDF: Admite la extracción de texto de un PDF completo o de páginas específicas
- Extraer datos de tablas: Opcionalmente puede extraer la estructura de tablas del PDF
- Obtener información del PDF: Extrae los metadatos del PDF (autor, título, etc.)
- Listar archivos PDF: Escanea todos los archivos PDF en un directorio
- Restricciones de seguridad: Solo puede acceder a archivos dentro del directorio de trabajo actual
Métodos de instalación
Método 1: Usar uv (recomendado)
# 克隆项目
git clone https://github.com/Waicy/-pdf-mcp-.git
cd pdf-mcp
# 创建虚拟环境并安装依赖
uv sync
Método 2: Usar pip
# 克隆项目
git clone https://github.com/yourusername/pdf-mcp.git
cd pdf-mcp
# 安装依赖
pip install . --index-url https://pypi.tuna.tsinghua.edu.cn/simple
Cómo usar
1. Ejecutar pruebas directamente
# 如果使用 uv
uv run pdf-mcp
# 如果使用传统方式
python src/pdf_mcp_server.py
2. Configurar Claude Desktop
Agregue la siguiente configuración en claude_desktop_config.json:
{
"mcpServers": {
"pdf-reader-custom": {
"command": "uv",
"args": [
"--directory",
"path/to/your/pdf-mcp",
"run",
"pdf-mcp"
]
}
}
}
Nota:
- Reemplace
path/to/your/pdf-mcpcon la ruta real del proyecto
Herramientas disponibles
read_pdf_text
Lee archivos PDF y extrae el contenido de texto
Parámetros:
file_path: Ruta del archivo PDF (relativa al directorio de trabajo)page_numbers: Opcional, lista de números de página a extraerextract_tables: Opcional, si extraer datos de tablas
get_pdf_info
Obtiene la información básica y los metadatos del archivo PDF
Parámetros:
file_path: Ruta del archivo PDF
list_pdfs_in_directory
Lista todos los archivos PDF en el directorio especificado
Parámetros:
directory_path: Ruta del directorio, por defecto el directorio actual
Ejemplos de uso
-
Leer el PDF completo:
read_pdf_text("文献整理/某篇论文.pdf") -
Leer solo páginas específicas:
read_pdf_text("文献整理/某篇论文.pdf", [1, 2, 3]) -
Extraer datos de tablas:
read_pdf_text("文献整理/某篇论文.pdf", extract_tables=True) -
Obtener información del PDF:
get_pdf_info("文献整理/某篇论文.pdf") -
Listar todos los PDFs:
list_pdfs_in_directory("文献整理")