Agentic Document Parsing and Extraction (ADP)
ADP clasifica automáticamente facturas internacionales, comprobantes nacionales, contratos de adquisición, documentos logísticos, estados financieros y contratos comerciales, y extrae con precisión los campos clave. También admite el análisis de tablas, la verificación de contenido y el reconocimiento multilingüe. Sin necesidad de configurar plantillas, etiquetar datos ni mantener reglas continuamente, maneja de manera eficiente tareas de procesamiento de documentos de alto volumen.
Documentación
Acerca del Servidor MCP de ADP
El Servidor MCP de ADP es el endpoint del Protocolo de Contexto de Modelo (MCP) para la plataforma Procesamiento de Documentos Agéntico (ADP) de Laiye. Permite que cualquier cliente de IA compatible con MCP — Claude Desktop, Cursor, Copilot Chat, Tongyi Lingma, Coze y otros — invoque las capacidades de análisis y extracción de documentos de ADP sin escribir una sola línea de código. A diferencia de la CLI, el Servidor MCP se ejecuta sobre transporte HTTP Streamable. Una sola conexión es todo lo que necesitas para descubrir las herramientas disponibles, invocar el procesamiento y consultar los resultados, todo dentro de tu ventana de chat.
ADP integra Modelos de Visión-Lenguaje (VLM), Modelos de Lenguaje Grande (LLM) y tecnologías de toma de decisiones con agentes autónomos. Rediseña el procesamiento documental tradicional transformando la extracción de campos basada en reglas convencionales en automatización inteligente de extremo a extremo orientada a objetivos. Centrado en el procesamiento inteligente de documentos empresariales, ADP clasifica automáticamente facturas internacionales, comprobantes nacionales, contratos de adquisición, documentos logísticos, estados financieros y contratos comerciales, y extrae con precisión los campos clave. También admite análisis de tablas, verificación de contenido y reconocimiento multilingüe. Sin necesidad de configuración de plantillas, etiquetado de datos o mantenimiento continuo de reglas, maneja eficientemente tareas de procesamiento documental de alto volumen.
Inicio Rápido
1. Obtén tu Clave de API
Regístrate en https://adp-global.laiye.com/ y recupera tu Clave de API desde Mi MCP en la configuración personal.
2. Configura tu Cliente MCP
El Servidor MCP de ADP se ejecuta sobre transporte stdio: el cliente lanza un proceso local mediante npx y pasa tu Clave de API a través de una variable de entorno. Añade lo siguiente al archivo de configuración MCP de tu cliente (por ejemplo, claude_desktop_config.json de Claude Desktop, mcp.json de Cursor):
{
"mcpServers": {
"adp": {
"command": "npx",
"args": ["-y", "@laiye-adp/mcp"],
"env": {
"ADP_API_KEY": "<YOUR-ADP-API-Key>"
}
}
}
}
Los mismos parámetros aplican a cualquier cliente MCP:
| Parámetro | Valor |
|---|---|
| Comando | npx |
| Argumentos | ["-y", "@laiye-adp/mcp"] |
| Transporte | stdio |
| Autenticación | Variable de entorno ADP_API_KEY=<YOUR-ADP-API-Key> |
La variable de entorno opcional
ADP_ACCEPT_LANGUAGE(zh/en, por defectozh) cambia el idioma y el dominio de la API. Requiere Node.js 20+ instalado localmente.
3. Comienza a Usarlo
Una vez conectado, tu cliente de IA descubrirá automáticamente todas las herramientas ADP disponibles. Simplemente describe lo que necesitas en lenguaje natural:
- "Sube este archivo local y extrae los campos de la URL devuelta"
- "Analiza la estructura de este PDF"
- "Extrae la información de esta tarjeta de identidad"
- "Obtén el monto y la fecha de esta factura"
Catálogo de Herramientas
Análisis de Documentos
| Nombre de Herramienta | Título | Descripción |
|---|---|---|
upload_temporary_file | Subir Archivo Temporal | Sube chunk y devuelve download_url. Pasa data.download_url a las herramientas de análisis o extracción como parámetro file. |
parse_document | Análisis General de Documentos | Analiza PDF, imágenes, Word, Excel, PPT y otros documentos para el análisis de diseño, devolviendo bloques de texto estructurados, tablas, orden de lectura y coordenadas de página. Úsalo cuando el tipo de documento sea desconocido y necesites la estructura bruta para procesamiento posterior; para facturas, tarjetas de identidad u otros tipos específicos, prefiere la herramienta de extracción dedicada. |
Extracción de Facturas y Pedidos
| Nombre de Herramienta | Título | Descripción |
|---|---|---|
extract_china_invoice | Factura / Comprobante de China | Cubre más de 30 tipos comunes de comprobantes chinos: facturas electrónicas totalmente digitalizadas, facturas generales de IVA, facturas especiales de IVA, recibos de taxi, billetes de tren, itinerarios aéreos, comprobantes fiscales, etc. Extrae número de factura, fecha, monto, comprador, vendedor y otros campos clave; también admite verificación de autenticidad de facturas. |
extract_global_invoice | Factura / Recibo Global | Extrae campos clave (número de factura, fecha, monto, impuestos, moneda, partidas, etc.) de facturas, recibos o comprobantes internacionales en formato PDF o imagen. Ideal para comercio transfronterizo, reembolsos y automatización de cuentas por pagar; para facturas de IVA chinas, usa la herramienta dedicada de facturas de China. |
extract_purchase_order | Pedido de Compra / Venta | Extrae campos clave (número de pedido, información de comprador/vendedor, fecha de pedido, detalles de artículos, cantidad, precio unitario, monto total, dirección de envío, etc.) de pedidos de compra o venta en formato PDF o imagen. Adecuado para entrada de pedidos de comercio electrónico, conciliación de cadena de suministro y automatización de gestión de almacenes. |
Extracción de Tarjetas y Certificados
| Nombre de Herramienta | Título | Descripción |
|---|---|---|
extract_id_card | Tarjeta de Identidad de China | Extrae campos clave (nombre, género, etnia, fecha de nacimiento, número de identidad, dirección, autoridad emisora, período de validez, etc.) de imágenes de tarjetas de identidad de residentes de China continental. Admite tanto el anverso como el reverso. Para permisos de Hong Kong/Macao/Taiwán o pasaportes, usa la herramienta correspondiente. |
extract_bank_card | Tarjeta Bancaria | Extrae campos clave (número de tarjeta, banco emisor, tipo de tarjeta, fecha de vencimiento, etc.) del anverso de una imagen de tarjeta bancaria. Solo se reconoce información pública de la tarjeta; campos sensibles como CVV no se extraen. |
extract_vehicle_cert | Certificado de Vehículo | Extrae campos clave (número de certificado, marca del vehículo, modelo, VIN, número de motor, fecha de fabricación, etc.) de imágenes de certificados de conformidad de vehículos. Adecuado para registro de vehículos, transacciones de autos usados y gestión de flotas. |
extract_account_permit | Permiso de Cuenta Bancaria | Extrae campos clave (nombre de la empresa, número de cuenta básica, nombre del banco, número de aprobación, fecha de emisión, etc.) de imágenes de permisos de apertura de cuentas bancarias corporativas. |
extract_driver_license | Licencia de Conducir de China | Extrae campos clave (nombre, género, nacionalidad, fecha de nacimiento, número de licencia, clase de vehículo permitida, fecha de primera emisión, período de validez, etc.) de imágenes de licencias de conducir de vehículos motorizados chinos. Admite tanto la página principal como la suplementaria. |
extract_business_license | Licencia Comercial | Extrae campos clave (nombre de la empresa, código de crédito social unificado, representante legal, capital registrado, fecha de establecimiento, ámbito comercial, dirección registrada, etc.) de imágenes de licencias comerciales chinas. |
extract_passport_cn | Pasaporte de China | Extrae campos clave (nombre en chino, nombre romanizado, género, fecha de nacimiento, número de pasaporte, nacionalidad, fecha de emisión, período de validez, autoridad emisora, etc.) de imágenes de pasaportes de la República Popular China. No se admiten pasaportes extranjeros. |
extract_vehicle_license | Matrícula de Vehículo | Extrae campos clave (número de placa, tipo de vehículo, propietario, VIN, número de motor, fecha de registro, fecha de emisión, etc.) de imágenes de matrículas de vehículos motorizados chinos. Admite tanto la página principal como la suplementaria. |
extract_org_code_cert | Certificado de Código de Organización | Extrae campos clave (nombre de la organización, código de organización, representante legal, dirección, fecha de emisión, período de validez, etc.) de imágenes de certificados de código de organización. Para empresas recién registradas, usa la herramienta de Licencia Comercial en su lugar. |
extract_household_book | Registro de Hogar | Extrae campos clave (número de hogar, tipo de hogar, dirección, lista de miembros de la familia incluyendo nombre, número de identidad y relación con el cabeza de familia, etc.) de imágenes de registros de hogar (Hukou) chinos. Admite tanto páginas de índice como individuales. |
extract_hk_macao_permit | Permiso de Viaje a Hong Kong/Macao | Extrae campos clave (nombre, género, fecha de nacimiento, número de permiso, fecha de emisión, período de validez, autoridad emisora, etc.) de imágenes de Permisos de Entrada y Salida para Viajar a Hong Kong y Macao. |
Extracción Personalizada
Además de las herramientas listas para usar anteriores, MCP proporciona dos herramientas fijas para trabajar con aplicaciones de extracción personalizadas que crees en la plataforma ADP:
| Nombre de Herramienta | Título | Descripción |
|---|---|---|
list_custom_extract_apps | Listar Aplicaciones de Extracción Personalizadas | Lista todas las aplicaciones de extracción de documentos personalizadas creadas por el usuario actual, devolviendo el ID, nombre, descripción, etiquetas y definiciones de campos de salida de cada aplicación. Úsalo para encontrar el app_id necesario para execute_custom_extract_app. |
execute_custom_extract_app | Ejecutar Aplicación de Extracción Personalizada | Procesa un archivo usando una aplicación de extracción de documentos personalizada especificada. Usa list_custom_extract_apps primero para obtener el app_id. |
Flujo de trabajo: Llama a list_custom_extract_apps para explorar las aplicaciones disponibles y obtener el app_id objetivo, luego llama a execute_custom_extract_app con el app_id y el archivo para realizar la extracción.
Parámetros de Entrada de Herramientas
Herramientas de Análisis de Documentos y Extracción Listas para Usar
Todas las herramientas listas para usar comparten un esquema de entrada unificado:
| Parámetro | Tipo | Requerido | Descripción |
|---|---|---|---|
file | string | Sí | URL del archivo o contenido codificado en Base64 |
file_name | string | No | Nombre del archivo (con extensión) |
with_rec_result | boolean | No | Si incluir resultados intermedios de OCR, por defecto true |
wait | boolean | No | Si esperar sincrónicamente el resultado, por defecto true |
timeout_seconds | integer | No | Tiempo de espera de sincronización en segundos, por defecto 300, rango 1–900 |
upload_temporary_file
| Parámetro | Tipo | Requerido | Descripción |
|---|---|---|---|
chunk | string | Sí | Archivo a subir. Ruta de archivo local, URL file:// o contenido codificado en Base64 |
La respuesta contiene data.download_url, que se puede pasar directamente a las herramientas de análisis o extracción como file.
execute_custom_extract_app
Además de los parámetros anteriores:
| Parámetro | Tipo | Requerido | Descripción |
|---|---|---|---|
app_id | string | Sí | ID de la aplicación de extracción personalizada (obtenido de list_custom_extract_apps) |
list_custom_extract_apps
No se requieren parámetros de entrada.
Métodos de entrada de archivos para análisis/extracción:
- URL: pasa un enlace que comience con
http://ohttps://comofile - Base64: pasa el contenido del archivo codificado en Base64 como
file(se detecta automáticamente cuando no es una URL) - Archivos locales: llama a
upload_temporary_fileprimero, luego pasa eldata.download_urldevuelto a la herramienta de análisis o extracción.
Sincrónico vs Asincrónico:
wait=true(por defecto): bloquea hasta que el procesamiento se complete, devuelve el resultado directamentewait=false: devuelve inmediatamente con untask_idpara consultas de estado posteriores
Salida de Herramientas
Salida de upload_temporary_file
{
"code": "success",
"message": "",
"tips": null,
"data": {
"id": "ade6dcfd9b9c11f1be34d85ed35661fd",
"file_name": "invoice.pdf",
"file_size": 123,
"content_type": "application/pdf",
"download_url": "https://adp.laiye.com/web/agentic_doc_processor/laiye/file/ade6dcfd9b9c11f1be34d85ed35661fd",
"status": "success"
}
}
| Campo | Tipo | Descripción |
|---|---|---|
code | string | Código de estado del negocio. El éxito suele ser success |
message | string | Mensaje de respuesta |
tips | string | null | Mensaje adicional |
data.id | string | ID del archivo |
data.file_name | string | Nombre del archivo |
data.file_size | integer | Tamaño del archivo en bytes |
data.content_type | string | Tipo MIME |
data.download_url | string | URL de descarga. Pasa este valor a las herramientas de análisis o extracción como file |
data.status | string | Estado del archivo, devuelto cuando está disponible |
Salida de parse_document
{
"task_id": "fabd7f0a4e7211f1bbc4d85ed35661fd",
"status": 4,
"message": "",
"doc_recognize_result": [
{
"page_num": 1,
"document_content": "Full text content of this page...",
"document_details": [
{
"type": "Text",
"text": "Paragraph content...",
"position": [{"points": [{"x": 311, "y": 50}, {"x": 500, "y": 50}, {"x": 500, "y": 80}, {"x": 311, "y": 80}]}],
"ocr_confidence": {
"ocr_mean_confidence": 0.999,
"ocr_min_confidence": 0.998,
"is_overall_confidence": 1
}
},
{
"type": "Table",
"text": "Column A\tColumn B\nValue 1\tValue 2",
"position": [{"points": [...]}],
"ocr_confidence": {...}
},
{
"type": "Picture",
"text": "https://adp.laiye.com/web/.../file/abc123",
"position": [{"points": [...]}],
"ocr_confidence": {...}
}
]
}
]
}
| Campo | Tipo | Descripción |
|---|---|---|
task_id | string | ID de la tarea |
status | integer | Código de estado de la tarea |
message | string | Mensaje de estado |
doc_recognize_result | array | Resultados de reconocimiento por página |
doc_recognize_result[].page_num | integer | Número de página (indexado desde 1) |
doc_recognize_result[].document_content | string | Texto completo de la página en orden de lectura |
doc_recognize_result[].document_details | array | Detalles a nivel de elemento |
document_details[].type | string | Tipo de elemento: Text, Table o Picture |
document_details[].text | string | Contenido de texto; URL de imagen para tipo Imagen |
document_details[].position | array | Coordenadas del cuadro delimitador (4 puntos de esquina) |
document_details[].ocr_confidence.ocr_mean_confidence | float | Confianza promedio de OCR (0–1) |
document_details[].ocr_confidence.ocr_min_confidence | float | Confianza mínima de OCR (0–1) |
Salida de la Herramienta extract
{
"task_id": "91283e544e7111f18cd6d85ed35661fd",
"status": 4,
"message": "",
"extraction_result": [
{
"field_key": "invoice_number",
"field_name": "Invoice Number",
"field_values": [
{
"field_value": "24VLT0591617",
"field_confidence": 1.0,
"references": []
}
]
},
{
"field_key": "line_items",
"field_name": "Product Details",
"references": [],
"field_confidence": 1.0,
"table_values": [
[
{
"field_name": "Description",
"field_key": "line_items_description",
"field_values": [
{
"field_value": "TESLA MODEL 3",
"field_confidence": 1.0,
"references": "Description: TESLA MODEL 3"
}
]
}
]
]
}
]
}
Campo regular (sin table_values):
| Campo | Tipo | Descripción |
|---|---|---|
field_key | string | Identificador de campo legible por máquina |
field_name | string | Nombre de campo legible por humanos |
field_values | array | Valores extraídos |
field_values[].field_value | string | El valor extraído |
field_values[].field_confidence | float | Puntuación de confianza (0–1) |
Campo de tabla (tiene table_values):
| Campo | Tipo | Descripción |
|---|---|---|
field_key | string | Identificador de tabla |
field_name | string | Nombre de tabla |
table_values | array[array] | Matriz 2D: filas de celdas, cada celda tiene field_name, field_key, field_values |
Cómo distinguir: El objeto de campo contiene table_values → campo de tabla; solo field_values → campo regular.
Respuesta asíncrona (wait=false)
{
"task_id": "fabd7f0a4e7211f1bbc4d85ed35661fd",
"status": "running"
}
Códigos de estado de tarea
| Código de estado | Estado MCP | Descripción |
|---|---|---|
| 0 | running | Desconocido |
| 1 | running | Listo / En cola |
| 2 | running | Procesando |
| 4 | success | Éxito |
| 5 | failed | Fallido |
| 6 | failed | Cancelado |
Formatos de archivo compatibles
| Formato | Extensiones | Notas |
|---|---|---|
.pdf | Admite tanto escaneados como electrónicos | |
| Imagen | .jpg .jpeg .png .bmp .tiff .webp | Admite fotos de cámara |
| Word | .doc .docx | - |
| Excel | .xls .xlsx | - |
| PPT | .ppt .pptx | - |
Autenticación
El servidor MCP de ADP utiliza autenticación mediante clave de API, que se pasa a través de la variable de entorno ADP_API_KEY:
"env": {
"ADP_API_KEY": "<YOUR-ADP-API-Key>"
}
- La clave de API está disponible en la página My MCP de la consola de ADP
- Cada clave de API está vinculada a un único usuario y solo puede acceder a las aplicaciones y datos de ese usuario
- La clave de API se pasa únicamente como variable de entorno al proceso local y nunca aparece en los cuerpos de las solicitudes ni en las respuestas
Preguntas frecuentes
P: ¿Algunas herramientas de tarjetas/certificados no aparecen después de conectarse?
R: La lista de herramientas se genera dinámicamente según las aplicaciones inicializadas. En la primera conexión, el sistema inicializa automáticamente todas las aplicaciones preinstaladas. Actualice la lista de herramientas una vez que la inicialización se complete para ver todas las herramientas disponibles.
P: ¿Una herramienta de tarjetas devuelve "error de extracción"?
R: Asegúrese de que el archivo cargado coincida con el tipo de herramienta (por ejemplo, use extract_id_card para imágenes de documentos de identidad, no extract_vehicle_cert). El archivo debe estar en un formato de imagen o PDF compatible.
P: ¿Cómo manejar los tiempos de espera?
R: El tiempo de espera predeterminado es de 300 segundos (5 minutos). Puede ajustarlo mediante el parámetro timeout_seconds (máximo 900). Para archivos grandes o documentos complejos, use wait=false para el modo asíncrono y consulte los resultados más tarde usando task_id.
P: ¿Cómo se compara MCP con ADP CLI / OpenAPI?
R: Los tres ofrecen funcionalidad equivalente: la diferencia está en el método de integración:
| Método | Mejor para |
|---|---|
| Servidor MCP | Clientes de IA (Claude Desktop, Cursor, etc.) — sin necesidad de código |
| ADP CLI | Terminal, scripting, integración con habilidades de IA |
| OpenAPI | Integración de sistemas empresariales, llamadas a servicios backend |
Licencia
- Servidor MCP: Conexión gratuita, proporcionado como parte de la plataforma ADP
- Servicio ADP: Procesamiento de documentos de IA basado en la nube, facturación según uso
Nivel gratuito: los nuevos usuarios reciben 100 créditos gratuitos al mes al registrarse
Soporte y contacto
- Documentación de API: Guía de API abierta
- Manual del producto: Manual de operaciones en la nube
- Correo electrónico: mkt@laiye.com
- Sitio web: Laiye
Construye el futuro de la IA agéntica con ❤️ Copyright © 2026 [Laiye Technology (Beijing) Co., Ltd.] Todos los derechos reservados.