GenPark OCR Table

Agrupa los cuadros delimitadores de texto OCR proporcionados por el grupo en filas y columnas alineadas a la izquierda y formatea tablas Markdown. MCP local en Python; no realiza OCR de imágenes.

Documentación

genpark-ocr-table

Agrupa los cuadros de texto OCR proporcionados en filas y columnas de tabla alineadas a la izquierda. No se realiza OCR de imágenes.

Python 3.9+; biblioteca estándar en tiempo de ejecución; licencia MIT.

Instalación y ejecución

Descargue genpark-ocr-table.mcpb desde GitHub Releases e instálelo con un cliente compatible con MCPB. Python debe estar instalado y disponible como python.

Alternativamente, clone este repositorio y configure un servidor MCP stdio con el comando python y argumentos que contengan la ruta absoluta a mcp_server.py.

Listado en Smithery

Herramientas

  • reconstruct_table_grid
  • format_to_markdown
  • run_benchmark_table_reconstruction

Ejecute python -m unittest discover -s tests para las comprobaciones de regresión. La verificación de integración oficial del SDK de MCP utiliza la dependencia de desarrollo mcp: python tests/check_mcp.py.

Limitaciones

Estos son ayudantes deterministas que operan sobre datos estructurados proporcionados, no modelos de aprendizaje automático. La entrada y la salida permanecen en el proceso local. No se requiere un endpoint alojado, acceso automático a archivos ni acceso a la red. El estado dura solo durante el proceso actual. Las herramientas de referencia ejecutan ejemplos sintéticos en estado aislado; su estado no es una certificación de calidad de producción.

Las filas utilizan una tolerancia vertical de 8 píxeles; las columnas utilizan alineación del borde izquierdo con una tolerancia de 20 píxeles. No se admiten celdas combinadas, texto rotado ni diseños centrados.