GenPark OCR Table
Agrupa los cuadros delimitadores de texto OCR proporcionados por el grupo en filas y columnas alineadas a la izquierda y formatea tablas Markdown. MCP local en Python; no realiza OCR de imágenes.
Documentación
genpark-ocr-table
Agrupa los cuadros de texto OCR proporcionados en filas y columnas de tabla alineadas a la izquierda. No se realiza OCR de imágenes.
Python 3.9+; biblioteca estándar en tiempo de ejecución; licencia MIT.
Instalación y ejecución
Descargue genpark-ocr-table.mcpb desde GitHub Releases e instálelo con un cliente compatible con MCPB. Python debe estar instalado y disponible como python.
Alternativamente, clone este repositorio y configure un servidor MCP stdio con el comando python y argumentos que contengan la ruta absoluta a mcp_server.py.
Herramientas
reconstruct_table_gridformat_to_markdownrun_benchmark_table_reconstruction
Ejecute python -m unittest discover -s tests para las comprobaciones de regresión. La verificación de integración oficial del SDK de MCP utiliza la dependencia de desarrollo mcp: python tests/check_mcp.py.
Limitaciones
Estos son ayudantes deterministas que operan sobre datos estructurados proporcionados, no modelos de aprendizaje automático. La entrada y la salida permanecen en el proceso local. No se requiere un endpoint alojado, acceso automático a archivos ni acceso a la red. El estado dura solo durante el proceso actual. Las herramientas de referencia ejecutan ejemplos sintéticos en estado aislado; su estado no es una certificación de calidad de producción.
Las filas utilizan una tolerancia vertical de 8 píxeles; las columnas utilizan alineación del borde izquierdo con una tolerancia de 20 píxeles. No se admiten celdas combinadas, texto rotado ni diseños centrados.