GenPark OCR Table
Agrupe caixas delimitadoras de texto OCR fornecidas em linhas e colunas alinhadas à esquerda e formate tabelas Markdown. MCP Python local; não realiza OCR de imagem.
Documentação
genpark-ocr-table
Agrupa caixas de texto OCR fornecidas em linhas e colunas de tabela alinhadas à esquerda. Nenhuma OCR de imagem é realizada.
Python 3.9+; biblioteca padrão em tempo de execução; licença MIT.
Instalação e execução
Baixe genpark-ocr-table.mcpb de GitHub Releases e instale com um cliente compatível com MCPB. O Python deve estar instalado e disponível como python.
Alternativamente, clone este repositório e configure um servidor MCP stdio com o comando python e argumentos contendo o caminho absoluto para mcp_server.py.
Ferramentas
reconstruct_table_gridformat_to_markdownrun_benchmark_table_reconstruction
Execute python -m unittest discover -s tests para verificações de regressão. A verificação de integração oficial do SDK MCP usa a dependência de desenvolvimento mcp: python tests/check_mcp.py.
Limitações
Estes são auxiliares determinísticos que operam em dados estruturados fornecidos, não modelos de aprendizado de máquina. A entrada e a saída permanecem no processo local. Nenhum endpoint hospedado, acesso automático a arquivos ou acesso à rede é necessário. O estado dura apenas durante o processo atual. As ferramentas de benchmark executam exemplos sintéticos em estado isolado; seu status não é uma certificação de qualidade de produção.
As linhas usam uma tolerância vertical de 8 pixels; as colunas usam alinhamento pela borda esquerda com tolerância de 20 pixels. Células mescladas, texto rotacionado e layouts centralizados não são suportados.