GenPark OCR Table

Agrupe caixas delimitadoras de texto OCR fornecidas em linhas e colunas alinhadas à esquerda e formate tabelas Markdown. MCP Python local; não realiza OCR de imagem.

Documentação

genpark-ocr-table

Agrupa caixas de texto OCR fornecidas em linhas e colunas de tabela alinhadas à esquerda. Nenhuma OCR de imagem é realizada.

Python 3.9+; biblioteca padrão em tempo de execução; licença MIT.

Instalação e execução

Baixe genpark-ocr-table.mcpb de GitHub Releases e instale com um cliente compatível com MCPB. O Python deve estar instalado e disponível como python.

Alternativamente, clone este repositório e configure um servidor MCP stdio com o comando python e argumentos contendo o caminho absoluto para mcp_server.py.

Listagem Smithery

Ferramentas

  • reconstruct_table_grid
  • format_to_markdown
  • run_benchmark_table_reconstruction

Execute python -m unittest discover -s tests para verificações de regressão. A verificação de integração oficial do SDK MCP usa a dependência de desenvolvimento mcp: python tests/check_mcp.py.

Limitações

Estes são auxiliares determinísticos que operam em dados estruturados fornecidos, não modelos de aprendizado de máquina. A entrada e a saída permanecem no processo local. Nenhum endpoint hospedado, acesso automático a arquivos ou acesso à rede é necessário. O estado dura apenas durante o processo atual. As ferramentas de benchmark executam exemplos sintéticos em estado isolado; seu status não é uma certificação de qualidade de produção.

As linhas usam uma tolerância vertical de 8 pixels; as colunas usam alinhamento pela borda esquerda com tolerância de 20 pixels. Células mescladas, texto rotacionado e layouts centralizados não são suportados.