MCP Mistral OCR
Realizar OCR em arquivos locais e URLs (imagens, PDFs) usando a API Mistral AI.
GitHub
39
Experimente este MCPPatrocinadoDocumentação
MCP Mistral OCR
Um servidor MCP que fornece capacidades de OCR usando a API de OCR da Mistral AI. Este servidor pode processar arquivos locais e URLs, suportando imagens e PDFs.
Recursos
- Processar arquivos locais (imagens e PDFs) usando o OCR da Mistral
- Processar arquivos de URLs com especificação explícita do tipo de arquivo
- Suporte a múltiplos formatos de arquivo (JPG, PNG, PDF, etc.)
- Resultados salvos como arquivos JSON com carimbos de data/hora
- Containerização com Docker
- Gerenciamento de pacotes UV
Variáveis de Ambiente
MISTRAL_API_KEY: Sua chave de API da Mistral AIOCR_DIR: Caminho do diretório para processamento de arquivos locais. Dentro do contêiner, isso é sempre mapeado para/data/ocr
Instalação
Instalação via Smithery
Para instalar o Mistral OCR para Claude Desktop automaticamente via Smithery:
npx -y @smithery/cli install @everaldo/mcp/mistral-crosswalk --client claude
Usando Docker
- Construa a imagem Docker:
docker build -t mcp-mistral-ocr .
- Execute o contêiner:
docker run -e MISTRAL_API_KEY=your_api_key -e OCR_DIR=/data/ocr -v /path/to/local/files:/data/ocr mcp-mistral-ocr
Desenvolvimento Local
- Instale o gerenciador de pacotes UV:
pip install uv
- Crie e ative o ambiente virtual:
uv venv
source .venv/bin/activate # On Unix
# or
.venv\Scripts\activate # On Windows
- Instale as dependências:
uv pip install .
Configuração do Claude Desktop
Adicione esta configuração ao seu claude_desktop_config.json:
{
"mcpServers": {
"mistral-ocr": {
"command": "docker",
"args": [
"run",
"-i",
"--rm",
"-e",
"MISTRAL_API_KEY",
"-e",
"OCR_DIR",
"-v",
"C:/path/to/your/files:/data/ocr",
"mcp-mistral-ocr:latest"
],
"env": {
"MISTRAL_API_KEY": "<YOUR_MISTRAL_API_KEY>",
"OCR_DIR": "C:/path/to/your/files"
}
}
}
}
Ferramentas Disponíveis
1. process_local_file
Processa um arquivo do diretório OCR_DIR configurado.
{
"name": "process_local_file",
"arguments": {
"filename": "document.pdf"
}
}
2. process_url_file
Processa um arquivo de uma URL. Requer especificação explícita do tipo de arquivo.
{
"name": "process_url_file",
"arguments": {
"url": "https://example.com/document",
"file_type": "image" // or "pdf"
}
}
Saída
Os resultados do OCR são salvos em formato JSON no diretório output dentro de OCR_DIR. Cada arquivo de resultado é nomeado usando o seguinte formato:
- Para arquivos locais:
{original_filename}_{timestamp}.json - Para URLs:
{url_filename}_{timestamp}.jsonouurl_document_{timestamp}.jsonse nenhum nome de arquivo for encontrado na URL
O formato do carimbo de data/hora é YYYYMMDD_HHMMSS.
Tipos de Arquivo Suportados
- Imagens: JPG, JPEG, PNG, GIF, WebP
- Documentos: PDF e outros formatos de documento suportados pelo Mistral OCR
Limitações
- Tamanho máximo do arquivo: 50MB (imposto pela API da Mistral)
- Número máximo de páginas do documento: 1000 (imposto pela API da Mistral)
