Japanese Text Analyzer MCP Server

Realiza análise morfológica em texto japonês usando kuromoji.js.

Documentação

MseeP.ai Security Assessment Badge

Japanese Text Analyzer MCP Server

Servidor MCP que permite realizar análise morfológica de textos em japonês. Mede e avalia as características do texto sob uma perspectiva linguística, sendo útil para feedback na geração de textos.

smithery badge Japanese Text Analyzer MCP server

Funcionalidades

  • Conta o número de caracteres do texto em japonês (número efetivo de caracteres, excluindo espaços e quebras de linha)
  • Conta o número de palavras do texto em japonês
  • Análise detalhada das características linguísticas do texto em japonês (comprimento médio de frases, proporção de classes gramaticais, diversidade de vocabulário, etc.)
  • Suporta tanto caminho de arquivo quanto entrada direta de texto
  • Resolução flexível de caminho de arquivo (pesquisa por caminho absoluto, relativo ou apenas nome do arquivo)

Ferramentas

Atualmente, as seguintes ferramentas estão implementadas:

count_chars

Mede o número de caracteres de um arquivo. Especifique um caminho absoluto (formato Windows C:\Users... ou formato WSL/Linux /c/Users/...). Conta o número efetivo de caracteres, excluindo espaços e quebras de linha.

Entrada:

  • filePath (string): Caminho do arquivo para contar caracteres (recomenda-se caminho absoluto no formato Windows ou WSL/Linux)

Saída:

  • Número de caracteres do arquivo (número efetivo, excluindo espaços e quebras de linha)

count_words

Mede o número de palavras de um arquivo. Especifique um caminho absoluto (formato Windows C:\Users... ou formato WSL/Linux /c/Users/...). Em inglês, conta palavras separadas por espaços; em japonês, usa análise morfológica.

Entrada:

  • filePath (string): Caminho do arquivo para contar palavras (recomenda-se caminho absoluto no formato Windows ou WSL/Linux)
  • language (string, opcional, padrão: "en"): Idioma do arquivo (en: inglês, ja: japonês)

Saída:

  • Número de palavras do arquivo
  • No modo japonês, também exibe resultados detalhados da análise morfológica

count_clipboard_chars

Mede o número de caracteres de um texto. Conta o número efetivo de caracteres, excluindo espaços e quebras de linha.

Entrada:

  • text (string): Texto para contar caracteres

Saída:

  • Número de caracteres do texto (número efetivo, excluindo espaços e quebras de linha)

count_clipboard_words

Mede o número de palavras de um texto. Em inglês, conta palavras separadas por espaços; em japonês, usa análise morfológica.

Entrada:

  • text (string): Texto para contar palavras
  • language (string, opcional, padrão: "en"): Idioma do texto (en: inglês, ja: japonês)

Saída:

  • Número de palavras do texto
  • No modo japonês, também exibe resultados detalhados da análise morfológica

analyze_text

Realiza análise morfológica detalhada e análise das características linguísticas do texto. Analisa complexidade das frases, proporção de classes gramaticais, diversidade de vocabulário, etc.

Entrada:

  • text (string): Texto a ser analisado

Saída:

  • Informações básicas do texto (total de caracteres, número de frases, total de morfemas)
  • Resultados da análise detalhada (comprimento médio de frases, proporção de classes gramaticais, proporção de tipos de caracteres, diversidade de vocabulário, etc.)

analyze_file

Realiza análise morfológica detalhada e análise das características linguísticas de um arquivo. Analisa complexidade das frases, proporção de classes gramaticais, diversidade de vocabulário, etc.

Entrada:

  • filePath (string): Caminho do arquivo a ser analisado (recomenda-se caminho absoluto no formato Windows ou WSL/Linux)

Saída:

  • Informações básicas do arquivo (total de caracteres, número de frases, total de morfemas)
  • Resultados da análise detalhada (comprimento médio de frases, proporção de classes gramaticais, proporção de tipos de caracteres, diversidade de vocabulário, etc.)

Como usar

Instalação via Smithery

Para instalar o Japanese Text Analyzer para Claude Desktop automaticamente via Smithery:

npx -y @smithery/cli install @Mistizz/mcp-JapaneseTextAnalyzer --client claude

Execução com npx

Este pacote pode ser executado diretamente do repositório GitHub com npx:

npx -y github:Mistizz/mcp-JapaneseTextAnalyzer

Uso com Claude for Desktop

Adicione o seguinte ao arquivo de configuração do Claude for Desktop:

Windows: %AppData%\Claude\claude_desktop_config.json

macOS: ~/Library/Application Support/Claude/claude_desktop_config.json

{
  "mcpServers": {
    "JapaneseTextAnalyzer": {
      "command": "npx",
      "args": [
        "-y",
        "github:Mistizz/mcp-JapaneseTextAnalyzer"
      ]
    }
  }
}

Uso com Cursor

No Cursor, adicione configuração semelhante ao arquivo mcp.json na pasta .cursor.

Windows: %USERPROFILE%\.cursor\mcp.json

macOS/Linux: ~/.cursor/mcp.json

Configuração geral (funciona na maioria dos ambientes):

{
  "mcpServers": {
    "JapaneseTextAnalyzer": {
      "command": "npx",
      "args": [
        "-y",
        "github:Mistizz/mcp-JapaneseTextAnalyzer"
      ]
    }
  }
}

No ambiente Windows, se o acima não funcionar, tente o seguinte:

{
  "mcpServers": {
    "JapaneseTextAnalyzer": {
      "command": "cmd",
      "args": [
        "/c",
        "npx",
        "-y",
        "github:Mistizz/mcp-JapaneseTextAnalyzer"
      ]
    }
  }
}

Exemplos de uso

Contar caracteres de texto diretamente

このテキストの文字数を数えてください。

Contar palavras de um arquivo no modo japonês

C:\path\to\your\file.txt の単語数を日本語モードで数えてください。

Contar palavras com caminho no formato WSL/Linux

/c/Users/username/Documents/file.txt の単語数を日本語モードで数えてください。

Contar palavras apenas com o nome do arquivo

README.md の単語数を英語モードで数えてください。

Colar texto e contar palavras em japonês

次のテキストの日本語の単語数を数えてください:

吾輩は猫である。名前はまだ無い。どこで生れたかとんと見当がつかぬ。何でも薄暗いじめじめした所でニャーニャー泣いていた事だけは記憶している。

Analisar características linguísticas detalhadas do texto

次のテキストを詳細に分析してください:

私は昨日、新しい本を買いました。とても面白そうな小説で、友人からの評判も良かったです。今週末にゆっくり読む予定です。

Analisar características linguísticas detalhadas de um arquivo

C:\path\to\your\file.txt を詳細に分析してください。

Funcionalidade de resolução de caminho de arquivo

Esta ferramenta busca arquivos de forma flexível quando um caminho de arquivo é especificado:

  1. Se um caminho absoluto for especificado, ele é usado diretamente
    • Caminho absoluto no formato Windows (ex.: C:\Users\username\Documents\file.txt)
    • Caminho absoluto no formato WSL/Linux (ex.: /c/Users/username/Documents/file.txt) — ambos são detectados e convertidos automaticamente
  2. Resolve caminhos relativos com base no diretório atual (diretório de trabalho)
  3. Busca com base no diretório home (%USERPROFILE% ou $HOME)
  4. Busca com base no diretório da área de trabalho
  5. Busca com base no diretório de documentos

Com isso, mesmo especificando apenas um nome de arquivo como "README.md", a ferramenta pesquisa automaticamente em alguns diretórios comuns e usa o arquivo se for encontrado. Além disso, caminhos obtidos de ambientes WSL ou Git Bash (formato /c/Users/...) também podem ser usados diretamente no ambiente Windows.

Sobre o funcionamento interno

Esta ferramenta usa a biblioteca de análise morfológica "kuromoji.js" para contagem de palavras em japonês. A análise morfológica é um processo básico de processamento de linguagem natural que divide o texto nas menores unidades com significado (morfemas).

O processo de análise morfológica pode levar tempo para inicializar. Especialmente, como é necessário carregar os dados do dicionário, a primeira execução pode demorar um pouco. Ao inicializar o analisador morfológico na inicialização do servidor, o atraso na execução das ferramentas é minimizado.

Sobre a análise de características linguísticas

As ferramentas "analyze_text" e "analyze_file" calculam várias características linguísticas do texto com base nos resultados da análise morfológica. Essas incluem os seguintes indicadores:

  • Comprimento médio de frases: número médio de caracteres por frase. Quanto maior esse valor, maior a probabilidade de o texto ser difícil de ler.
  • Morfemas por frase: número médio de morfemas por frase. Representa a densidade da frase e a complexidade sintática.
  • Proporção de classes gramaticais: mostra a proporção em que classes gramaticais como substantivos, verbos, adjetivos, etc., são usadas no texto.
  • Proporção de partículas: mostra a frequência com que partículas específicas são usadas e analisa a estrutura e o fluxo das frases.
  • Proporção de tipos de caracteres: mostra a proporção de hiragana, katakana, kanji e caracteres alfanuméricos.
  • Diversidade de vocabulário: mostra a proporção entre o número de palavras distintas e o total de palavras (razão tipo/token) e mede a riqueza do vocabulário.
  • Proporção de palavras em katakana: mostra a frequência de uso de palavras em katakana e reflete a quantidade de palavras estrangeiras e termos técnicos, bem como o estilo casual do texto.
  • Frequência de linguagem honorífica: mostra a frequência de expressões honoríficas e mede o nível de polidez e formalidade do texto.
  • Número médio de pontuações: mostra o número médio de pontuações por frase e fornece um indicador sobre o ritmo das frases e a legibilidade.

Ao combinar esses indicadores, é possível analisar as características do texto sob múltiplas perspectivas e avaliar estilo, legibilidade, nível de especialização, etc.

Licença

Este servidor MCP é fornecido sob a licença MIT. Isso significa que o software pode ser usado, modificado e distribuído livremente, de acordo com os termos da licença MIT. Para mais detalhes, consulte o arquivo LICENSE no repositório do projeto.