Japanese Text Analyzer MCP Server
Realiza análise morfológica em texto japonês usando kuromoji.js.
Documentação
Japanese Text Analyzer MCP Server
Servidor MCP que permite realizar análise morfológica de textos em japonês. Mede e avalia as características do texto sob uma perspectiva linguística, sendo útil para feedback na geração de textos.
Funcionalidades
- Conta o número de caracteres do texto em japonês (número efetivo de caracteres, excluindo espaços e quebras de linha)
- Conta o número de palavras do texto em japonês
- Análise detalhada das características linguísticas do texto em japonês (comprimento médio de frases, proporção de classes gramaticais, diversidade de vocabulário, etc.)
- Suporta tanto caminho de arquivo quanto entrada direta de texto
- Resolução flexível de caminho de arquivo (pesquisa por caminho absoluto, relativo ou apenas nome do arquivo)
Ferramentas
Atualmente, as seguintes ferramentas estão implementadas:
count_chars
Mede o número de caracteres de um arquivo. Especifique um caminho absoluto (formato Windows C:\Users... ou formato WSL/Linux /c/Users/...). Conta o número efetivo de caracteres, excluindo espaços e quebras de linha.
Entrada:
filePath(string): Caminho do arquivo para contar caracteres (recomenda-se caminho absoluto no formato Windows ou WSL/Linux)
Saída:
- Número de caracteres do arquivo (número efetivo, excluindo espaços e quebras de linha)
count_words
Mede o número de palavras de um arquivo. Especifique um caminho absoluto (formato Windows C:\Users... ou formato WSL/Linux /c/Users/...). Em inglês, conta palavras separadas por espaços; em japonês, usa análise morfológica.
Entrada:
filePath(string): Caminho do arquivo para contar palavras (recomenda-se caminho absoluto no formato Windows ou WSL/Linux)language(string, opcional, padrão: "en"): Idioma do arquivo (en: inglês, ja: japonês)
Saída:
- Número de palavras do arquivo
- No modo japonês, também exibe resultados detalhados da análise morfológica
count_clipboard_chars
Mede o número de caracteres de um texto. Conta o número efetivo de caracteres, excluindo espaços e quebras de linha.
Entrada:
text(string): Texto para contar caracteres
Saída:
- Número de caracteres do texto (número efetivo, excluindo espaços e quebras de linha)
count_clipboard_words
Mede o número de palavras de um texto. Em inglês, conta palavras separadas por espaços; em japonês, usa análise morfológica.
Entrada:
text(string): Texto para contar palavraslanguage(string, opcional, padrão: "en"): Idioma do texto (en: inglês, ja: japonês)
Saída:
- Número de palavras do texto
- No modo japonês, também exibe resultados detalhados da análise morfológica
analyze_text
Realiza análise morfológica detalhada e análise das características linguísticas do texto. Analisa complexidade das frases, proporção de classes gramaticais, diversidade de vocabulário, etc.
Entrada:
text(string): Texto a ser analisado
Saída:
- Informações básicas do texto (total de caracteres, número de frases, total de morfemas)
- Resultados da análise detalhada (comprimento médio de frases, proporção de classes gramaticais, proporção de tipos de caracteres, diversidade de vocabulário, etc.)
analyze_file
Realiza análise morfológica detalhada e análise das características linguísticas de um arquivo. Analisa complexidade das frases, proporção de classes gramaticais, diversidade de vocabulário, etc.
Entrada:
filePath(string): Caminho do arquivo a ser analisado (recomenda-se caminho absoluto no formato Windows ou WSL/Linux)
Saída:
- Informações básicas do arquivo (total de caracteres, número de frases, total de morfemas)
- Resultados da análise detalhada (comprimento médio de frases, proporção de classes gramaticais, proporção de tipos de caracteres, diversidade de vocabulário, etc.)
Como usar
Instalação via Smithery
Para instalar o Japanese Text Analyzer para Claude Desktop automaticamente via Smithery:
npx -y @smithery/cli install @Mistizz/mcp-JapaneseTextAnalyzer --client claude
Execução com npx
Este pacote pode ser executado diretamente do repositório GitHub com npx:
npx -y github:Mistizz/mcp-JapaneseTextAnalyzer
Uso com Claude for Desktop
Adicione o seguinte ao arquivo de configuração do Claude for Desktop:
Windows:
%AppData%\Claude\claude_desktop_config.json
macOS:
~/Library/Application Support/Claude/claude_desktop_config.json
{
"mcpServers": {
"JapaneseTextAnalyzer": {
"command": "npx",
"args": [
"-y",
"github:Mistizz/mcp-JapaneseTextAnalyzer"
]
}
}
}
Uso com Cursor
No Cursor, adicione configuração semelhante ao arquivo mcp.json na pasta .cursor.
Windows:
%USERPROFILE%\.cursor\mcp.json
macOS/Linux:
~/.cursor/mcp.json
Configuração geral (funciona na maioria dos ambientes):
{
"mcpServers": {
"JapaneseTextAnalyzer": {
"command": "npx",
"args": [
"-y",
"github:Mistizz/mcp-JapaneseTextAnalyzer"
]
}
}
}
No ambiente Windows, se o acima não funcionar, tente o seguinte:
{
"mcpServers": {
"JapaneseTextAnalyzer": {
"command": "cmd",
"args": [
"/c",
"npx",
"-y",
"github:Mistizz/mcp-JapaneseTextAnalyzer"
]
}
}
}
Exemplos de uso
Contar caracteres de texto diretamente
このテキストの文字数を数えてください。
Contar palavras de um arquivo no modo japonês
C:\path\to\your\file.txt の単語数を日本語モードで数えてください。
Contar palavras com caminho no formato WSL/Linux
/c/Users/username/Documents/file.txt の単語数を日本語モードで数えてください。
Contar palavras apenas com o nome do arquivo
README.md の単語数を英語モードで数えてください。
Colar texto e contar palavras em japonês
次のテキストの日本語の単語数を数えてください:
吾輩は猫である。名前はまだ無い。どこで生れたかとんと見当がつかぬ。何でも薄暗いじめじめした所でニャーニャー泣いていた事だけは記憶している。
Analisar características linguísticas detalhadas do texto
次のテキストを詳細に分析してください:
私は昨日、新しい本を買いました。とても面白そうな小説で、友人からの評判も良かったです。今週末にゆっくり読む予定です。
Analisar características linguísticas detalhadas de um arquivo
C:\path\to\your\file.txt を詳細に分析してください。
Funcionalidade de resolução de caminho de arquivo
Esta ferramenta busca arquivos de forma flexível quando um caminho de arquivo é especificado:
- Se um caminho absoluto for especificado, ele é usado diretamente
- Caminho absoluto no formato Windows (ex.:
C:\Users\username\Documents\file.txt) - Caminho absoluto no formato WSL/Linux (ex.:
/c/Users/username/Documents/file.txt) — ambos são detectados e convertidos automaticamente
- Caminho absoluto no formato Windows (ex.:
- Resolve caminhos relativos com base no diretório atual (diretório de trabalho)
- Busca com base no diretório home (
%USERPROFILE%ou$HOME) - Busca com base no diretório da área de trabalho
- Busca com base no diretório de documentos
Com isso, mesmo especificando apenas um nome de arquivo como "README.md", a ferramenta pesquisa automaticamente em alguns diretórios comuns e usa o arquivo se for encontrado. Além disso, caminhos obtidos de ambientes WSL ou Git Bash (formato /c/Users/...) também podem ser usados diretamente no ambiente Windows.
Sobre o funcionamento interno
Esta ferramenta usa a biblioteca de análise morfológica "kuromoji.js" para contagem de palavras em japonês. A análise morfológica é um processo básico de processamento de linguagem natural que divide o texto nas menores unidades com significado (morfemas).
O processo de análise morfológica pode levar tempo para inicializar. Especialmente, como é necessário carregar os dados do dicionário, a primeira execução pode demorar um pouco. Ao inicializar o analisador morfológico na inicialização do servidor, o atraso na execução das ferramentas é minimizado.
Sobre a análise de características linguísticas
As ferramentas "analyze_text" e "analyze_file" calculam várias características linguísticas do texto com base nos resultados da análise morfológica. Essas incluem os seguintes indicadores:
- Comprimento médio de frases: número médio de caracteres por frase. Quanto maior esse valor, maior a probabilidade de o texto ser difícil de ler.
- Morfemas por frase: número médio de morfemas por frase. Representa a densidade da frase e a complexidade sintática.
- Proporção de classes gramaticais: mostra a proporção em que classes gramaticais como substantivos, verbos, adjetivos, etc., são usadas no texto.
- Proporção de partículas: mostra a frequência com que partículas específicas são usadas e analisa a estrutura e o fluxo das frases.
- Proporção de tipos de caracteres: mostra a proporção de hiragana, katakana, kanji e caracteres alfanuméricos.
- Diversidade de vocabulário: mostra a proporção entre o número de palavras distintas e o total de palavras (razão tipo/token) e mede a riqueza do vocabulário.
- Proporção de palavras em katakana: mostra a frequência de uso de palavras em katakana e reflete a quantidade de palavras estrangeiras e termos técnicos, bem como o estilo casual do texto.
- Frequência de linguagem honorífica: mostra a frequência de expressões honoríficas e mede o nível de polidez e formalidade do texto.
- Número médio de pontuações: mostra o número médio de pontuações por frase e fornece um indicador sobre o ritmo das frases e a legibilidade.
Ao combinar esses indicadores, é possível analisar as características do texto sob múltiplas perspectivas e avaliar estilo, legibilidade, nível de especialização, etc.
Licença
Este servidor MCP é fornecido sob a licença MIT. Isso significa que o software pode ser usado, modificado e distribuído livremente, de acordo com os termos da licença MIT. Para mais detalhes, consulte o arquivo LICENSE no repositório do projeto.
