Japanese Text Analyzer MCP Server
Realiza análisis morfológico de texto japonés utilizando kuromoji.js.
Documentación
Japanese Text Analyzer MCP Server
Es un servidor MCP que permite realizar análisis morfológico de texto japonés. Mide y evalúa las características del texto desde una perspectiva lingüística, y resulta útil para la retroalimentación en la generación de texto.
Funciones
- Contar el número de caracteres del texto japonés (número real de caracteres excluyendo espacios y saltos de línea)
- Contar el número de palabras del texto japonés
- Análisis detallado de las características lingüísticas del texto japonés (longitud media de oración, proporción de categorías gramaticales, diversidad de vocabulario, etc.)
- Compatible tanto con rutas de archivo como con entrada directa de texto
- Resolución flexible de rutas de archivo (búsqueda posible con rutas absolutas, relativas o solo con el nombre del archivo)
Herramientas
Actualmente, están implementadas las siguientes herramientas:
count_chars
Mide el número de caracteres de un archivo. Especifique una ruta absoluta (tanto en formato Windows C:\Users... como en formato WSL/Linux /c/Users/...). Cuenta el número real de caracteres excluyendo espacios y saltos de línea.
Entrada:
filePath(string): Ruta del archivo cuyo número de caracteres se va a contar (se recomienda una ruta absoluta en formato Windows o WSL/Linux)
Salida:
- Número de caracteres del archivo (número real de caracteres excluyendo espacios y saltos de línea)
count_words
Mide el número de palabras de un archivo. Especifique una ruta absoluta (tanto en formato Windows C:\Users... como en formato WSL/Linux /c/Users/...). En inglés cuenta las palabras separadas por espacios, y en japonés utiliza análisis morfológico.
Entrada:
filePath(string): Ruta del archivo cuyo número de palabras se va a contar (se recomienda una ruta absoluta en formato Windows o WSL/Linux)language(string, opcional, predeterminado: "en"): Idioma del archivo (en: inglés, ja: japonés)
Salida:
- Número de palabras del archivo
- En modo japonés, también muestra los resultados detallados del análisis morfológico
count_clipboard_chars
Mide el número de caracteres de un texto. Cuenta el número real de caracteres excluyendo espacios y saltos de línea.
Entrada:
text(string): Texto cuyo número de caracteres se va a contar
Salida:
- Número de caracteres del texto (número real de caracteres excluyendo espacios y saltos de línea)
count_clipboard_words
Mide el número de palabras de un texto. En inglés cuenta las palabras separadas por espacios, y en japonés utiliza análisis morfológico.
Entrada:
text(string): Texto cuyo número de palabras se va a contarlanguage(string, opcional, predeterminado: "en"): Idioma del texto (en: inglés, ja: japonés)
Salida:
- Número de palabras del texto
- En modo japonés, también muestra los resultados detallados del análisis morfológico
analyze_text
Realiza un análisis morfológico detallado y un análisis de las características lingüísticas del texto. Analiza la complejidad de las oraciones, la proporción de categorías gramaticales, la diversidad de vocabulario, etc.
Entrada:
text(string): Texto a analizar
Salida:
- Información básica del texto (número total de caracteres, número de oraciones, número total de morfemas)
- Resultados del análisis detallado (longitud media de oración, proporción de categorías gramaticales, proporción de tipos de caracteres, diversidad de vocabulario, etc.)
analyze_file
Realiza un análisis morfológico detallado y un análisis de las características lingüísticas de un archivo. Analiza la complejidad de las oraciones, la proporción de categorías gramaticales, la diversidad de vocabulario, etc.
Entrada:
filePath(string): Ruta del archivo a analizar (se recomienda una ruta absoluta en formato Windows o WSL/Linux)
Salida:
- Información básica del archivo (número total de caracteres, número de oraciones, número total de morfemas)
- Resultados del análisis detallado (longitud media de oración, proporción de categorías gramaticales, proporción de tipos de caracteres, diversidad de vocabulario, etc.)
Uso
Instalación mediante Smithery
Para instalar Japanese Text Analyzer para Claude Desktop automáticamente a través de Smithery:
npx -y @smithery/cli install @Mistizz/mcp-JapaneseTextAnalyzer --client claude
Ejecución con npx
Este paquete se puede ejecutar directamente desde el repositorio de GitHub con npx:
npx -y github:Mistizz/mcp-JapaneseTextAnalyzer
Uso con Claude for Desktop
Agregue lo siguiente al archivo de configuración de Claude for Desktop:
Windows:
%AppData%\Claude\claude_desktop_config.json
macOS:
~/Library/Application Support/Claude/claude_desktop_config.json
{
"mcpServers": {
"JapaneseTextAnalyzer": {
"command": "npx",
"args": [
"-y",
"github:Mistizz/mcp-JapaneseTextAnalyzer"
]
}
}
}
Uso con Cursor
En Cursor, agregue una configuración similar al archivo mcp.json dentro de la carpeta .cursor.
Windows:
%USERPROFILE%\.cursor\mcp.json
macOS/Linux:
~/.cursor/mcp.json
Configuración general (funciona en la mayoría de los entornos):
{
"mcpServers": {
"JapaneseTextAnalyzer": {
"command": "npx",
"args": [
"-y",
"github:Mistizz/mcp-JapaneseTextAnalyzer"
]
}
}
}
Si lo anterior no funciona en un entorno Windows, pruebe lo siguiente:
{
"mcpServers": {
"JapaneseTextAnalyzer": {
"command": "cmd",
"args": [
"/c",
"npx",
"-y",
"github:Mistizz/mcp-JapaneseTextAnalyzer"
]
}
}
}
Ejemplos de uso
Contar el número de caracteres de un texto directamente
このテキストの文字数を数えてください。
Contar el número de palabras de un archivo en modo japonés
C:\path\to\your\file.txt の単語数を日本語モードで数えてください。
Contar el número de palabras con una ruta en formato WSL/Linux
/c/Users/username/Documents/file.txt の単語数を日本語モードで数えてください。
Contar el número de palabras solo con el nombre del archivo
README.md の単語数を英語モードで数えてください。
Pegar texto y contar el número de palabras en japonés
次のテキストの日本語の単語数を数えてください:
吾輩は猫である。名前はまだ無い。どこで生れたかとんと見当がつかぬ。何でも薄暗いじめじめした所でニャーニャー泣いていた事だけは記憶している。
Analizar las características lingüísticas detalladas de un texto
次のテキストを詳細に分析してください:
私は昨日、新しい本を買いました。とても面白そうな小説で、友人からの評判も良かったです。今週末にゆっくり読む予定です。
Analizar las características lingüísticas detalladas de un archivo
C:\path\to\your\file.txt を詳細に分析してください。
Función de resolución de rutas de archivo
Esta herramienta busca archivos de forma flexible cuando se especifica una ruta de archivo:
- Si se especifica una ruta absoluta, se utiliza tal cual
- Ruta absoluta en formato Windows (ej.:
C:\Users\username\Documents\file.txt) - Tanto las rutas absolutas en formato WSL/Linux (ej.:
/c/Users/username/Documents/file.txt) se detectan y convierten automáticamente
- Ruta absoluta en formato Windows (ej.:
- Resuelve rutas relativas con respecto al directorio actual (directorio de trabajo)
- Busca con respecto al directorio de inicio (
%USERPROFILE%o$HOME) - Busca con respecto al directorio de escritorio
- Busca con respecto al directorio de documentos
De esta manera, incluso si solo se especifica un nombre de archivo como «README.md», se busca automáticamente en varios directorios comunes y, si se encuentra el archivo, se utiliza. Además, las rutas obtenidas desde entornos WSL o Git Bash (formato /c/Users/...) también se pueden usar directamente en entornos Windows.
Sobre el funcionamiento interno
Esta herramienta utiliza una biblioteca de análisis morfológico llamada «kuromoji.js» para contar palabras en japonés. El análisis morfológico es un proceso básico del procesamiento del lenguaje natural que divide el texto en las unidades mínimas con significado (morfemas).
El proceso de análisis morfológico puede tardar en inicializarse. En particular, dado que es necesario cargar los datos del diccionario, la primera ejecución puede tardar un poco. Al inicializar el analizador morfológico al iniciar el servidor, se minimiza el retraso al ejecutar las herramientas.
Sobre el análisis de las características lingüísticas
Las herramientas «analyze_text» y «analyze_file» calculan diversas características lingüísticas del texto basándose en los resultados del análisis morfológico. Estas incluyen los siguientes indicadores:
- Longitud media de oración: Número medio de caracteres por oración. Cuanto mayor sea este valor, más probable es que el texto sea difícil de leer.
- Número de morfemas por oración: Número medio de morfemas por oración. Representa la densidad de la oración y la complejidad sintáctica.
- Proporción de categorías gramaticales: Muestra la proporción en que se utilizan categorías gramaticales como sustantivos, verbos, adjetivos, etc. en el texto.
- Proporción de partículas: Muestra la frecuencia con la que se utilizan partículas específicas y analiza la estructura y el flujo de las oraciones.
- Proporción de tipos de caracteres: Muestra la proporción de composición de hiragana, katakana, kanji y caracteres alfanuméricos.
- Diversidad de vocabulario: Muestra la proporción entre el número de palabras diferentes y el número total de palabras (relación tipo/marca) y mide la riqueza del vocabulario.
- Proporción de palabras en katakana: Muestra la frecuencia de uso de palabras en katakana y refleja la cantidad de préstamos lingüísticos y términos técnicos, así como la informalidad del estilo.
- Frecuencia de lenguaje honorífico: Muestra la frecuencia de uso de expresiones honoríficas y mide la cortesía y el grado de formalidad del texto.
- Número medio de signos de puntuación: Muestra el número medio de signos de puntuación por oración y proporciona un indicador sobre la segmentación de las oraciones y la legibilidad.
Al combinar estos indicadores, es posible analizar las características del texto desde múltiples perspectivas y evaluar el estilo, la legibilidad, la especialización, etc.
Licencia
Este servidor MCP se proporciona bajo la licencia MIT. Esto significa que puede usar, modificar y distribuir el software libremente de acuerdo con los términos de la licencia MIT. Para más detalles, consulte el archivo LICENSE del repositorio del proyecto.
