Qwen Max
Un servidor MCP para el modelo de lenguaje grande Qwen Max, impulsado por Dashscope.
Documentación
Servidor MCP de Qwen Max
Una implementación de servidor de Protocolo de Contexto de Modelo (MCP) para el modelo de lenguaje Qwen Max.
¿Por qué Node.js? Esta implementación utiliza Node.js/TypeScript, ya que actualmente proporciona la integración más estable y confiable con servidores MCP en comparación con otros lenguajes como Python. El SDK de Node.js para MCP ofrece mejor seguridad de tipos, manejo de errores y compatibilidad con Claude Desktop.
Requisitos previos
- Node.js (v18 o superior)
- npm
- Claude Desktop
- Clave de API de Dashscope
Instalación
Instalación mediante Smithery
Para instalar el Servidor MCP de Qwen Max para Claude Desktop automáticamente a través de Smithery:
npx -y @smithery/cli install @66julienmartin/mcp-server-qwen_max --client claude
Instalación manual
git clone https://github.com/66julienmartin/mcp-server-qwen-max.git
cd Qwen_Max
npm install
Selección de modelo
Por defecto, este servidor usa el modelo Qwen-Max. La serie Qwen ofrece varios modelos comerciales con diferentes capacidades:
Qwen-Max
Proporciona el mejor rendimiento de inferencia, especialmente para tareas complejas y de múltiples pasos.
Ventana de contexto: 32,768 tokens
- Entrada máxima: 30,720 tokens
- Salida máxima: 8,192 tokens
- Precio: $0.0016/1K tokens (entrada), $0.0064/1K tokens (salida)
- Cuota gratuita: 1 millón de tokens
Versiones disponibles:
- qwen-max (Estable)
- qwen-max-latest (Última)
- qwen-max-2025-01-25 (Instantánea, también conocida como qwen-max-0125 o Qwen2.5-Max)
Qwen-Plus
Combinación equilibrada de rendimiento, velocidad y costo, ideal para tareas moderadamente complejas.
Ventana de contexto: 131,072 tokens
- Entrada máxima: 129,024 tokens
- Salida máxima: 8,192 tokens
- Precio: $0.0004/1K tokens (entrada), $0.0012/1K tokens (salida)
- Cuota gratuita: 1 millón de tokens
Versiones disponibles:
- qwen-plus (Estable)
- qwen-plus-latest (Última)
- qwen-plus-2025-01-25 (Instantánea, también conocida como qwen-plus-0125)
Qwen-Turbo
Rápido y de bajo costo, adecuado para tareas simples.
- Ventana de contexto: 1,000,000 tokens
- Entrada máxima: 1,000,000 tokens
- Salida máxima: 8,192 tokens
- Precio: $0.00005/1K tokens (entrada), $0.0002/1K tokens (salida)
- Cuota gratuita: 1 millón de tokens
Versiones disponibles:
- qwen-turbo (Estable)
- qwen-turbo-latest (Última)
- qwen-turbo-2024-11-01 (Instantánea, también conocida como qwen-turbo-1101)
Para modificar el modelo, actualice el nombre del modelo en src/index.ts:
// For Qwen-Max (default)
model: "qwen-max"
// For Qwen-Plus
model: "qwen-plus"
// For Qwen-Turbo
model: "qwen-turbo"
Para obtener información más detallada sobre los modelos disponibles, visite la Documentación de Modelos de Alibaba Cloud https://www.alibabacloud.com/help/en/model-studio/getting-started/models?spm=a3c0i.23458820.2359477120.1.446c7d3f9LT0FY.
Estructura del proyecto
qwen-max-mcp/
├── src/
│ ├── index.ts # Main server implementation
├── build/ # Compiled files
│ ├── index.js
├── LICENSE
├── README.md
├── package.json
├── package-lock.json
└── tsconfig.json
Configuración
- Cree un archivo
.enven la raíz del proyecto:
DASHSCOPE_API_KEY=your-api-key-here
- Actualice la configuración de Claude Desktop:
{
"mcpServers": {
"qwen_max": {
"command": "node",
"args": ["/path/to/Qwen_Max/build/index.js"],
"env": {
"DASHSCOPE_API_KEY": "your-api-key-here"
}
}
}
}
Desarrollo
npm run dev # Watch mode
npm run build # Build
npm run start # Start server
Características
- Generación de texto con modelos Qwen
- Parámetros configurables (max_tokens, temperature)
- Manejo de errores
- Soporte de protocolo MCP
- Integración con Claude Desktop
- Soporte para todos los modelos comerciales de Qwen (Max, Plus, Turbo)
- Amplias ventanas de contexto de tokens
Uso de la API
// Example tool call
{
"name": "qwen_max",
"arguments": {
"prompt": "Your prompt here",
"max_tokens": 8192,
"temperature": 0.7
}
}
El parámetro de temperatura
El parámetro de temperatura controla la aleatoriedad de la salida del modelo:
Valores más bajos (0.0-0.7): Salidas más enfocadas y deterministas Valores más altos (0.7-1.0): Salidas más creativas y variadas
Configuraciones de temperatura recomendadas según la tarea:
Generación de código: 0.0-0.3 Escritura técnica: 0.3-0.5 Tareas generales: 0.7 (predeterminado) Escritura creativa: 0.8-1.0
Manejo de errores
El servidor proporciona mensajes de error detallados para problemas comunes:
Errores de autenticación de API Parámetros inválidos Límite de tasa Problemas de red Límite de tokens excedido Problemas de disponibilidad del modelo
Contribuciones
¡Las contribuciones son bienvenidas! Siéntase libre de enviar una Solicitud de Extracción (Pull Request).
Licencia
MIT
