LLM Broker
Una sola clave compatible con OpenAI para cada modelo: puntuaciones de referencia medidas y precios en vivo, cada solicitud enrutada a la oferta más barata que cumpla con tus criterios.
Servidor MCP alojado
npx add-mcp 'https://api.llm-broker.net/api/v1/broker/mcp'Se instala en Claude Code, Codex, Cursor y más
Documentación
DeepSeek V4.1 Flash OpenInference 0.004 / 3.12 ▲ DeepSeek V4.1 Flash Relace 0.002 / 2.40 ▲ DeepSeek V4.1 Flash InferenceNet 0.021 / 0.40 ▼ Mimo V2.6 Flash Io Net 0.13 / 0.27 ▼ DeepSeek V4.1 Flash Wafer 0.050 / 0.60 ▲ DeepSeek V4.1 Flash Morph 0.025 / 0.38 ▼ DeepSeek V4.1 Flash Alibaba 0.15 / 0.60 ▼ Mimo V2.6 Flash InferenceNet 0.11 / 0.28 Mimo V2.6 Pro GMICloud 0.44 / 0.87 ▲ Mimo V2.6 Flash GMICloud 0.14 / 0.28 ▲ DeepSeek V4.1 Flash Venice 0.30 / 1.20 ▼ DeepSeek V4.1 Flash Baidu 0.30 / 1.20 ▲ DeepSeek V4.1 Flash StreamLake 0.14 / 0.56 ▼ DeepSeek V4.1 Flash DeepSeek 0.15 / 0.60 ▼ DeepSeek V4.1 Flash Novita 0.24 / 0.96 ▼ DeepSeek V4.1 Flash Fireworks 0.30 / 1.20 ▲ DeepSeek V4.1 Flash Makora 0.20 / 0.99 ▼ DeepSeek V4.1 Flash Ionstream 0.10 / 1.15 DeepSeek V4.1 Flash DigitalOcean 0.18 / 0.72 ▼ DeepSeek V4.1 Flash AtlasCloud 0.14 / 0.56 ▲ DeepSeek V4.1 Flash BaseTen 0.30 / 1.20 Mimo V2.6 Flash DeepInfra 0.14 / 0.28 DeepSeek V4.1 Flash Phala 0.21 / 0.84 ▼ Ling 3.0 Flash VL DeepInfra 0.060 / 0.18 DeepSeek V4 Flash 0731 DeepInfra 0.060 / 0.18 DeepSeek V4.1 Flash Decart 0.090 / 0.18 GPT 6 Luna OpenAI 0.050 / 0.25 GLM 5.3 Flash Novita 0.15 / 0.50 Mimo V2.6 Pro DeepInfra 0.43 / 0.87 Minimax M3 DeepInfra 0.28 / 1.10 Mimo V2.5 Pro Novita 0.52 / 1.04 Inkling Small DeepInfra 0.45 / 1.20 Qwen3.8 27b Novita 0.42 / 3.00 DeepSeek V4 Pro DeepInfra 1.30 / 2.60 DeepSeek V4 Pro 0813 DeepInfra 1.30 / 2.60 Kimi K2.6 Novita 0.80 / 3.40 Gemini 3.7 Flash DeepInfra 0.75 / 3.75 Kimi K2.7 Code Novita 0.95 / 4.00 Inkling DeepInfra 0.95 / 4.05 Qwen3.7 Max Novita 1.25 / 3.75 GLM 5.1 Novita 1.38 / 4.40 GLM 5.2 Novita 1.40 / 4.40 GLM 5.3 Novita 1.40 / 4.40 GPT 5.6 Sol OpenAI 1.00 / 5.00 GPT 6.1 Sol OpenAI 1.00 / 5.00 GPT 6 Sol OpenAI 1.00 / 5.00 DeepSeek V4.1 Flash OpenInference 0.004 / 3.12 ▲ DeepSeek V4.1 Flash Relace 0.002 / 2.40 ▲ DeepSeek V4.1 Flash InferenceNet 0.021 / 0.40 ▼ Mimo V2.6 Flash Io Net 0.13 / 0.27 ▼ DeepSeek V4.1 Flash Wafer 0.050 / 0.60 ▲ DeepSeek V4.1 Flash Morph 0.025 / 0.38 ▼ DeepSeek V4.1 Flash Alibaba 0.15 / 0.60 ▼ Mimo V2.6 Flash InferenceNet 0.11 / 0.28 Mimo V2.6 Pro GMICloud 0.44 / 0.87 ▲ Mimo V2.6 Flash GMICloud 0.14 / 0.28 ▲ DeepSeek V4.1 Flash Venice 0.30 / 1.20 ▼ DeepSeek V4.1 Flash Baidu 0.30 / 1.20 ▲ DeepSeek V4.1 Flash StreamLake 0.14 / 0.56 ▼ DeepSeek V4.1 Flash DeepSeek 0.15 / 0.60 ▼ DeepSeek V4.1 Flash Novita 0.24 / 0.96 ▼ DeepSeek V4.1 Flash Fireworks 0.30 / 1.20 ▲ DeepSeek V4.1 Flash Makora 0.20 / 0.99 ▼ DeepSeek V4.1 Flash Ionstream 0.10 / 1.15 DeepSeek V4.1 Flash DigitalOcean 0.18 / 0.72 ▼ DeepSeek V4.1 Flash AtlasCloud 0.14 / 0.56 ▲ DeepSeek V4.1 Flash BaseTen 0.30 / 1.20 Mimo V2.6 Flash DeepInfra 0.14 / 0.28 DeepSeek V4.1 Flash Phala 0.21 / 0.84 ▼ Ling 3.0 Flash VL DeepInfra 0.060 / 0.18 DeepSeek V4 Flash 0731 DeepInfra 0.060 / 0.18 DeepSeek V4.1 Flash Decart 0.090 / 0.18 GPT 6 Luna OpenAI 0.050 / 0.25 GLM 5.3 Flash Novita 0.15 / 0.50 Mimo V2.6 Pro DeepInfra 0.43 / 0.87 Minimax M3 DeepInfra 0.28 / 1.10 Mimo V2.5 Pro Novita 0.52 / 1.04 Inkling Small DeepInfra 0.45 / 1.20 Qwen3.8 27b Novita 0.42 / 3.00 DeepSeek V4 Pro DeepInfra 1.30 / 2.60 DeepSeek V4 Pro 0813 DeepInfra 1.30 / 2.60 Kimi K2.6 Novita 0.80 / 3.40 Gemini 3.7 Flash DeepInfra 0.75 / 3.75 Kimi K2.7 Code Novita 0.95 / 4.00 Inkling DeepInfra 0.95 / 4.05 Qwen3.7 Max Novita 1.25 / 3.75 GLM 5.1 Novita 1.38 / 4.40 GLM 5.2 Novita 1.40 / 4.40 GLM 5.3 Novita 1.40 / 4.40 GPT 5.6 Sol OpenAI 1.00 / 5.00 GPT 6.1 Sol OpenAI 1.00 / 5.00 GPT 6 Sol OpenAI 1.00 / 5.00
El mejor rendimiento al mejor precio, automáticamente.
Dices una vez lo que necesitas: rendimiento o modelo, familia de modelos, ubicación, velocidad, capacidades, precio. Nosotros nos aseguramos de que tu clave de API obtenga exactamente eso, hoy y con cada nueva generación de modelos, sin que tengas que ajustar nada. LLM, imágenes, salida de voz y transcripción con una sola clave; precios comparados en vivo, rendimiento medido por nosotros mismos, cuenta y facturación también vía API.
38 modelos en comparación
39 plataformas
0.18 USD por millón de salida, desde
Tú defines los criterios. Nosotros los mantenemos actualizados.
Define una vez lo que importa: tu clave de API obtiene exactamente eso, decidido de nuevo en cada solicitud. Todos los campos forman parte de la misma API compatible con OpenAI.
Rendimiento o modelo
El mejor modelo medido para cada caso de uso, un nivel (solid, strong, top), un rendimiento mínimo propio — por ejemplo, 0.80 en programación — o un nombre de modelo fijo. De lo contrario, elegimos el más barato que cumpla con eso.
category + level | min_score · model
Familia de modelos
Por ejemplo, claude, qwen3 o deepseek/deepseek-v4. Si aparece una nueva generación, se incluye en cuanto esté en el mercado — con min_score, en cuanto la hayamos medido.
family
Ubicación
Suiza, UE, EE. UU. o Asia: solo proveedores con ubicación de ejecución registrada por nosotros (eu incluye ch).
region
Velocidad
Ordenar según el rendimiento medido, cuando el tiempo de respuesta importa.
sort: "speed"
Capacidades
Herramientas, salida estructurada, razonamiento, entrada de imágenes, contexto mínimo — cada proveedor seleccionado debe poder hacerlo.
capabilities · min_context
Precio
El más barato primero, mejor puntuación por franco o un precio máximo estricto por millón de tokens.
sort: "price" | "value" · max_price
Integrar una vez. No volver a actualizar nunca.
Quien construye una plataforma o herramienta se fija hoy en un modelo — y mañana lo actualiza cuando aparece uno mejor o más barato. Aquí te fijas en tus requisitos, no en un modelo. La interfaz sigue igual; la selección detrás la renovamos continuamente.
- Las nuevas generaciones de modelos se incorporan sin cambios de código.
- Si un proveedor falla, el siguiente que cumpla tus reglas asume el control.
- Las bajadas de precios del mercado llegan automáticamente a ti.
- Si nada cumple tus reglas, lo decimos claramente (409) — sin desvíos ocultos.
{"model": "james-direct",
"routing": {"family": "deepseek", "category": "coding", "min_score": 0.8,
"sort": "value", "region": "eu", "capabilities": ["tools"]},
"messages": [{"role": "user", "content": "…"}]}
Precios de mercado
Precios de lista de las plataformas en USD por 1 millón de tokens (tipo del día, sin nuestro recargo), verificados cada 15 minutos. Las barras hacen comparables precio y velocidad; índice = Artificial-Analysis vía OpenRouter (preselección, solo garantizamos lo que medimos nosotros mismos). Ubicación de ejecución: registrada por nosotros — de lo contrario, "global" (según proveedor).
Mapa de rendimiento
Cada punto es un modelo: a la izquierda barato, arriba potente. La línea brillante es la frontera de eficiencia — ningún otro modelo es a la vez más barato y mejor. Tamaño de burbuja = ventana de contexto.
↖ potente y barato 0 20 40 60 0.1 1 10 100 USD por millón de tokens de salida (logarítmico) → Índice de razonamiento ↑ GPT 6.1 Sol GPT 5.6 Sol Mimo V2.6 Pro GLM 5.3 Flash GLM 5.3 Flash DeepSeek V4.1 Flash DeepSeek V4.1 Flash DeepSeek V4 Flash 0731 Claude Opus 5.5 Claude Sonnet 5.5 Claude Fable 5.1 Claude Opus 5 Gemini 3.7 Flash
Frontera de eficiencia anthropicopenaideepseekz-aimoonshotaiqwenxiaomigoogle
Rango de precios por plataforma
El mismo modelo cuesta diferente según la plataforma. El punto brillante es el más barato — hacia allí enrutamos.
0.1110100
GPT 6 Astra
×2.2 · −55 %
GPT 6.1 Sol
×2.2 · −55 %
GPT 6 Sol
×2.2 · −55 %
GPT 5.6 Sol
×4.4 · −77 %
Grok 4.6
×1.1 · −9 %
Kimi K3
×1.1 · −5 %
DeepSeek V4.1 Flash
×17.3 · −94 %
GPT 6 Luna
×2.2 · −55 %
Mimo V2.6 Flash
×1.3 · −24 %
DeepSeek V4 Pro 0813
×1.5 · −34 %
DeepSeek V4 Flash 0731
×7.3 · −86 %
DeepSeek V4 Pro
×1.2 · −19 %
Movimiento de precios
Precio de salida más barato (USD por 1 millón de tokens) en todas las plataformas — velas por intervalo, rojo = más caro, turquesa = más barato.
Vela = 4 h · desde 29.09.26 01:32 · 234 cambios de precio
0.180 ▼ 70.0 % 0.208 0.329 0.451 0.573 29.09.26 00:00 01.10.26 08:00 03.10.26 20:00 0.180
Relación calidad-precio
Puntos de índice por USD de precio de salida · Movimiento de precios de los últimos 30 días.
1. D DeepSeek V4.1 Flash deepseek 219.1 P/USD nuevo
2. D DeepSeek V4 Flash 0731 deepseek 190.3 P/USD nuevo
3. O GPT 6 Luna openai 152.1 P/USD nuevo
4. I Ling 3.0 Flash VL inclusionai 136.5 P/USD nuevo
5. X Mimo V2.6 Flash xiaomi 135.6 P/USD nuevo
6. Z GLM 5.3 Flash z-ai 83.7 P/USD nuevo
7. X Mimo V2.6 Pro xiaomi 53.2 P/USD nuevo
8. M Minimax M3 minimax 26.6 P/USD nuevo
9. X Mimo V2.5 Pro xiaomi 24.9 P/USD nuevo
10. T Inkling Small thinkingmachines 21.4 P/USD nuevo
| Modelo | Razonamiento | Código | Precio entrada/salida | Velocidad | Ubicación | Historial | Plataforma | Contexto |
|---|---|---|---|---|---|---|---|---|
| Claude Opus 5.5 anthropic | 58 | HumanEval+ 93 % | 4.00 20.00 | 159 tok/s Uptime 100 % | global | Amazon Bedrock · 6 ▾ - Amazon Bedrock: 4.00 / 20.00 - Azure: 4.00 / 20.00 - Google: 4.00 / 20.00 - Claude Platform on AWS: 4.00 / 20.00 - Anthropic: 4.00 / 20.00 - DeepInfra: 4.00 / 20.00 | 1 M | |
| Claude Sonnet 5.5 anthropic | 56 | HumanEval+ 94 % | 2.00 10.00 | 110 tok/s Uptime 100 % | global | Google · 6 ▾ - Google: 2.00 / 10.00 - Amazon Bedrock: 2.00 / 10.00 - Azure: 2.00 / 10.00 - Anthropic: 2.00 / 10.00 - Claude Platform on AWS: 2.00 / 10.00 - DeepInfra: 2.00 / 10.00 | 1 M | |
| Claude Fable 5.1 anthropic | 53 | 82 | 10.00 50.00 | 57 tok/s Uptime 100 % | global | nuevo | Amazon Bedrock · 4 ▾ - Amazon Bedrock: 10.00 / 50.00 - Google: 10.00 / 50.00 - Azure: 10.00 / 50.00 - Anthropic: 10.00 / 50.00 | 1 M |
| GPT 6 Astra openai | 53 | 77 | 5.00 25.00 | 122 tok/s Uptime 100 % | global | nuevo | OpenAI · 3 ▾ - OpenAI: 5.00 / 25.00 - Azure: 10.00 / 50.00 - Amazon Bedrock: 11.00 / 55.00 | 1 M |
| GPT 6.1 Sol openai | 52 | HumanEval+ 95 % | 1.00 5.00 | 87 tok/s Uptime 100 % | global | nuevo | OpenAI · 3 ▾ - OpenAI: 1.00 / 5.00 - Azure: 2.00 / 10.00 - Amazon Bedrock: 2.20 / 11.00 | 1 M |
| Claude Opus 5 anthropic | 51 | 78 | 5.00 25.00 | 188 tok/s Uptime 100 % | global | nuevo | Claude Platform on AWS · 6 ▾ - Claude Platform on AWS: 5.00 / 25.00 - Azure: 5.00 / 25.00 - Google: 5.00 / 25.00 - Anthropic: 5.00 / 25.00 - Amazon Bedrock: 5.00 / 25.00 - DeepInfra: 5.00 / 25.00 | 1 M |
| Claude Fable 5 anthropic | 50 | 77 | 10.00 50.00 | – | global | nuevo | DeepInfra · 1 ▾ - DeepInfra: 10.00 / 50.00 | 1 M |
| GPT 6 Sol openai | 48 | 1.00 5.00 | 82 tok/s Uptime 100 % | global | nuevo | OpenAI · 3 ▾ - OpenAI: 1.00 / 5.00 - Azure: 2.00 / 10.00 - Amazon Bedrock: 2.20 / 11.00 | 1 M | |
| GPT 5.6 Sol openai | 47 | 77 | 1.00 5.00 | 140 tok/s Uptime 100 % | global | nuevo | OpenAI · 3 ▾ - OpenAI: 1.00 / 5.00 - Azure: 4.00 / 20.00 - Amazon Bedrock: 4.40 / 22.00 | 1 M |
| Grok 4.7 x-ai | 46 | 2.00 6.00 | 78 tok/s Uptime 100 % | global | nuevo | xAI · 1 ▾ - xAI: 2.00 / 6.00 | 500 k | |
| Mimo V2.6 Pro xiaomi | 46 | 0.43 0.87 | 30 tok/s Uptime 100 % | global | DeepInfra · 4 ▾ - DeepInfra: 0.43 / 0.87 - GMICloud: 0.44 / 0.87 - Xiaomi: 0.44 / 0.87 - Novita: 0.44 / 0.87 | 1 M | ||
| GLM 5.3 z-ai | 45 | 75 | 1.40 4.40 | 58 tok/s medido | global | nuevo | Novita · 1 ▾ - Novita: 1.40 / 4.40 | 1 M |
| Grok 4.6 x-ai | 44 | 77 | 2.00 6.00 | 95 tok/s Uptime 100 % | global | nuevo | xAI · 2 ▾ - xAI: 2.00 / 6.00 - Amazon Bedrock: 2.20 / 6.60 | 500 k |
| Kimi K3 moonshotai | 44 | 76 | 2.85 14.25 | 25 tok/s medido | global | nuevo | DeepInfra · 2 ▾ - DeepInfra: 2.85 / 14.25 - Novita: 3.00 / 15.00 | 1 M |
| GLM 5.3 Flash z-ai | 42 | 72 | 0.15 0.50 | 63 tok/s medido | global | nuevo | Novita · 1 ▾ - Novita: 0.15 / 0.50 | 1 M |
| Claude Opus 4.8 anthropic | 42 | 74 | 5.00 25.00 | – | global | nuevo | DeepInfra · 1 ▾ - DeepInfra: 5.00 / 25.00 | 1 M |
| Qwen3.8 2.4t A95b qwen | 40 | 72 | 2.00 6.00 | 32 tok/s medido | global | nuevo | DeepInfra · 2 ▾ - DeepInfra: 2.00 / 6.00 - Novita: 2.00 / 6.00 | 1 M |
| DeepSeek V4.1 Flash deepseek | 40 | HumanEval+ 89 % | 0.090 0.18 | 225 tok/s Uptime 100 % | global | Decart · 29 ▾ - Decart: 0.090 / 0.18 - Morph: 0.025 / 0.38 - InferenceNet: 0.021 / 0.40 - Sail Research: 0.080 / 0.40 - DekaLLM: 0.12 / 0.40 - DeepInfra: 0.14 / 0.42 - Wafer: 0.050 / 0.60 - StreamLake: 0.14 / 0.56 - AtlasCloud: 0.14 / 0.56 - DeepSeek: 0.15 / 0.60 - Alibaba: 0.15 / 0.60 - CoreWeave: 0.20 / 0.65 - DigitalOcean: 0.18 / 0.72 - GMICloud: 0.18 / 0.72 - NextBit: 0.21 / 0.84 - Phala: 0.21 / 0.84 - Makora: 0.20 / 0.99 - Novita: 0.24 / 0.96 - Ionstream: 0.10 / 1.15 - Baidu: 0.30 / 1.20 - SiliconFlow: 0.30 / 1.20 - Parasail: 0.30 / 1.20 - Venice: 0.30 / 1.20 - BaseTen: 0.30 / 1.20 - Modal: 0.30 / 1.20 - Fireworks: 0.30 / 1.20 - Together: 0.30 / 1.20 - Relace: 0.002 / 2.40 - OpenInference: 0.004 / 3.12 | 1 M | |
| Gemini 3.7 Flash google | 39 | 76 | 0.75 3.75 | 1 tok/s medido | global | nuevo | DeepInfra · 1 ▾ - DeepInfra: 0.75 / 3.75 | 1 M |
| Claude Sonnet 5 anthropic | 38 | 72 | 3.00 15.00 | 65 tok/s medido | global | nuevo | DeepInfra · 1 ▾ - DeepInfra: 3.00 / 15.00 | 1 M |
| GPT 6 Luna openai | 38 | 0.050 0.25 | 123 tok/s Uptime 100 % | global | nuevo | OpenAI · 3 ▾ - OpenAI: 0.050 / 0.25 - Azure: 0.10 / 0.50 - Amazon Bedrock: 0.11 / 0.55 | 1 M | |
| Mimo V2.6 Flash xiaomi | 38 | 0.11 0.28 | 101 tok/s Uptime 100 % | global | InferenceNet · 8 ▾ - InferenceNet: 0.11 / 0.28 - Darkbloom: 0.12 / 0.28 - Io Net: 0.13 / 0.27 - GMICloud: 0.14 / 0.28 - DeepInfra: 0.14 / 0.28 - Xiaomi: 0.14 / 0.28 - Novita: 0.14 / 0.28 - Venice: 0.18 / 0.35 | 1 M | ||
| DeepSeek V4 Pro 0813 deepseek | 36 | 69 | 1.30 2.60 | 69 tok/s medido | global | nuevo | DeepInfra · 2 ▾ - DeepInfra: 1.30 / 2.60 - Novita: 1.32 / 3.96 | 1 M |
| DeepSeek V4 Flash 0731 deepseek | 34 | 69 | 0.060 0.18 | 44 tok/s medido | global | nuevo | DeepInfra · 2 ▾ - DeepInfra: 0.060 / 0.18 - Novita: 0.44 / 1.32 | 1 M |
| Qwen3.8 27b qwen | 34 | 68 | 0.42 3.00 | – | global | nuevo | Novita · 1 ▾ - Novita: 0.42 / 3.00 | 1 M |
| GLM 5.2 z-ai | 34 | 69 | 1.40 4.40 | – | global | nuevo | Novita · 1 ▾ - Novita: 1.40 / 4.40 | 1 M |
| Gemini 3.5 Flash google | 33 | 70 | 1.50 9.00 | – | global | nuevo | DeepInfra · 1 ▾ - DeepInfra: 1.50 / 9.00 | 1 M |
| DeepSeek V4 Pro deepseek | 30 | 59 | 1.30 2.60 | – | global | nuevo | DeepInfra · 2 ▾ - DeepInfra: 1.30 / 2.60 - Novita: 1.60 / 3.20 | 1 M |
| Claude Sonnet 4.6 anthropic | 30 | 63 | 3.00 15.00 | – | global | nuevo | DeepInfra · 1 ▾ - DeepInfra: 3.00 / 15.00 | 1 M |
| Qwen3.7 Max qwen | 30 | 66 | 1.25 3.75 | – | global | nuevo | Novita · 2 ▾ - Novita: 1.25 / 3.75 - DeepInfra: 2.50 / 7.50 | 1 M |
| Minimax M3 minimax | 29 | 59 | 0.28 1.10 | – | global | nuevo | DeepInfra · 1 ▾ - DeepInfra: 0.28 / 1.10 | 524 k |
| Kimi K2.6 moonshotai | 27 | 62 | 0.80 3.40 | – | global | nuevo | Novita · 2 ▾ - Novita: 0.80 / 3.40 - DeepInfra: 0.75 / 3.50 | 262 k |
| GLM 5.1 z-ai | 26 | 56 | 1.38 4.40 | – | global | nuevo | Novita · 1 ▾ - Novita: 1.38 / 4.40 | 204 k |
| Mimo V2.5 Pro xiaomi | 26 | 60 | 0.52 1.04 | – | global | nuevo | Novita · 1 ▾ - Novita: 0.52 / 1.04 | 1 M |
| Kimi K2.7 Code moonshotai | 26 | 61 | 0.95 4.00 | – | global | nuevo | Novita · 1 ▾ - Novita: 0.95 / 4.00 | 262 k |
| Inkling Small thinkingmachines | 26 | 53 | 0.45 1.20 | – | global | nuevo | DeepInfra · 1 ▾ - DeepInfra: 0.45 / 1.20 | 524 k |
| Inkling thinkingmachines | 25 | 52 | 0.95 4.05 | – | global | nuevo | DeepInfra · 1 ▾ - DeepInfra: 0.95 / 4.05 | 524 k |
| Ling 3.0 Flash VL inclusionai | 25 | 57 | 0.060 0.18 | – | global | nuevo | DeepInfra · 2 ▾ - DeepInfra: 0.060 / 0.18 - Novita: 0.075 / 0.22 | 262 k |
Imagen y voz — la misma clave
No solo LLM: imágenes, salida de voz y transcripción del mercado, con la misma API compatible con OpenAI y la misma facturación. Tú indicas un ID de mercado, nosotros tomamos el proveedor más barato. Precios en USD, incluido nuestro margen, en vivo desde /api/v1/broker/models?type=….

Generación de imágenes
Desde el borrador rápido hasta la calidad de impresión: FLUX, Qwen-Image, Seedream y más — o iris, nuestro propio modelo de imagen.
iris0.0079 USD por imagenstabilityai/sdxl-turbo0.00026 USD por imagenblack-forest-labs/FLUX-1-schnell0.00065 USD por imagenPrunaAI/p-image0.0065 USD por imagenblack-forest-labs/FLUX-1-dev0.0117 USD por imagenblack-forest-labs/FLUX-2-dev0.013 USD por imagen
curl https://llm-broker.net/api/v1/images/generations \
-H "Authorization: Bearer $BROKER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"black-forest-labs/FLUX-1-schnell","prompt":"a lighthouse at dawn","size":"1024x1024"}'

Salida de voz
Texto a voz en muchas voces e idiomas — Kokoro, Qwen3-TTS, Chatterbox y más — o quill con voces clonadas.
quill0.121 USD por 1 000 caractereshexgrad/Kokoro-82M0.000806 USD por 1 000 caracteresResembleAI/chatterbox-turbo0.0013 USD por 1 000 caracteresResembleAI/chatterbox-multilingual0.0013 USD por 1 000 caracteresAudio8/Audio8-TTS-Preview-0.6b0.0065 USD por 1 000 caracteressesame/csm-1b0.0091 USD por 1 000 caracteres
curl https://llm-broker.net/api/v1/audio/speech \
-H "Authorization: Bearer $BROKER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"hexgrad/Kokoro-82M","input":"Hello from LLM Broker","voice":"af_bella"}' -o hello.mp3

Transcripción
Idioma a texto: Whisper, Qwen3-ASR, Voxtral y más — facturado según la duración que mide el proveedor.
quill0.0121 USD por minutonvidia/Nemotron-3.5-ASR-Streaming-Multilingual-0.6b0.00026 USD por minutoopenai/whisper-large-v3-turbo0.00026 USD por minutoQwen/Qwen3-ASR-0.6B0.00026 USD por minutoQwen/Qwen3-ASR-1.7B0.000586 USD por minutoopenai/whisper-large-v30.000586 USD por minuto
curl https://llm-broker.net/api/v1/audio/transcriptions \
-H "Authorization: Bearer $BROKER_API_KEY" \
-F model=openai/whisper-large-v3-turbo -F [email protected]
Un prompt: tu asistente de IA lo configura todo
Copia el prompt en Claude Code, Cursor, Codex, OpenCode o cualquier otro asistente de codificación. Él lee nuestra documentación, abre la cuenta vía API, guarda la clave de forma segura, integra la API y la verifica con una prueba de humo. Tú solo confirmas el pago.

- llms.txt — Introducción para agentes https://llm-broker.net/llms.txt
- OpenAPI (legible por máquina) https://llm-broker.net/api/openapi
- Documentación de API en el navegador https://llm-broker.net/api/docs
- Wiki: API https://astrioncore.wiki/api
- Wiki: Cuenta y pago vía API https://astrioncore.wiki/api#konto
- Lista de mercado (sin clave) https://llm-broker.net/api/v1/broker/models
Claude Code: pega el prompt en la sesión · Cursor/Windsurf: en el chat del agente · OpenCode: opencode run "…" · Codex: codex "…"
Richte in diesem Projekt den LLM Broker ein (https://llm-broker.net) — eine OpenAI-kompatible API für LLM, Bilder,
Sprachausgabe und Transkription mit einem Schlüssel. Arbeite selbstständig; frag mich nur, wenn eine Zahlung
bestätigt oder ein Geheimnis eingegeben werden muss.
1. Lies zuerst die Beschreibungen, nicht raten:
- https://llm-broker.net/llms.txt (Einstieg für Agenten)
- https://llm-broker.net/api/openapi (alle Endpunkte und Schemata)
- https://astrioncore.wiki/api und https://astrioncore.wiki/api#konto (Konto und Bezahlung per API)
2. Schlüssel: Ist BROKER_API_KEY (beginnt mit ast_sk_) nicht gesetzt, eröffne ein Konto per API:
POST https://llm-broker.net/api/v1/broker/accounts
{"billing": "topup", "amount": 25, "currency": "USD"} (Leistung wählt jede Anfrage per "routing")
Zeig mir die checkout_url (die Karte wird einmal bei Stripe eingegeben) und frag danach status_url ab,
bis 200 kommt. Der api_key erscheint GENAU EINMAL: sofort in .env als BROKER_API_KEY speichern,
.env in .gitignore, nie ins Log oder in einen Commit. base_url steht in derselben Antwort.
3. Einbinden: OpenAI-SDK der Projektsprache mit base_url und BROKER_API_KEY. Modelle findest du unter
GET /api/v1/broker/models?type=chat|image|speech|transcription (ohne Schlüssel lesbar).
- LLM: POST /api/v1/chat/completions, model "james-direct" mit "routing" (category, level|min_score, sort,
region, family, capabilities, max_price) oder direkt eine Markt-ID wie "deepseek/deepseek-v4.1-flash".
- Bilder: POST /api/v1/images/generations, Sprache: POST /api/v1/audio/speech,
Transkription: POST /api/v1/audio/transcriptions — jeweils mit einer Markt-ID der passenden type.
4. Lege eine kleine Client-Schicht an (Konfiguration aus der Umgebung, keine festen Modellnamen im Code —
lieber routing), schreibe einen Rauchtest mit einem kurzen Chat-Aufruf und führe ihn aus.
5. Abrechnung: GET /api/v1/broker/billing zeigt Guthaben und Verbrauch; Aufladen oder Monatsrahmen ändern
mit PATCH /api/v1/broker/billing, Karte mit POST|DELETE /api/v1/broker/card.
Fehler: 402 insufficient_balance (aufladen), 409 no_matching_offer (routing lockern),
404 model_not_found (Marktliste prüfen), 429 rate_limited (später erneut).
Fasse am Ende zusammen, was eingerichtet ist und wo der Schlüssel liegt.
Set up LLM Broker in this project (https://llm-broker.net) — one OpenAI-compatible API for LLMs, images, speech
and transcription with a single key. Work on your own; only ask me when a payment must be confirmed or a secret
must be entered.
1. Read the descriptions first, don't guess:
- https://llm-broker.net/llms.txt (entry point for agents)
- https://llm-broker.net/api/openapi (all endpoints and schemas)
- https://astrioncore.wiki/api and https://astrioncore.wiki/api#konto (account and billing via API)
2. Key: if BROKER_API_KEY (starts with ast_sk_) is not set, open an account via the API:
POST https://llm-broker.net/api/v1/broker/accounts
{"billing": "topup", "amount": 25, "currency": "USD"} (every request picks its level via "routing")
Show me the checkout_url (the card is entered once at Stripe), then poll status_url until it returns 200.
The api_key is shown EXACTLY ONCE: store it right away in .env as BROKER_API_KEY, add .env to .gitignore,
never log or commit it. base_url is in the same response.
3. Integrate: the OpenAI SDK of the project's language with base_url and BROKER_API_KEY. Models are listed at
GET /api/v1/broker/models?type=chat|image|speech|transcription (no key needed).
- LLM: POST /api/v1/chat/completions, model "james-direct" with "routing" (category, level|min_score, sort,
region, family, capabilities, max_price) or a market id such as "deepseek/deepseek-v4.1-flash".
- Images: POST /api/v1/images/generations, speech: POST /api/v1/audio/speech,
transcription: POST /api/v1/audio/transcriptions — each with a market id of the matching type.
4. Add a small client layer (configuration from the environment, no hard-coded model names — prefer routing),
write a smoke test with one short chat call and run it.
5. Billing: GET /api/v1/broker/billing shows balance and spend; top up or change the monthly limit with
PATCH /api/v1/broker/billing, the card with POST|DELETE /api/v1/broker/card.
Errors: 402 insufficient_balance (top up), 409 no_matching_offer (relax routing),
404 model_not_found (check the market list), 429 rate_limited (retry later).
Finish with a summary of what is set up and where the key is stored.
Rendimiento por solicitud
Tú eliges en cada solicitud qué tan potente debe ser el modelo — mediante routing en la misma API compatible con OpenAI. Un nivel es una puntuación mínima en NUESTRAS mediciones por caso de uso; best es el modelo con la puntuación más alta medida; un umbral propio se establece con "min_score": 0.85. El precio es el precio actual para clientes (en la moneda elegida por 1 millón de tokens de entrada/salida, incluido nuestro margen) del modelo más económico que cumple el nivel — aplica para taylor, james-direct y cualquier ID de mercado.
Programación medida con HumanEval+ "category": "coding"
Sólido ≥ 70 %
0.05 / 0.22
21 modelos cumplen
"level": "solid"
Fuerte ≥ 80 %
0.05 / 0.22
19 modelos cumplen
"level": "strong"
Élite ≥ 88 %
0.07 / 0.23
17 modelos cumplen
"level": "top"
Mejor puntuación más alta
1.29 / 6.50
1 modelo cumple
"level": "best"
Razonamiento y conocimiento medido con MMLU-Pro + GPQA Diamond "category": "reasoning"
Sólido ≥ 55 %
0.05 / 0.22
16 modelos cumplen
"level": "solid"
Fuerte ≥ 65 %
0.07 / 0.23
15 modelos cumplen
"level": "strong"
Élite ≥ 75 %
0.07 / 0.23
11 modelos cumplen
"level": "top"
Mejor puntuación más alta
1.29 / 6.50
1 modelo cumple
"level": "best"
Matemáticas medido con MATH "category": "math"
Sólido ≥ 60 %
0.05 / 0.22
17 modelos cumplen
"level": "solid"
Fuerte ≥ 75 %
0.05 / 0.22
17 modelos cumplen
"level": "strong"
Élite ≥ 85 %
0.07 / 0.23
12 modelos cumplen
"level": "top"
Mejor puntuación más alta
5.20 / 26.00
1 modelo cumple
"level": "best"
Seguimiento de instrucciones medido con IFEval "category": "instruction_following"
Sólido ≥ 75 %
0.05 / 0.22
19 modelos cumplen
"level": "solid"
Fuerte ≥ 82 %
0.07 / 0.23
15 modelos cumplen
"level": "strong"
Élite ≥ 88 %
0.16 / 0.52
9 modelos cumplen
"level": "top"
Mejor puntuación más alta
2.60 / 7.80
1 modelo cumple
"level": "best"
Obtener la clave
Registra una tarjeta una vez y listo. El número de la tarjeta solo lo ve Stripe — nosotros nunca.
Registrarse y pagar: todo vía API
Un programa o agente abre la cuenta, obtiene la clave y gestiona la facturación por sí mismo. Dinero antes que clave: sin saldo gratuito, la clave se crea solo después del pago.
1 · CUENTA
Abrir la cuenta
Elige la facturación — un nivel es opcional, cada solicitud lo elige mediante routing. La respuesta indica checkout_url y status_url.
curl -X POST https://llm-broker.net/api/v1/broker/accounts \
-H "Content-Type: application/json" \
-d '{"billing":"topup",
"amount":25}'
2 · TARJETA
Pagar una vez
La tarjeta se ingresa una sola vez en Stripe — por ti o por un agente con navegador. Nosotros nunca vemos el número de la tarjeta.
3 · CLAVE
Recoger la clave
202 hasta el pago, luego api_key (ast_sk_…) y base_url — exactamente una vez.
curl https://llm-broker.net/api/v1/broker/accounts/$SESSION_ID
4 · FACTURACIÓN
Gestionar por ti mismo
Leer saldo y consumo, recargar o cambiar el límite mensual, cambiar o eliminar la tarjeta.
GET|PATCH /api/v1/broker/billing
POST|DELETE /api/v1/broker/card
Después todo funciona sin intervención humana: recarga con la tarjeta guardada, facturación mensual, cancelación. Solo la primera entrada de tarjeta requiere hoy un navegador en Stripe. Detalles: Wiki: Cuenta y pago vía API.
¿Qué modelo obtengo con taylor?
Sin nivel, el más potente; con nivel (por solicitud o como valor predeterminado de la clave), el más económico entre todos los que lo alcanzan en nuestras mediciones. La tabla anterior muestra el mercado; qué modelo responde a una solicitud individual lo decide el precio en el momento de la solicitud. Si prefieres el más fuerte en lugar del más económico: "routing": {"category": "…", "level": "best"} — aplica para taylor, james-direct y cualquier ID de mercado.
¿Qué significa "medido"?
Probamos cada modelo nosotros mismos con benchmarks abiertos (muestras, mismas configuraciones) y medimos regularmente de nuevo — todos sin modo de razonamiento, para que los valores sean comparables; los modelos de razonamiento suelen rendir mejor en tareas difíciles con el razonamiento activado. Puedes controlarlo por solicitud con reasoning_effort (p. ej., "none"). Los índices de terceros solo sirven para la preselección.
¿Y si ninguno cumple el nivel?
Entonces la API responde con level_unavailable y no cobra nada — nunca un modelo más débil en silencio.
¿También hay modelos de imagen y voz?
Sí: generación de imágenes, salida de voz y transcripción del mercado con la misma clave — ID de mercado bajo /api/v1/broker/models?type=image|speech|transcription, además de nuestros propios modelos iris y quill.
¿Cómo se factura?
Según el consumo al precio del día — tokens, imágenes, caracteres o minutos —, exclusivamente con tarjeta de crédito: recarga automática o mensual a posteriori. Sin suscripción, sin saldo inicial.