BridgeNode
Inferencia de IA mediante x402. Paga con Solana USDC. Sin registro. Sin claves API.
Documentación
BridgeNode — Guía Completa para Agentes
Puente de inferencia de IA para agentes de IA. Sin claves API, sin registro, sin suscripciones. Los modelos gratuitos están incluidos, y las primeras llamadas en modelos de pago son gratuitas — después pagas por solicitud con USDC de Solana vía x402 (HTTP 402). Las tarifas de transacción están patrocinadas — el agente solo necesita USDC para pagar.
Acceso gratuito (empieza aquí — no se requiere wallet)
- Modelos gratuitos: gpt-oss-20b, gpt-oss-120b, glm-4.7-flash, glm-4.5-flash, glm-4.6v-flash — servidos sin costo, sin wallet, sin gas. Notas sobre modelos gratuitos (léelas antes de elegir uno):
glm-4.7-flash— ⚠️ temporalmente poco confiable: modelo gratuito de z.ai: más lento que los modelos gratuitos de Groq — una respuesta puede tardar hasta un minuto, y el proveedor a veces está sobrecargado. Si devuelve un error (límite de tasa / sobrecarga temporal), reintenta una vez o cambia a gpt-oss-20b, el modelo gratuito más confiable.glm-4.5-flash— ⚠️ temporalmente poco confiable: modelo gratuito de z.ai: más lento que los modelos gratuitos de Groq — una respuesta puede tardar hasta un minuto, y el proveedor a veces está sobrecargado. Si devuelve un error (límite de tasa / sobrecarga temporal), reintenta una vez o cambia a gpt-oss-20b, el modelo gratuito más confiable.glm-4.6v-flash: modelo gratuito de z.ai: más lento que los modelos gratuitos de Groq — una respuesta puede tardar hasta un minuto, y el proveedor a veces está sobrecargado. Si devuelve un error (límite de tasa / sobrecarga temporal), reintenta una vez o cambia a gpt-oss-20b, el modelo gratuito más confiable.- Pruebas gratuitas en modelos de pago: las primeras 2 llamada(s) a CUALQUIER modelo de pago
son gratuitas por cliente, para que puedas experimentar una respuesta completa antes de pagar. Las respuestas
de prueba llevan
X-Bridgenode-Free-Trial: 1yX-Bridgenode-Free-Trials-Remaining: <n>. - Cuando se agotan las pruebas, una solicitud no pagada devuelve 402 cuyo
objeto
extensions.bridgenodete dice exactamente qué hacer a continuación:free_models(lista),free_trials_remaining,how_to_pay,docs. - Cada 402 también lleva
request_hint. Para una solicitud válida, enumera los hechos por los que pagarías (modelo, context_window, max_output_tokens, clamping). Si la solicitud no puede tener éxito, el 402 lo dice antes de que firmes:request_hint.ok = falseconproblemymessage(por ejemplounknown_model,empty_messages,invalid_json,unknown_mode) — corrige eso y reintenta, ninguna firma se desperdicia jamás en una solicitud que sería rechazada.
Límites (publicados — contados por cliente, y aplicados exactamente así)
- Un cliente = una wallet con historial de pagos, de lo contrario tu red (presupuesto diario: /24 IPv4, /64 IPv6; pruebas: /16 IPv4, /48 IPv6).
- Pruebas gratuitas: 2 llamadas en modelos DE PAGO (únicas, por cliente).
- Presupuesto gratuito diario: 200 llamadas y 100,000 tokens por cliente por día (MODELOS GRATUITOS Y PRUEBAS juntos, se reinicia a las 00:00 UTC). Por encima → 429
free_daily_quota_exhaustedconRetry-After. - Por modelo gratuito, nuestro propio límite diario:
gpt-oss-120b160,000,gpt-oss-20b160,000 tokens/día (compartido por todos los clientes). Alcanzado → 429free_budget_exhaustednombrando un modelo que aún funciona — nos detenemos antes que el proveedor. - Tasa: 30 solicitudes gratuitas/minuto por cliente; 10 desafíos de pago/minuto.
- Concurrencia: 20 llamadas gratuitas a la vez en todos los clientes. Por encima → 503
free_path_busy+Retry-After(nunca una cola silenciosa). - Cada respuesta gratuita lleva los números:
X-Bridgenode-Free-Quota-Limit,X-Bridgenode-Free-Quota-Remaining,X-Bridgenode-Free-Quota-Reset,X-Bridgenode-Free-Quota-Tokens-Limit,X-Bridgenode-Free-Quota-Tokens-Remaining,X-Bridgenode-Free-Trials-Remaining. - Las solicitudes de pago (x402) nunca se ven afectadas por ninguno de estos límites — ni esperan por el tráfico gratuito ni comparten sus presupuestos.
- Los modelos gratuitos y las pruebas gratuitas comparten un límite de tasa por cliente; las solicitudes de pago no.
- No necesitas enviar un encabezado especial para usar una prueba — solo envía una solicitud
normal con un modelo de pago y sin encabezado de pago. Las pruebas y el presupuesto
gratuito diario (
X-Bridgenode-Free-Quota-*en cada respuesta gratuita) se cuentan por identidad de cliente: un cliente anónimo es su red (/24IPv4,/64IPv6), y una wallet (SIGN-IN-WITH-X, sin pago) se convierte en su propia identidad una vez que tiene historial de pagos con nosotros — una wallet nueva no compra un presupuesto fresco, pero un cliente que ha pagado nunca es castigado por sus vecinos.
Endpoints
- API compatible con OpenAI: https://bridgenode.cc/v1
- Modelos y precios (JSON): https://bridgenode.cc/v1/models
- Servidor MCP (streamable-http): https://bridgenode.cc/mcp
- Mapa de instalación para agentes: https://bridgenode.cc/llms.txt
- Archivo de skill: https://bridgenode.cc/skill.md
Modelos y Precios
Los precios están en USDC por token (6 decimales). Precios en vivo: GET https://bridgenode.cc/v1/models.
| Modelo | Entrada / token | Salida / token | Ventana de contexto | Salida máxima | Herramientas |
|---|---|---|---|---|---|
gpt-oss-20b 🆓 | $0.00000000 | $0.00000000 | 8,000 | 8,000 | ✅ |
gpt-oss-120b 🆓 | $0.00000000 | $0.00000000 | 8,000 | 8,000 | ✅ |
glm-4.7-flash 🆓 | $0.00000000 | $0.00000000 | 131,072 | 8,192 | ✅ |
glm-4.5-flash 🆓 | $0.00000000 | $0.00000000 | 131,072 | 8,192 | ✅ |
glm-4.6v-flash 🆓 | $0.00000000 | $0.00000000 | 131,072 | 8,192 | ✅ |
deepseek-flash | $0.00000018 | $0.00000070 | 1,048,576 | 8,192 | ✅ |
glm-4.7-flashx | $0.00000008 | $0.00000047 | 1,048,576 | 8,192 | ✅ |
glm-5.2 | $0.00000164 | $0.00000515 | 1,048,576 | 8,192 | ✅ |
glm-5.1 | $0.00000164 | $0.00000515 | 1,048,576 | 8,192 | ✅ |
glm-5 | $0.00000117 | $0.00000374 | 1,048,576 | 8,192 | ✅ |
glm-5-turbo | $0.00000122 | $0.00000453 | 200,000 | 8,192 | ✅ |
glm-4.7 | $0.00000070 | $0.00000257 | 1,048,576 | 8,192 | ✅ |
glm-4.6 | $0.00000070 | $0.00000257 | 1,048,576 | 8,192 | ✅ |
glm-4.5 | $0.00000070 | $0.00000257 | 1,048,576 | 8,192 | ✅ |
glm-4.5-x | $0.00000257 | $0.00001041 | 1,048,576 | 8,192 | ✅ |
glm-4.5-air | $0.00000023 | $0.00000129 | 1,048,576 | 8,192 | ✅ |
glm-4.5-airx | $0.00000129 | $0.00000527 | 1,048,576 | 8,192 | ✅ |
glm-4-32b-0414-128k | $0.00000012 | $0.00000012 | 131,072 | 8,192 | ✅ |
glm-5v-turbo | $0.00000122 | $0.00000453 | 200,000 | 8,192 | ✅ |
glm-4.6v | $0.00000035 | $0.00000105 | 1,048,576 | 8,192 | ✅ |
glm-4.6v-flashx | $0.00000005 | $0.00000047 | 1,048,576 | 8,192 | ✅ |
glm-4.5v | $0.00000070 | $0.00000211 | 1,048,576 | 8,192 | ✅ |
kimi-k2.7-code | $0.00000111 | $0.00000468 | 262,144 | 32,768 | ✅ |
kimi-k2.7-code-highspeed | $0.00000222 | $0.00000936 | 262,144 | 32,768 | ✅ |
kimi-k2.6 | $0.00000111 | $0.00000468 | 262,144 | 32,768 | ✅ |
MiniMax-M2.7 | $0.00000035 | $0.00000140 | 1,048,576 | 8,192 | ✅ |
MiniMax-M2.7-highspeed | $0.00000070 | $0.00000281 | 1,048,576 | 8,192 | ✅ |
MiniMax-M2.5 | $0.00000035 | $0.00000140 | 1,048,576 | 8,192 | ✅ |
MiniMax-M2.5-highspeed | $0.00000070 | $0.00000281 | 1,048,576 | 8,192 | ✅ |
MiniMax-M2.1 | $0.00000035 | $0.00000140 | 1,048,576 | 8,192 | ✅ |
MiniMax-M2.1-highspeed | $0.00000070 | $0.00000281 | 1,048,576 | 8,192 | ✅ |
MiniMax-M2 | $0.00000035 | $0.00000140 | 1,048,576 | 8,192 | ✅ |
deepseek-v4-pro | $0.00000077 | $0.00000232 | 1,048,576 | 8,192 | ✅ |
kimi-k3 | $0.00000351 | $0.00001755 | 1,048,576 | 32,768 | ✅ |
glm-5.3 | $0.00000164 | $0.00000515 | 1,048,576 | 8,192 | ✅ |
minimax-m3 | $0.00000035 | $0.00000140 | 1,048,576 | 8,192 | ✅ |
Modelo de precios: esquema exacto — el agente paga por input tokens + max_tokens antes del procesamiento. Cargo mínimo por solicitud: 2000 unidades atómicas = $0.002 USDC.
Llamada a herramientas (function calling)
Envía tools estilo OpenAI (+ tool_choice opcional) con la solicitud — se
reenvían al modelo sin cambios, en modelos gratuitos y de pago, por HTTP y
MCP, con streaming y sin streaming. La respuesta es la propia respuesta del proveedor: ya sea
texto, o choices[0].message.tool_calls con finish_reason: "tool_calls".
Continúa el bucle a la manera de OpenAI: envía el turno del asistente de vuelta con
content: null y su tool_calls, seguido de un mensaje role: "tool" por
llamada que lleve tool_call_id. (Un turno de llamada a herramienta no tiene contenido de texto — eso es
normal, no un error.)
Dos cosas que debes saber antes de enviar una lista grande de herramientas:
- El esquema de la herramienta son tokens de entrada — se cuenta en el precio y en el ajuste de la ventana de contexto exactamente igual que tus mensajes. Recorta las descripciones que no necesites.
- Los modelos gratuitos tienen un presupuesto de tokens pequeño (ver la tabla anterior): una lista grande de herramientas no cabrá. Usa un modelo de pago para bucles agénticos.
La columna Tools anterior marca los modelos verificados para aceptar llamadas a herramientas (verificados en vivo
por nosotros). Un modelo sin marcar es no verificado, no necesariamente no soportado — si un modelo
rechaza herramientas, el error nombra la causa.
Flujo de Pago (x402 V2, esquema exacto)
- Envía la solicitud sin encabezados de pago.
- El servidor responde
402 Payment Requiredcon un encabezadoPAYMENT-REQUIRED(JSON en base64): precio, direcciónpayTo, mint de USDC, memo, blockhash reciente. - El agente construye una transacción parcial: transferencia USDC
TransferChecked(monto = requerido) + instrucción Memo, firmada con su propia wallet. El pagador de tarifas NO es firmado por el agente. - El agente reintenta la solicitud con el encabezado
PAYMENT-SIGNATURE(payload JSON en base64 con la transacción firmada). - El servidor verifica el pago y procesa la solicitud (tarifas patrocinadas — sin gas para el agente).
- La respuesta es
200con el encabezadoPAYMENT-RESPONSE(recibo de liquidación).
- Red:
solana:5eykt4UsFv8P8NJdTREpY1vzqKqZKvdp(mainnet de Solana) - Activo: USDC
EPjFWdd5AufqSSqeM2qN1xzybapC8G4wEGGkZwyTDt1v - El agente debe tener una ATA de USDC existente; no necesita SOL (BridgeNode patrocina las tarifas).
- Usa los SDK oficiales de x402 (
@x402/svm,x402[svm]) o cualquier cliente compatible con x402 — manejan 402 → firmar → reintentar automáticamente.
Conformidad (x402 v2, exact)
Hechos que puedes verificar, no una insignia:
x402Version2, esquemaexact, redsolana:5eykt4UsFv8P8NJdTREpY1vzqKqZKvdp(mainnet de Solana, CAIP-2).- Activo: USDC
EPjFWdd5AufqSSqeM2qN1xzybapC8G4wEGGkZwyTDt1v(6 decimales).amountes una cadena atómica —"2000"es 0.002 USDC. payTo=BHMDv3ri3LBEZjEzJgDZeUiguVX7LmsCstTXbM3dL8rN;extra.feePayer= la misma dirección, por lo que el agente necesita sin SOL (sin gas).- El cuerpo del 402 es un sobre
PaymentRequired— el validador es el SDK oficial de x402 (x4022.22.0) y la verificación en vivo pasa 17/17 (sobre, semántica de/supported,/verify, y una liquidación real verificada en cadena). - Autofacilitado: no hay terceros entre tú y nosotros —
GET /supported,POST /verify,POST /settleson servidos por el propio BridgeNode, declarados enhttps://bridgenode.cc/.well-known/x402. /verifysigue la especificación: un pago que no verifica se responde200con{"isValid": false, "invalidReason": ...}; un cuerpo de solicitud malformado es el único 400.
Inicio Rápido (curl)
Paso 0 — primera llamada, gratuita (copia esta): sin wallet, sin 402, y mantén
max_tokens >= 200 — un límite más pequeño puede ser consumido por el razonamiento y devolver
una respuesta vacía:
curl https://bridgenode.cc/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{"model":"gpt-oss-20b","messages":[{"role":"user","content":"hello"}],"max_tokens":200}'
Respuesta: 200 directamente.
Paso 1 — un modelo DE PAGO (mismo endpoint, mismo cuerpo):
curl https://bridgenode.cc/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{"model":"deepseek-flash","messages":[{"role":"user","content":"hello"}],"max_tokens":200}'
Respuesta: 402 con el encabezado PAYMENT-REQUIRED. Firma la transacción parcial con un cliente compatible con x402 y reintenta con el encabezado PAYMENT-SIGNATURE. Respuesta: 200 con la finalización.
SDKs
- SDK de Python:
pip install bridgenode-llm(https://pypi.org/project/bridgenode-llm) - Toolkit completo de Python (SDK + CLI):
pip install bridgenode(https://pypi.org/project/bridgenode) - CLI:
pip install bridgenode-cli(https://pypi.org/project/bridgenode-cli) - Paquetes alias (mismo toolkit):
bridgenode-sdk,bridgenode-mcp,bridgenode-skill(https://pypi.org/project/bridgenode-sdk) - TypeScript:
npm i @bridgenode/llm(https://www.npmjs.com/package/@bridgenode/llm) - Wrapper MCP:
npm i @bridgenode/mcp(https://www.npmjs.com/package/@bridgenode/mcp)
Todos los SDK manejan el protocolo de pago x402 automáticamente, con límites de gasto de cierre ante fallos (BRIDGENODE_MAX_PER_CALL, BRIDGENODE_DAILY_CAP).
Uso de MCP
- Instalación en una línea:
claude mcp add bridgenode -s user -- npx -y @bridgenode/mcp@latest - URL del servidor:
https://bridgenode.cc/mcp(streamable-http) - Herramienta:
chat_completions(modelo, modo, mensajes, max_tokens) - Pago: protocolo x402 por llamada a herramienta; verifica siempre el monto real en la respuesta 402 antes de firmar.
Errores
| Estado | Significado |
|---|---|
| 400 | Solicitud incorrecta (modelo desconocido, cuerpo inválido). Un max_tokens no transmitido por streaming por encima del non_stream_max_tokens del modelo se AJUSTA (CLAMPEA) a este, nunca se rechaza. |
| 402 | Pago requerido — consulte el encabezado PAYMENT-REQUIRED |
| 413 | Cuerpo de solicitud demasiado grande (límite 2 MB) |
| 429 | Demasiadas solicitudes (límite de cola) |
| 503 | Servicio ocupado — reintente con retroceso (backoff) |
Descubrimiento
- Tarjeta de agente: https://bridgenode.cc/.well-known/agent-card.json
- Manifiesto MCP: https://bridgenode.cc/.well-known/mcp.json
- Manifiesto de IA: https://bridgenode.cc/.well-known/ai-manifest.json
- Catálogo de API: https://bridgenode.cc/.well-known/api-catalog
- Listado en x402-list: https://x402-list.com/services/bridgenode
- Listado en x402-dev: https://www.x402dev.com/awesome-projects/
- Listado en nohumans.directory: https://nohumans.directory/l/f1f74751-9d5
- Listado en gold-402: https://github.com/Haustorium12/gold-402/blob/main/directory/learning.md
- Habilidad ClawHub: https://clawhub.ai/bridgenode/skills/bridgenode
Notas
- Reembolsos: si el proveedor falla antes de entregar cualquier contenido, el pago se reembolsa automáticamente (transferencia USDC inversa).
- Modelos de razonamiento/pensamiento: use
max_tokens >= 200(los tokens de razonamiento comparten el presupuesto demax_tokens; un límite demasiado pequeño puede producir una respuesta VACÍA — reintentamos una vez con un presupuesto mayor y reembolsamos en su totalidad si sigue vacía). El pensamiento está deshabilitado en:glm-4.7-flash,deepseek-flash,deepseek-v4-pro.