BridgeNode

Inferencia de IA mediante x402. Paga con Solana USDC. Sin registro. Sin claves API.

Documentación

BridgeNode — Guía Completa para Agentes

Puente de inferencia de IA para agentes de IA. Sin claves API, sin registro, sin suscripciones. Los modelos gratuitos están incluidos, y las primeras llamadas en modelos de pago son gratuitas — después pagas por solicitud con USDC de Solana vía x402 (HTTP 402). Las tarifas de transacción están patrocinadas — el agente solo necesita USDC para pagar.

Acceso gratuito (empieza aquí — no se requiere wallet)

  • Modelos gratuitos: gpt-oss-20b, gpt-oss-120b, glm-4.7-flash, glm-4.5-flash, glm-4.6v-flash — servidos sin costo, sin wallet, sin gas. Notas sobre modelos gratuitos (léelas antes de elegir uno):
  • glm-4.7-flash — ⚠️ temporalmente poco confiable: modelo gratuito de z.ai: más lento que los modelos gratuitos de Groq — una respuesta puede tardar hasta un minuto, y el proveedor a veces está sobrecargado. Si devuelve un error (límite de tasa / sobrecarga temporal), reintenta una vez o cambia a gpt-oss-20b, el modelo gratuito más confiable.
  • glm-4.5-flash — ⚠️ temporalmente poco confiable: modelo gratuito de z.ai: más lento que los modelos gratuitos de Groq — una respuesta puede tardar hasta un minuto, y el proveedor a veces está sobrecargado. Si devuelve un error (límite de tasa / sobrecarga temporal), reintenta una vez o cambia a gpt-oss-20b, el modelo gratuito más confiable.
  • glm-4.6v-flash: modelo gratuito de z.ai: más lento que los modelos gratuitos de Groq — una respuesta puede tardar hasta un minuto, y el proveedor a veces está sobrecargado. Si devuelve un error (límite de tasa / sobrecarga temporal), reintenta una vez o cambia a gpt-oss-20b, el modelo gratuito más confiable.
  • Pruebas gratuitas en modelos de pago: las primeras 2 llamada(s) a CUALQUIER modelo de pago son gratuitas por cliente, para que puedas experimentar una respuesta completa antes de pagar. Las respuestas de prueba llevan X-Bridgenode-Free-Trial: 1 y X-Bridgenode-Free-Trials-Remaining: <n>.
  • Cuando se agotan las pruebas, una solicitud no pagada devuelve 402 cuyo objeto extensions.bridgenode te dice exactamente qué hacer a continuación: free_models (lista), free_trials_remaining, how_to_pay, docs.
  • Cada 402 también lleva request_hint. Para una solicitud válida, enumera los hechos por los que pagarías (modelo, context_window, max_output_tokens, clamping). Si la solicitud no puede tener éxito, el 402 lo dice antes de que firmes: request_hint.ok = false con problem y message (por ejemplo unknown_model, empty_messages, invalid_json, unknown_mode) — corrige eso y reintenta, ninguna firma se desperdicia jamás en una solicitud que sería rechazada.

Límites (publicados — contados por cliente, y aplicados exactamente así)

  • Un cliente = una wallet con historial de pagos, de lo contrario tu red (presupuesto diario: /24 IPv4, /64 IPv6; pruebas: /16 IPv4, /48 IPv6).
  • Pruebas gratuitas: 2 llamadas en modelos DE PAGO (únicas, por cliente).
  • Presupuesto gratuito diario: 200 llamadas y 100,000 tokens por cliente por día (MODELOS GRATUITOS Y PRUEBAS juntos, se reinicia a las 00:00 UTC). Por encima → 429 free_daily_quota_exhausted con Retry-After.
  • Por modelo gratuito, nuestro propio límite diario: gpt-oss-120b 160,000, gpt-oss-20b 160,000 tokens/día (compartido por todos los clientes). Alcanzado → 429 free_budget_exhausted nombrando un modelo que aún funciona — nos detenemos antes que el proveedor.
  • Tasa: 30 solicitudes gratuitas/minuto por cliente; 10 desafíos de pago/minuto.
  • Concurrencia: 20 llamadas gratuitas a la vez en todos los clientes. Por encima → 503 free_path_busy + Retry-After (nunca una cola silenciosa).
  • Cada respuesta gratuita lleva los números: X-Bridgenode-Free-Quota-Limit, X-Bridgenode-Free-Quota-Remaining, X-Bridgenode-Free-Quota-Reset, X-Bridgenode-Free-Quota-Tokens-Limit, X-Bridgenode-Free-Quota-Tokens-Remaining, X-Bridgenode-Free-Trials-Remaining.
  • Las solicitudes de pago (x402) nunca se ven afectadas por ninguno de estos límites — ni esperan por el tráfico gratuito ni comparten sus presupuestos.
  • Los modelos gratuitos y las pruebas gratuitas comparten un límite de tasa por cliente; las solicitudes de pago no.
  • No necesitas enviar un encabezado especial para usar una prueba — solo envía una solicitud normal con un modelo de pago y sin encabezado de pago. Las pruebas y el presupuesto gratuito diario (X-Bridgenode-Free-Quota-* en cada respuesta gratuita) se cuentan por identidad de cliente: un cliente anónimo es su red (/24 IPv4, /64 IPv6), y una wallet (SIGN-IN-WITH-X, sin pago) se convierte en su propia identidad una vez que tiene historial de pagos con nosotros — una wallet nueva no compra un presupuesto fresco, pero un cliente que ha pagado nunca es castigado por sus vecinos.

Endpoints

Modelos y Precios

Los precios están en USDC por token (6 decimales). Precios en vivo: GET https://bridgenode.cc/v1/models.

ModeloEntrada / tokenSalida / tokenVentana de contextoSalida máximaHerramientas
gpt-oss-20b 🆓$0.00000000$0.000000008,0008,000✅
gpt-oss-120b 🆓$0.00000000$0.000000008,0008,000✅
glm-4.7-flash 🆓$0.00000000$0.00000000131,0728,192✅
glm-4.5-flash 🆓$0.00000000$0.00000000131,0728,192✅
glm-4.6v-flash 🆓$0.00000000$0.00000000131,0728,192✅
deepseek-flash$0.00000018$0.000000701,048,5768,192✅
glm-4.7-flashx$0.00000008$0.000000471,048,5768,192✅
glm-5.2$0.00000164$0.000005151,048,5768,192✅
glm-5.1$0.00000164$0.000005151,048,5768,192✅
glm-5$0.00000117$0.000003741,048,5768,192✅
glm-5-turbo$0.00000122$0.00000453200,0008,192✅
glm-4.7$0.00000070$0.000002571,048,5768,192✅
glm-4.6$0.00000070$0.000002571,048,5768,192✅
glm-4.5$0.00000070$0.000002571,048,5768,192✅
glm-4.5-x$0.00000257$0.000010411,048,5768,192✅
glm-4.5-air$0.00000023$0.000001291,048,5768,192✅
glm-4.5-airx$0.00000129$0.000005271,048,5768,192✅
glm-4-32b-0414-128k$0.00000012$0.00000012131,0728,192✅
glm-5v-turbo$0.00000122$0.00000453200,0008,192✅
glm-4.6v$0.00000035$0.000001051,048,5768,192✅
glm-4.6v-flashx$0.00000005$0.000000471,048,5768,192✅
glm-4.5v$0.00000070$0.000002111,048,5768,192✅
kimi-k2.7-code$0.00000111$0.00000468262,14432,768✅
kimi-k2.7-code-highspeed$0.00000222$0.00000936262,14432,768✅
kimi-k2.6$0.00000111$0.00000468262,14432,768✅
MiniMax-M2.7$0.00000035$0.000001401,048,5768,192✅
MiniMax-M2.7-highspeed$0.00000070$0.000002811,048,5768,192✅
MiniMax-M2.5$0.00000035$0.000001401,048,5768,192✅
MiniMax-M2.5-highspeed$0.00000070$0.000002811,048,5768,192✅
MiniMax-M2.1$0.00000035$0.000001401,048,5768,192✅
MiniMax-M2.1-highspeed$0.00000070$0.000002811,048,5768,192✅
MiniMax-M2$0.00000035$0.000001401,048,5768,192✅
deepseek-v4-pro$0.00000077$0.000002321,048,5768,192✅
kimi-k3$0.00000351$0.000017551,048,57632,768✅
glm-5.3$0.00000164$0.000005151,048,5768,192✅
minimax-m3$0.00000035$0.000001401,048,5768,192✅

Modelo de precios: esquema exacto — el agente paga por input tokens + max_tokens antes del procesamiento. Cargo mínimo por solicitud: 2000 unidades atómicas = $0.002 USDC.

Llamada a herramientas (function calling)

Envía tools estilo OpenAI (+ tool_choice opcional) con la solicitud — se reenvían al modelo sin cambios, en modelos gratuitos y de pago, por HTTP y MCP, con streaming y sin streaming. La respuesta es la propia respuesta del proveedor: ya sea texto, o choices[0].message.tool_calls con finish_reason: "tool_calls".

Continúa el bucle a la manera de OpenAI: envía el turno del asistente de vuelta con content: null y su tool_calls, seguido de un mensaje role: "tool" por llamada que lleve tool_call_id. (Un turno de llamada a herramienta no tiene contenido de texto — eso es normal, no un error.)

Dos cosas que debes saber antes de enviar una lista grande de herramientas:

  • El esquema de la herramienta son tokens de entrada — se cuenta en el precio y en el ajuste de la ventana de contexto exactamente igual que tus mensajes. Recorta las descripciones que no necesites.
  • Los modelos gratuitos tienen un presupuesto de tokens pequeño (ver la tabla anterior): una lista grande de herramientas no cabrá. Usa un modelo de pago para bucles agénticos.

La columna Tools anterior marca los modelos verificados para aceptar llamadas a herramientas (verificados en vivo por nosotros). Un modelo sin marcar es no verificado, no necesariamente no soportado — si un modelo rechaza herramientas, el error nombra la causa.

Flujo de Pago (x402 V2, esquema exacto)

  1. Envía la solicitud sin encabezados de pago.
  2. El servidor responde 402 Payment Required con un encabezado PAYMENT-REQUIRED (JSON en base64): precio, dirección payTo, mint de USDC, memo, blockhash reciente.
  3. El agente construye una transacción parcial: transferencia USDC TransferChecked (monto = requerido) + instrucción Memo, firmada con su propia wallet. El pagador de tarifas NO es firmado por el agente.
  4. El agente reintenta la solicitud con el encabezado PAYMENT-SIGNATURE (payload JSON en base64 con la transacción firmada).
  5. El servidor verifica el pago y procesa la solicitud (tarifas patrocinadas — sin gas para el agente).
  6. La respuesta es 200 con el encabezado PAYMENT-RESPONSE (recibo de liquidación).
  • Red: solana:5eykt4UsFv8P8NJdTREpY1vzqKqZKvdp (mainnet de Solana)
  • Activo: USDC EPjFWdd5AufqSSqeM2qN1xzybapC8G4wEGGkZwyTDt1v
  • El agente debe tener una ATA de USDC existente; no necesita SOL (BridgeNode patrocina las tarifas).
  • Usa los SDK oficiales de x402 (@x402/svm, x402[svm]) o cualquier cliente compatible con x402 — manejan 402 → firmar → reintentar automáticamente.

Conformidad (x402 v2, exact)

Hechos que puedes verificar, no una insignia:

  • x402Version 2, esquema exact, red solana:5eykt4UsFv8P8NJdTREpY1vzqKqZKvdp (mainnet de Solana, CAIP-2).
  • Activo: USDC EPjFWdd5AufqSSqeM2qN1xzybapC8G4wEGGkZwyTDt1v (6 decimales). amount es una cadena atómica — "2000" es 0.002 USDC.
  • payTo = BHMDv3ri3LBEZjEzJgDZeUiguVX7LmsCstTXbM3dL8rN; extra.feePayer = la misma dirección, por lo que el agente necesita sin SOL (sin gas).
  • El cuerpo del 402 es un sobre PaymentRequired — el validador es el SDK oficial de x402 (x402 2.22.0) y la verificación en vivo pasa 17/17 (sobre, semántica de /supported, /verify, y una liquidación real verificada en cadena).
  • Autofacilitado: no hay terceros entre tú y nosotros — GET /supported, POST /verify, POST /settle son servidos por el propio BridgeNode, declarados en https://bridgenode.cc/.well-known/x402.
  • /verify sigue la especificación: un pago que no verifica se responde 200 con {"isValid": false, "invalidReason": ...}; un cuerpo de solicitud malformado es el único 400.

Inicio Rápido (curl)

Paso 0 — primera llamada, gratuita (copia esta): sin wallet, sin 402, y mantén max_tokens >= 200 — un límite más pequeño puede ser consumido por el razonamiento y devolver una respuesta vacía:

curl https://bridgenode.cc/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{"model":"gpt-oss-20b","messages":[{"role":"user","content":"hello"}],"max_tokens":200}'

Respuesta: 200 directamente.

Paso 1 — un modelo DE PAGO (mismo endpoint, mismo cuerpo):

curl https://bridgenode.cc/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{"model":"deepseek-flash","messages":[{"role":"user","content":"hello"}],"max_tokens":200}'

Respuesta: 402 con el encabezado PAYMENT-REQUIRED. Firma la transacción parcial con un cliente compatible con x402 y reintenta con el encabezado PAYMENT-SIGNATURE. Respuesta: 200 con la finalización.

SDKs

Todos los SDK manejan el protocolo de pago x402 automáticamente, con límites de gasto de cierre ante fallos (BRIDGENODE_MAX_PER_CALL, BRIDGENODE_DAILY_CAP).

Uso de MCP

  • Instalación en una línea: claude mcp add bridgenode -s user -- npx -y @bridgenode/mcp@latest
  • URL del servidor: https://bridgenode.cc/mcp (streamable-http)
  • Herramienta: chat_completions (modelo, modo, mensajes, max_tokens)
  • Pago: protocolo x402 por llamada a herramienta; verifica siempre el monto real en la respuesta 402 antes de firmar.

Errores

EstadoSignificado
400Solicitud incorrecta (modelo desconocido, cuerpo inválido). Un max_tokens no transmitido por streaming por encima del non_stream_max_tokens del modelo se AJUSTA (CLAMPEA) a este, nunca se rechaza.
402Pago requerido — consulte el encabezado PAYMENT-REQUIRED
413Cuerpo de solicitud demasiado grande (límite 2 MB)
429Demasiadas solicitudes (límite de cola)
503Servicio ocupado — reintente con retroceso (backoff)

Descubrimiento

Notas

  • Reembolsos: si el proveedor falla antes de entregar cualquier contenido, el pago se reembolsa automáticamente (transferencia USDC inversa).
  • Modelos de razonamiento/pensamiento: use max_tokens >= 200 (los tokens de razonamiento comparten el presupuesto de max_tokens; un límite demasiado pequeño puede producir una respuesta VACÍA — reintentamos una vez con un presupuesto mayor y reembolsamos en su totalidad si sigue vacía). El pensamiento está deshabilitado en: glm-4.7-flash, deepseek-flash, deepseek-v4-pro.