BridgeNode
Inferência de IA via x402. Pague com Solana USDC. Sem registro. Sem chaves de API.
Documentação
BridgeNode — Guia Completo do Agente
Ponte de inferência de IA para agentes de IA. Sem chaves de API, sem registro, sem assinaturas. Modelos gratuitos estão incluídos, e as primeiras chamadas em modelos pagos são gratuitas — depois disso você paga por requisição com USDC da Solana via x402 (HTTP 402). Taxas de transação são patrocinadas — o agente só precisa de USDC para pagar.
Acesso gratuito (comece aqui — sem carteira necessária)
- Modelos gratuitos: gpt-oss-20b, gpt-oss-120b, glm-4.7-flash, glm-4.5-flash, glm-4.6v-flash — servidos gratuitamente, sem carteira, sem gas. Notas sobre modelos gratuitos (leia antes de escolher um):
glm-4.7-flash— ⚠️ temporariamente não confiável: modelo gratuito z.ai: mais lento que os modelos gratuitos Groq — uma resposta pode levar até um minuto, e o provedor às vezes está sobrecarregado. Se retornar um erro (limite de taxa / sobrecarga temporária), tente novamente uma vez ou mude para gpt-oss-20b, o modelo gratuito mais confiável.glm-4.5-flash— ⚠️ temporariamente não confiável: modelo gratuito z.ai: mais lento que os modelos gratuitos Groq — uma resposta pode levar até um minuto, e o provedor às vezes está sobrecarregado. Se retornar um erro (limite de taxa / sobrecarga temporária), tente novamente uma vez ou mude para gpt-oss-20b, o modelo gratuito mais confiável.glm-4.6v-flash: modelo gratuito z.ai: mais lento que os modelos gratuitos Groq — uma resposta pode levar até um minuto, e o provedor às vezes está sobrecarregado. Se retornar um erro (limite de taxa / sobrecarga temporária), tente novamente uma vez ou mude para gpt-oss-20b, o modelo gratuito mais confiável.- Testes gratuitos em modelos pagos: as primeiras 2 chamada(s) para QUALQUER modelo pago
são gratuitas por cliente, para que você possa experimentar uma resposta completa antes de pagar. Respostas
de teste carregam
X-Bridgenode-Free-Trial: 1eX-Bridgenode-Free-Trials-Remaining: <n>. - Quando os testes acabam, uma requisição não paga retorna 402 cujo
objeto
extensions.bridgenodediz exatamente o que fazer em seguida:free_models(lista),free_trials_remaining,how_to_pay,docs. - Cada 402 também carrega
request_hint. Para uma requisição válida, ele lista os fatos pelos quais você pagaria (modelo, context_window, max_output_tokens, clamping). Se a requisição não puder ser bem-sucedida, o 402 avisa antes de você assinar:request_hint.ok = falsecomproblememessage(por exemplounknown_model,empty_messages,invalid_json,unknown_mode) — corrija isso e tente novamente, nenhuma assinatura é desperdiçada em uma requisição que seria rejeitada.
Limites (publicados — contados por cliente, e aplicados exatamente assim)
- Um cliente = uma carteira com histórico de pagamento, caso contrário sua rede (orçamento diário: /24 IPv4, /64 IPv6; testes: /16 IPv4, /48 IPv6).
- Testes gratuitos: 2 chamadas em modelos PAGOS (únicos, por cliente).
- Orçamento gratuito diário: 200 chamadas e 100.000 tokens por cliente por dia (MODELOS GRATUITOS E TESTES juntos, reinicia às 00:00 UTC). Acima disso → 429
free_daily_quota_exhaustedcomRetry-After. - Por modelo gratuito, nosso próprio teto diário:
gpt-oss-120b160.000,gpt-oss-20b160.000 tokens/dia (compartilhado por todos os clientes). Atingido → 429free_budget_exhaustednomeando um modelo que ainda funciona — paramos antes do provedor. - Taxa: 30 requisições gratuitas/minuto por cliente; 10 desafios de pagamento/minuto.
- Concorrência: 20 chamadas gratuitas simultâneas em todos os clientes. Acima disso → 503
free_path_busy+Retry-After(nunca uma fila silenciosa). - Cada resposta gratuita carrega os números:
X-Bridgenode-Free-Quota-Limit,X-Bridgenode-Free-Quota-Remaining,X-Bridgenode-Free-Quota-Reset,X-Bridgenode-Free-Quota-Tokens-Limit,X-Bridgenode-Free-Quota-Tokens-Remaining,X-Bridgenode-Free-Trials-Remaining. - Requisições pagas (x402) nunca são afetadas por nenhum desses limites — elas não esperam tráfego gratuito nem compartilham seus orçamentos.
- Modelos gratuitos e testes gratuitos compartilham um limite de taxa por cliente; requisições pagas não.
- Você não precisa enviar um cabeçalho especial para usar um teste — basta enviar uma requisição
normal com um modelo pago e sem cabeçalho de pagamento. Testes e o orçamento gratuito
diário (
X-Bridgenode-Free-Quota-*em cada resposta gratuita) são contados por identidade de cliente: um cliente anônimo é sua rede (/24IPv4,/64IPv6), e uma carteira (SIGN-IN-WITH-X, sem pagamento) torna-se sua própria identidade uma vez que tenha histórico de pagamento conosco — uma carteira nova não compra um orçamento novo, mas um cliente que pagou nunca é punido por seus vizinhos.
Endpoints
- API compatível com OpenAI: https://bridgenode.cc/v1
- Modelos e preços (JSON): https://bridgenode.cc/v1/models
- Servidor MCP (streamable-http): https://bridgenode.cc/mcp
- Mapa de instalação do agente: https://bridgenode.cc/llms.txt
- Arquivo de skill: https://bridgenode.cc/skill.md
Modelos e Preços
Preços em USDC por token (6 decimais). Preços ao vivo: GET https://bridgenode.cc/v1/models.
| Modelo | Entrada / token | Saída / token | Janela de contexto | Saída máxima | Ferramentas |
|---|---|---|---|---|---|
gpt-oss-20b 🆓 | $0.00000000 | $0.00000000 | 8.000 | 8.000 | ✅ |
gpt-oss-120b 🆓 | $0.00000000 | $0.00000000 | 8.000 | 8.000 | ✅ |
glm-4.7-flash 🆓 | $0.00000000 | $0.00000000 | 131.072 | 8.192 | ✅ |
glm-4.5-flash 🆓 | $0.00000000 | $0.00000000 | 131.072 | 8.192 | ✅ |
glm-4.6v-flash 🆓 | $0.00000000 | $0.00000000 | 131.072 | 8.192 | ✅ |
deepseek-flash | $0.00000018 | $0.00000070 | 1.048.576 | 8.192 | ✅ |
glm-4.7-flashx | $0.00000008 | $0.00000047 | 1.048.576 | 8.192 | ✅ |
glm-5.2 | $0.00000164 | $0.00000515 | 1.048.576 | 8.192 | ✅ |
glm-5.1 | $0.00000164 | $0.00000515 | 1.048.576 | 8.192 | ✅ |
glm-5 | $0.00000117 | $0.00000374 | 1.048.576 | 8.192 | ✅ |
glm-5-turbo | $0.00000122 | $0.00000453 | 200.000 | 8.192 | ✅ |
glm-4.7 | $0.00000070 | $0.00000257 | 1.048.576 | 8.192 | ✅ |
glm-4.6 | $0.00000070 | $0.00000257 | 1.048.576 | 8.192 | ✅ |
glm-4.5 | $0.00000070 | $0.00000257 | 1.048.576 | 8.192 | ✅ |
glm-4.5-x | $0.00000257 | $0.00001041 | 1.048.576 | 8.192 | ✅ |
glm-4.5-air | $0.00000023 | $0.00000129 | 1.048.576 | 8.192 | ✅ |
glm-4.5-airx | $0.00000129 | $0.00000527 | 1.048.576 | 8.192 | ✅ |
glm-4-32b-0414-128k | $0.00000012 | $0.00000012 | 131.072 | 8.192 | ✅ |
glm-5v-turbo | $0.00000122 | $0.00000453 | 200.000 | 8.192 | ✅ |
glm-4.6v | $0.00000035 | $0.00000105 | 1.048.576 | 8.192 | ✅ |
glm-4.6v-flashx | $0.00000005 | $0.00000047 | 1.048.576 | 8.192 | ✅ |
glm-4.5v | $0.00000070 | $0.00000211 | 1.048.576 | 8.192 | ✅ |
kimi-k2.7-code | $0.00000111 | $0.00000468 | 262.144 | 32.768 | ✅ |
kimi-k2.7-code-highspeed | $0.00000222 | $0.00000936 | 262.144 | 32.768 | ✅ |
kimi-k2.6 | $0.00000111 | $0.00000468 | 262.144 | 32.768 | ✅ |
MiniMax-M2.7 | $0.00000035 | $0.00000140 | 1.048.576 | 8.192 | ✅ |
MiniMax-M2.7-highspeed | $0.00000070 | $0.00000281 | 1.048.576 | 8.192 | ✅ |
MiniMax-M2.5 | $0.00000035 | $0.00000140 | 1.048.576 | 8.192 | ✅ |
MiniMax-M2.5-highspeed | $0.00000070 | $0.00000281 | 1.048.576 | 8.192 | ✅ |
MiniMax-M2.1 | $0.00000035 | $0.00000140 | 1.048.576 | 8.192 | ✅ |
MiniMax-M2.1-highspeed | $0.00000070 | $0.00000281 | 1.048.576 | 8.192 | ✅ |
MiniMax-M2 | $0.00000035 | $0.00000140 | 1.048.576 | 8.192 | ✅ |
deepseek-v4-pro | $0.00000077 | $0.00000232 | 1.048.576 | 8.192 | ✅ |
kimi-k3 | $0.00000351 | $0.00001755 | 1.048.576 | 32.768 | ✅ |
glm-5.3 | $0.00000164 | $0.00000515 | 1.048.576 | 8.192 | ✅ |
minimax-m3 | $0.00000035 | $0.00000140 | 1.048.576 | 8.192 | ✅ |
Modelo de preço: esquema exato — o agente paga por input tokens + max_tokens antes do processamento. Cobrança mínima por requisição: 2000 unidades atômicas = $0.002 USDC.
Chamada de ferramentas (function calling)
Envie tools no estilo OpenAI (+ tool_choice opcional) com a requisição — eles são
encaminhados ao modelo sem alterações, em modelos gratuitos e pagos, via HTTP e
MCP, streaming e não-streaming. A resposta é a própria resposta do provedor: texto
ou choices[0].message.tool_calls com finish_reason: "tool_calls".
Continue o loop do jeito OpenAI: envie o turno do assistente de volta com
content: null e seu tool_calls, seguido por uma mensagem role: "tool" por
chamada carregando tool_call_id. (Um turno de chamada de ferramenta não tem conteúdo de texto — isso é
normal, não um erro.)
Duas coisas para saber antes de enviar uma lista grande de ferramentas:
- O schema da ferramenta é token de entrada — é contado no preço e no ajuste da janela de contexto exatamente como suas mensagens. Encurte descrições que você não precisa.
- Modelos gratuitos têm um orçamento pequeno de tokens (veja a tabela acima): uma lista grande de ferramentas não caberá. Use um modelo pago para loops agênticos.
A coluna Tools acima marca modelos verificados para aceitar chamada de ferramentas (verificados ao vivo
por nós). Um modelo não marcado é não verificado, não necessariamente não suportado — se um modelo
recusar ferramentas, o erro nomeia a causa.
Fluxo de Pagamento (x402 V2, esquema exato)
- Envie a requisição sem cabeçalhos de pagamento.
- O servidor responde
402 Payment Requiredcom um cabeçalhoPAYMENT-REQUIRED(JSON base64): preço, endereçopayTo, mint USDC, memo, blockhash recente. - O agente constrói uma transação parcial: USDC
TransferChecked(valor = necessário) + instrução Memo, assina com sua própria carteira. O pagador de taxa NÃO é assinado pelo agente. - O agente tenta novamente a requisição com o cabeçalho
PAYMENT-SIGNATURE(payload JSON base64 com a transação assinada). - O servidor verifica o pagamento e processa a requisição (taxas patrocinadas — sem gas para o agente).
- A resposta é
200com o cabeçalhoPAYMENT-RESPONSE(recibo de liquidação).
- Rede:
solana:5eykt4UsFv8P8NJdTREpY1vzqKqZKvdp(Solana mainnet) - Ativo: USDC
EPjFWdd5AufqSSqeM2qN1xzybapC8G4wEGGkZwyTDt1v - O agente deve ter um ATA USDC existente; ele não precisa de SOL (BridgeNode patrocina as taxas).
- Use SDKs oficiais x402 (
@x402/svm,x402[svm]) ou qualquer cliente compatível com x402 — eles lidam com 402 → assinar → tentar novamente automaticamente.
Conformidade (x402 v2, exact)
Fatos que você pode verificar, não um selo:
x402Version2, esquemaexact, redesolana:5eykt4UsFv8P8NJdTREpY1vzqKqZKvdp(Solana mainnet, CAIP-2).- Ativo: USDC
EPjFWdd5AufqSSqeM2qN1xzybapC8G4wEGGkZwyTDt1v(6 decimais).amounté uma string atômica —"2000"é 0.002 USDC. payTo=BHMDv3ri3LBEZjEzJgDZeUiguVX7LmsCstTXbM3dL8rN;extra.feePayer= o mesmo endereço, então o agente precisa de nenhum SOL (sem gas).- O corpo do 402 é um envelope
PaymentRequired— o validador é o SDK oficial x402 (x4022.22.0) e a verificação ao vivo passa 17/17 (envelope, semântica/supported,/verify, e uma liquidação real verificada on-chain). - Autofacilitado: não há terceiros entre você e nós —
GET /supported,POST /verify,POST /settlesão servidos pelo próprio BridgeNode, declarados emhttps://bridgenode.cc/.well-known/x402. /verifysegue a especificação: um pagamento que não verifica é respondido200com{"isValid": false, "invalidReason": ...}; um corpo de requisição malformado é o único 400.
Início Rápido (curl)
Passo 0 — primeira chamada, gratuita (copie esta): sem carteira, sem 402, e mantenha
max_tokens >= 200 — um limite menor pode ser consumido pelo raciocínio e retornar
uma resposta vazia:
curl https://bridgenode.cc/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{"model":"gpt-oss-20b","messages":[{"role":"user","content":"hello"}],"max_tokens":200}'
Resposta: 200 diretamente.
Passo 1 — um modelo PAGO (mesmo endpoint, mesmo corpo):
curl https://bridgenode.cc/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{"model":"deepseek-flash","messages":[{"role":"user","content":"hello"}],"max_tokens":200}'
Resposta: 402 com cabeçalho PAYMENT-REQUIRED. Assine a transação parcial com um cliente compatível com x402 e tente novamente com o cabeçalho PAYMENT-SIGNATURE. Resposta: 200 com a conclusão.
SDKs
- SDK Python:
pip install bridgenode-llm(https://pypi.org/project/bridgenode-llm) - Kit completo Python (SDK + CLI):
pip install bridgenode(https://pypi.org/project/bridgenode) - CLI:
pip install bridgenode-cli(https://pypi.org/project/bridgenode-cli) - Pacotes de alias (mesmo kit):
bridgenode-sdk,bridgenode-mcp,bridgenode-skill(https://pypi.org/project/bridgenode-sdk) - TypeScript:
npm i @bridgenode/llm(https://www.npmjs.com/package/@bridgenode/llm) - Wrapper MCP:
npm i @bridgenode/mcp(https://www.npmjs.com/package/@bridgenode/mcp)
Todos os SDKs lidam com o handshake de pagamento x402 automaticamente, com limites de gasto fail-closed (BRIDGENODE_MAX_PER_CALL, BRIDGENODE_DAILY_CAP).
Uso MCP
- Instalação em uma linha:
claude mcp add bridgenode -s user -- npx -y @bridgenode/mcp@latest - URL do servidor:
https://bridgenode.cc/mcp(streamable-http) - Ferramenta:
chat_completions(modelo, modo, mensagens, max_tokens) - Pagamento: handshake x402 por chamada de ferramenta; sempre verifique o valor real na resposta 402 antes de assinar.
Erros
| Status | Significado |
|---|---|
| 400 | Requisição inválida (modelo desconhecido, corpo inválido). Um max_tokens não-stream acima do non_stream_max_tokens do modelo é LIMITADO a ele, nunca rejeitado. |
| 402 | Pagamento necessário — veja o cabeçalho PAYMENT-REQUIRED |
| 413 | Corpo da requisição muito grande (limite de 2 MB) |
| 429 | Muitas requisições (limite de fila) |
| 503 | Serviço ocupado — tente novamente com backoff |
Descoberta
- Cartão do agente: https://bridgenode.cc/.well-known/agent-card.json
- Manifesto MCP: https://bridgenode.cc/.well-known/mcp.json
- Manifesto de IA: https://bridgenode.cc/.well-known/ai-manifest.json
- Catálogo de API: https://bridgenode.cc/.well-known/api-catalog
- Listado em x402-list: https://x402-list.com/services/bridgenode
- Listado em x402-dev: https://www.x402dev.com/awesome-projects/
- Listado em nohumans.directory: https://nohumans.directory/l/f1f74751-9d5
- Listado em gold-402: https://github.com/Haustorium12/gold-402/blob/main/directory/learning.md
- Habilidade ClawHub: https://clawhub.ai/bridgenode/skills/bridgenode
Notas
- Reembolsos: se o provedor falhar antes de qualquer conteúdo ser entregue, o pagamento é reembolsado automaticamente (transferência USDC reversa).
- Modelos de raciocínio/pensamento: use
max_tokens >= 200(tokens de raciocínio compartilham o orçamento demax_tokens; um limite muito pequeno pode produzir uma resposta VAZIA — tentamos novamente uma vez com um orçamento maior e reembolsamos integralmente se continuar vazia). O pensamento está desativado em:glm-4.7-flash,deepseek-flash,deepseek-v4-pro.