Plugsky MCP

Plugsky é um servidor Model Context Protocol ao vivo — conecte ChatGPT, Claude, Cursor, VS Code ou Windsurf a 20 ferramentas ao vivo: todos os modelos, busca na web, transcrições de vídeo, áudio, visão, geração de imagens, memória persistente, navegação e um sandbox de código — por meio de uma única URL.

Documentação

Começando

Cinco minutos do zero até sua primeira resposta do modelo. A API Plugsky é 100% compatível com OpenAI — altere seu base_url e seu código existente, SDK e prompts continuarão funcionando.

Instalação

# Python (OpenAI SDK — works as-is)
pip install openai

# Node.js / TypeScript
npm install openai

# Go
go get github.com/sashabaranov/go-openai

# Or use raw HTTP — no SDK required

Sua primeira chamada de API

from openai import OpenAI

client = OpenAI(
    api_key="sk-live-…",                          # your Plugsky key
    base_url="https://plugsky.com/v1",         # the only line that changes
)

resp = client.chat.completions.create(
    model="plugsky-pro",
    messages=[{"role": "user", "content": "Say hello in 5 languages"}],
    max_tokens=200,
)
print(resp.choices[0].message.content)

É isso. Mesmo formato de requisição, mesmo formato de resposta, mesmo streaming, mesmo function-calling, mesmo modo JSON. Referência completa de compatibilidade com OpenAI →

✓

Substituição direta. Seus clientes OpenAI existentes em Python, Node, Go, Java, .NET e cURL funcionam sem alterações de código. Ferramentas como LangChain, LlamaIndex, Vercel AI SDK e OpenAI Playground são totalmente suportadas.

Conceitos principais

  • Modelo. O mecanismo de inferência. plugsky-micro até plugsky-frontier, além de 13+ modelos de terceiros (opencode.ai, NVIDIA NIM, Mistral, Cohere, Stability).
  • Requisição. Uma única chamada de API. Contabilizada por tokens. Precificada.
  • Thread / Run. Conversa multi-turno com estado (Assistants API).
  • Ferramenta. Uma função que você expõe ao modelo para function-calling.
  • Base de conhecimento / Vector store. Documentos indexados que o modelo pode consultar (RAG).
  • Endpoint / Região. Onde o modelo é executado. me-central-1 (EAU), eu-west-1, us-east-1, além de VPC do cliente e on-premises.

Autenticação

A Plugsky usa chaves de API com bearer token. As chaves são escopadas por projeto, por função e podem ser rotacionadas sem tempo de inatividade.

Chaves de API

Gere chaves no Dashboard → API keys. Cada chave possui um escopo e um projeto. Três funções integradas:

FunçãoPode fazerNão pode fazer
readListar modelos, obter uso, visualizar logs de auditoriaInferência, criação de chaves
inferChat / embeddings / imagem / áudio / batchAdministração, cobrança, criação de chaves
adminTudo acima + gerenciamento de chaves + cobrança + RBACConfigurações de nível organizacional (somente root)

Variáveis de ambiente

export PLUGSKY_API_KEY="sk-live-…"
export PLUGSKY_BASE_URL="https://plugsky.com/v1"
export PLUGSKY_PROJECT="prj_8x2…"   # optional, defaults to your first project
export PLUGSKY_REGION="me-central-1"

Escopos e funções

Cada chave possui uma lista de escopos separada por vírgulas. Exemplos: chat:write,embeddings:write,files:read. Use o escopo mais restrito que funcionar — chaves de produção nunca devem ter admin.

OAuth 2.0 (aplicativos de terceiros)

A Plugsky suporta o fluxo padrão de código de autorização OAuth 2.0 com PKCE para aplicativos SaaS que desejam oferecer "Entrar com Plugsky" ou acessar os workspaces Plugsky de seus usuários. Leia o guia completo de OAuth →

⚠

Rotacione as chaves trimestralmente. Chaves antigas permanecem válidas por 24 horas após a rotação para que implantações possam ser atualizadas sem interrupção. Rotacione agora →

Referência da API

Cada endpoint, cada parâmetro, cada código de status. Compatível com o namespace /v1/* da OpenAI; extensões específicas da Plugsky ficam em /v1/plugsky/*.

Chat completions

POST /v1/chat/completions

O endpoint principal de inferência. Suporta streaming, function-calling, modo JSON, saídas estruturadas, visão e uso de ferramentas.

Obrigatório: model, messages · Opcional: temperature, top_p, n, stream, stop, max_tokens, presence_penalty, frequency_penalty, tools, tool_choice, response_format, seed, user

from openai import OpenAI
client = OpenAI(api_key="sk-live-…", base_url="https://plugsky.com/v1")

stream = client.chat.completions.create(
    model="plugsky-pro",
    messages=[{"role": "user", "content": "Write a haiku about GCC summers"}],
    stream=True,
    temperature=0.7,
)
for chunk in stream:
    print(chunk.choices[0].delta.content or "", end="")

Completions legados

POST/v1/completionsem breve

Endpoint de completions cru pré-chat. Retrocompatível. Prefira /v1/chat/completions para novas integrações.

Embeddings

POST/v1/embeddings

Embeddings vetoriais para busca semântica, RAG, agrupamento e recomendações. Modelos →

resp = client.embeddings.create(
    model="plugsky-embed",
    input=["Plugsky is a sovereign AI cloud", "GCC banks run on us"],
)
print(len(resp.data[0].embedding), "dimensions")  # 2048

Geração de imagens

POST/v1/images/generationsem breve

Em breve — geração de imagens compatível com OpenAI. Aliases de modelo planejados: dall-e-3 (Flux Dev), dall-e-2 (Flux Schnell). O endpoint atualmente retorna 501 até que um modelo de imagem seja habilitado no catálogo upstream.

Áudio (ASR / TTS)

POST/v1/audio/transcriptionsem breve

Fala para texto. 99 idiomas, suporte a dialetos árabes, streaming em tempo real. Modelo whisper-plugsky.

POST/v1/audio/speechem breve

Texto para fala. Mais de 30 vozes, SSML, árabe e inglês, tempo real.

Moderação

POST/v1/moderationsem breve

Classifica texto para conteúdo prejudicial. Retorna pontuações por categoria (ódio, violência, sexual, automutilação, PII). Extensão Plugsky: pii, prompt-injection.

Arquivos

POST/v1/filesem breve

Envie arquivos para fine-tuning, batch ou ingestão em vector store. Até 512 MB por arquivo. PDF, DOCX, MD, TXT, JSON, CSV, áudio, vídeo.

API Batch

POST/v1/batchesem breve

Processe até 50.000 requisições de forma assíncrona. SLA de 24 horas, 50% mais barato que síncrono. Retorna resultados em JSONL.

Fine-tuning

POST/v1/fine_tuning/jobsem breve

Fine-tuning supervisionado (SFT) e DPO. Modelos base: plugsky-micro, plugsky-lite, plugsky-pro. Seus dados, sua região, suas chaves.

Assistants / Agentes

POST/v1/assistantsem breve

Agentes com estado compatíveis com OpenAI Assistants, com ferramentas (interpretador de código, busca de arquivos, function calling). 100% compatível com a API OpenAI Assistants.

Function calling / ferramentas

Passe um array tools com definições de função em JSON-Schema. O modelo retorna um payload estruturado tool_calls que você executa e depois retorna o resultado. Streaming e chamadas de ferramentas paralelas são suportados. Gere seu schema de função →

Responses (com estado)

POST/v1/responsesem breve

Endpoint com estado compatível com OpenAI Responses. RAG integrado, busca na web, interpretador de código e uso de computador. Recomendado para novas construções de agentes.

Extensões Plugsky

GET/v1/plugsky/usageem breve

Uso por chave, por modelo, por dia. Retorna o mesmo formato usado pelo Dashboard.

POST/v1/plugsky/routeem breve

Roteamento inteligente — passe model="auto" e a Plugsky escolhe o melhor modelo para o prompt, seu alvo de custo e seu alvo de latência.

Modelos

Todos os modelos nos níveis gratuito, pago e embeddings — servidos atrás de um único endpoint compatível com OpenAI, cobrados em uma única fatura, governados por um único conjunto de políticas. A tabela é preenchida ao vivo a partir de GET /v1/models (a fonte única de verdade). Passe o mouse sobre o ícone ⓘ para detalhes completos.

ModeloContextoMelhor paraNível
Carregando modelos…

Roteamento inteligente e Model Fusion

Duas maneiras de obter economia de custos automaticamente. Defina model="plugsky-fusion" para usar a cadeia padrão do dashboard (sequencial, paralela, economia de custos — sua escolha). Para roteamento baseado em classificador, use POST /v1/plugsky/route (o padrão é model="auto"); model="auto" não é aceito por /v1/chat/completions. Economia típica: 60-80% no tráfego de produção. Veja Model Fusion no dashboard para a interface completa.

# Option 1: use your configured Fusion chain
resp = client.chat.completions.create(
    model="plugsky-fusion",   # runs the workspace's default chain
    messages=[{"role": "user", "content": "Hello!"}],
)
print(resp.model)             # which model actually answered (e.g. "plugsky-micro")

# Option 2: smart routing with cost hint
resp = client.chat.completions.create(
    model="auto",              # classifier picks the best model
    route_hint="cost",         # cost | quality | latency
    max_cost_per_1m=0.50,
    messages=[{"role": "user", "content": "Hello!"}],
)
print(resp.model)             # the model Plugsky chose

SDKs

O SDK da OpenAI funciona como está. Também oferecemos SDKs idiomáticos de primeira parte que adicionam recursos específicos da Plugsky (roteamento inteligente, batch, fixação regional).

v2.1.0

Python

3.8+. pip install openai. Defina base_url para Plugsky. Streaming, async, type hints.

v1.4.0

Node.js / TypeScript

18+. npm install openai. Defina baseURL para Plugsky. Browser, Bun, Deno, Cloudflare Workers.

v0.9.0

Go

1.21+. go get github.com/sashabaranov/go-openai. Defina BaseURL para Plugsky. Ciente de contexto.

v1.1.0

Java / Kotlin

JDK 11+. Maven & Gradle. Coroutines, Reactor, sync.

v0.6.0

Rust

1.74+. cargo add openai. tokio, async-std, sync.

v1.0

cURL & HTTP bruto

Qualquer cliente HTTP. Especificação OpenAPI 3.1 publicada em /v1/openapi.json.

Integrações com frameworks

  • LangChain — ChatOpenAI(base_url="https://plugsky.com/v1")
  • LlamaIndex — OpenAI(base_url=…)
  • Vercel AI SDK — openai("…", { baseURL: "https://plugsky.com/v1" })
  • Haystack — OpenAIGenerator(api_base=…)
  • Semantic Kernel — OpenAIChatCompletion(…endpoint=…)
  • AutoGen — OpenAIWrapper(base_url=…)
  • OpenAI Playground — Campo de URL base personalizada. Testado diariamente.

Exemplo: streaming com back-pressure

import openai
client = openai.OpenAI(api_key="sk-live-…", base_url="https://plugsky.com/v1")

with client.chat.completions.stream(
    model="plugsky-pro",
    messages=[{"role":"user","content":"Tell me a 500-word story about Plugsky"}],
) as stream:
    for text in stream.text_stream:
        print(text, end="", flush=True)
    final = stream.get_final_completion()
    print("\n--- usage:", final.usage)

Software oficial e instaladores

Aplicativos desktop, CLI e self-hosted de primeira parte — todos open-source sob MIT / Apache-2.0, com a marca Plugsky e pré-configurados para falar com a API Plugsky. Instale com um comando.

Plugsky CLI

Agente nativo de codificação por IA no terminal — binário único compilado com Bun, com loop de agente integrado, edição de arquivos, sandbox de shell, cliente MCP, indexação RAG e roteamento automático de modelo. Sem necessidade de configuração de provedor — basta plugsky login.

# macOS / Linux (one-line install)
curl -fsSL https://plugsky.com/install | sh

# Authenticate
plugsky login

# One-shot agentic task
plugsky "explain this project"

# Interactive TUI (REPL)
plugsky

Referência rápida:

plugsky "add tests"Tarefa agêntica de uso único
plugskyAbrir TUI interativa
plugsky chat "hi"Resposta em streaming, sem ferramentas
plugsky modelsListar escada de modelos
plugsky indexConstruir índice RAG
plugsky -m auto "task"Roteamento automático de modelo
plugsky --resumeRetomar última sessão

Modos de aprovação: suggest (solicita confirmação para edições + shell) · auto-edit (edições automáticas, solicita confirmação para shell) · full-auto (sem solicitações)

Ver no GitHub → · Guia completo do usuário → · Documentação do CLI no Dashboard →

Plugsky Desktop (baseado em Jan)

Cliente nativo de chat com IA para macOS, Linux, Windows. Construído sobre o projeto open-source Jan (Apache-2.0). Com a marca Plugsky, pré-configurado com plugsky-pro como modelo padrão.

curl -fsSL https://plugsky.com/install-desktop | bash
plugsky-desktop

Disponível para macOS (Apple Silicon + Intel), Linux (x64), Windows (x64).

Plugsky Web (baseado em Open WebUI)

Interface de chat com IA self-hosted no seu navegador. Construído sobre o projeto open-source Open WebUI. Instalação via Docker ou pip, ambos os backends suportados. O modelo plugsky-fusion está pré-listado.

curl -fsSL https://plugsky.com/install-web | bash
plugsky-web start
# → opens http://localhost:8080

Últimos lançamentos (Plugsky CLI v0.1.2 — 05/07/2026)

[

v0.1.2

Plugsky CLI

macOS arm64, macOS x64, Linux x64, Linux arm64, Windows x64, Windows arm64. curl -fsSL https://plugsky.com/install | bash

](https://github.com/coinplannet/plugskyCLI/releases/tag/v0.1.2)[

v0.1.0

Plugsky Desktop (Jan)

macOS arm64/x64 (universal), Linux x64 AppImage, instalador Windows x64. ~150 MB. curl -fsSL https://plugsky.com/install-desktop | bash

](https://github.com/coinplannet/plugskyCLI/releases)[

v0.1.0

Plugsky Web (Open WebUI)

Imagem Docker (1,5 GB) ou instalação via pip. curl -fsSL https://plugsky.com/install-web | bash

](https://github.com/coinplannet/plugskyCLI/releases)

Todos os três são licenciados sob MIT. Veja NOTICE para atribuição completa upstream.

Operações

Limites de taxa e cotas

Todos os planos incluem uso ilimitado dentro dos limites de taxa de uso justo — sem cobrança por token, sem cobrança por requisição, sem taxas de excedente. O único limite é a taxa de requisições por minuto (RPM) do seu nível. Aumente os limites pelo Dashboard ou enviando e-mail para support@plugsky.com.

PlanoTaxa mensalRPM de uso justoConcorrentesChaves de APIAssentos
Gratuito$0 / 14 dias605Ilimitadas1
Hobby$8 / mês3005Ilimitadas1
Starter$20 / mês60010Ilimitadas1
Builder$60 / mês1.50050Ilimitadas5
Scale$120 / mês5.000200Ilimitadas25
EnterpriseContrato anualPersonalizado (10K+)PersonalizadoIlimitadasIlimitados

Mesma taxa fixa em todos os modelos — sem precificação separada para plugsky-frontier vs plugsky-micro. Todo modelo do catálogo está incluído em todos os planos pagos. Recebeu um 429? A resposta inclui um cabeçalho Retry-After. Os SDKs fazem novas tentativas com backoff exponencial automaticamente.

MCP (Model Context Protocol)

A Plugsky oferece um endpoint MCP remoto e um servidor stdio local, para que ChatGPT, Claude, Cursor, VS Code, Windsurf e Zed possam usar seus modelos, coleções RAG, ferramentas da plataforma e ingestão de documentos diretamente.

  • Remoto (Streamable HTTP): https://plugsky.com/mcp com Authorization: Bearer sk-live-… — ferramentas: plugsky_chat, plugsky_models, plugsky_fusion. Abra plugsky.com/mcp para o cartão do servidor e exemplos ao vivo.
  • Local (stdio): npx -y @plugsky/mcp com PLUGSKY_API_KEY (os grupos RAG/uso/ferramentas/arquivos também precisam de PLUGSKY_EMAIL / PLUGSKY_PASSWORD). Filtre ferramentas com --groups=chat,models,rag,usage,tools,files.
  • Configurações prontas: Dashboard → IA → Servidores MCP (conectores Claude Desktop, Cursor, Windsurf, VS Code, ChatGPT).

Novas tentativas e idempotência

Todos os endpoints POST aceitam um cabeçalho Idempotency-Key. Reenviar a mesma chave retorna o resultado em cache por 24 horas. Isso torna seus POSTs seguros para repetição sem cobrança duplicada ou criação duplicada de recursos.

curl -X POST https://plugsky.com/v1/chat/completions \
  -H "Authorization: Bearer $PLUGSKY_API_KEY" \
  -H "Idempotency-Key: $(uuidgen)" \
  -H "Content-Type: application/json" \
  -d '{"model":"plugsky-pro","messages":[{"role":"user","content":"hello"}]}'

Erros e códigos de status

CódigoSignificadoO que fazer
400Requisição inválida — JSON malformado, parâmetro inválidoValide localmente antes de enviar
401Chave de API inválida ou ausenteVerifique o cabeçalho Authorization
403A chave não possui o escopo necessárioVerifique a função da chave no Dashboard
404Modelo ou recurso não encontradoListe /v1/models para ver o que está disponível
409Conflito (chave de idempotência duplicada com corpo diferente)Gere uma nova chave por requisição lógica
429Limite de taxa atingidoRespeite Retry-After
413Corpo da requisição > 16 MBReduza o histórico da conversa ou divida a requisição
400 (contexto)Janela de contexto excedidaA mensagem inclui contagens exatas de tokens — reduza o histórico ou max_tokens
500Erro internoRepita com backoff. Abra um ticket se persistir.
502Falha do provedor upstream (após failover automático)Repita com backoff. Página de status: /status
503Provedor upstream indisponívelRequisições com roteamento inteligente fazem failover automaticamente

Todos os erros de API usam o esquema de erro da OpenAI: {"error":{"message","type","code","param"}} — somente JSON, nunca HTML. O tamanho máximo do corpo da requisição é 16 MB.

Webhooks

Assine 9 tipos de eventos: batch.completed, fine_tuning.completed, invoice.paid, key.rotated, quota.warning, quota.exceeded, model.deprecated, usage.threshold, audit.alert. Assinados com HMAC-SHA256. Configure em Dashboard → Webhooks.

Logs e observabilidade

Cada requisição é registrada com: timestamp, modelo, tokens, latência, status, ID da chave, ID do projeto, região, ID da requisição, tag opcional user. Exporte para Datadog, Splunk, Grafana, New Relic, OpenTelemetry ou seu SIEM.

Status e SLAs

Status ao vivo: /status. Histórico público de incidentes. SLAs de disponibilidade:

  • Builder / Scale: 99,9% de disponibilidade mensal, crédito de 10% em caso de descumprimento
  • Enterprise: 99,95% de disponibilidade mensal, crédito de 25%, 99,99% em implantações multirregionais

Topologias de implantação

Mesma API, quatro modelos de implantação. Escolha um ou combine-os entre equipes.

DEFAULT

Plugsky Cloud

SaaS multilocatário. Primário em me-central-1 (EAU), eu-west-1, us-east-1, ap-southeast-1. Mais rápido para começar.

ENTERPRISE

Implantação em VPC

O Plugsky roda dentro da sua VPC AWS / GCP / Azure / OCI. Sua rede, seu peering, seu KMS, suas chaves.

REGULATED

On-premises

Helm chart ou instalador air-gap para seu data center. Pool de GPUs: H100, H200, MI300X ou somente CPU.

SOVEREIGN

Air-gapped

Sem internet alguma. O pacote é enviado em mídia física. Atualização mensal de modelos por transportadora.

FINANCIAL

Traga sua própria nuvem

O plano de controle do Plugsky roda na nossa nuvem; a inferência roda na sua conta de nuvem. Você paga seu hyperscaler diretamente.

SAAS

White-label

Sua marca no dashboard, seu domínio, suas cores. Revenda IA sob seu próprio SKU.

Matriz de decisão

Você precisa…Use
Lançar em 1 dia, sem conformidadePlugsky Cloud
Dados permanecem em me-central-1Plugsky Cloud (região fixa)
Nenhum dado sai da sua conta AWS / Azure / GCPImplantação em VPC
Trilha de auditoria SAMA / CBUAE / NSDImplantação em VPC + chaves gerenciadas pelo cliente
Air-gap, sem internetOn-prem ou air-gapped
Revender IA sob sua marcaWhite-label

Segurança e conformidade

Modelo de segurança

  • Criptografia em trânsito: somente TLS 1.3, HSTS, cifras modernas
  • Criptografia em repouso: AES-256-GCM, chaves gerenciadas pelo cliente disponíveis
  • Isolamento de rede: VPC por locatário, security groups, sem kernel compartilhado
  • Isolamento de locatário: lógico (RBAC + chaves com escopo) ou físico (seu próprio cluster)
  • Higiene de segredos: chaves nunca são registradas, nunca retornadas em respostas, com hash em repouso usando Argon2id
  • Testes de penetração: trimestrais pela HackerOne + uma empresa externa. Relatórios sob NDA.
  • Bug bounty: até US$ 25.000. security@plugsky.com

Residência de dados

Escolha por requisição ou fixe globalmente. Regiões: me-central-1 (EAU — GCC padrão), sa-central-1 (Riad — Enterprise), eu-west-1 (Dublin), eu-central-1 (Frankfurt), us-east-1, us-west-2, ap-southeast-1 (Singapura). Os dados nunca saem da região fixada. Mergulho profundo →

Conformidade e certificações

  • SOC 2 Tipo II — auditado anualmente, relatório sob NDA
  • ISO 27001 — Gestão de segurança da informação
  • ISO 27701 — Gestão de privacidade
  • ISO 27017 / 27018 — Nuvem e PII
  • GDPR — Proteção de dados da UE
  • HIPAA — Saúde (Enterprise + BAA)
  • PCI DSS — Segurança de dados de cartão (sem inferência em dados de cartão, exceto on-prem)
  • FedRAMP Moderate — Em processo, disponível no Enterprise
  • PDPL dos EAU — Lei Federal de Proteção de Dados
  • DIFC DPL — Centro Financeiro Internacional de Dubai
  • SAMA CSF — Estrutura cibernética do Banco Central da Arábia Saudita
  • NSD — Alinhamento à Diretriz de Segurança Nacional (Enterprise on-prem)

DPA e aspectos legais

Cláusulas Contratuais Padrão (SCCs) incorporadas ao DPA. Lista de subprocessadores publicada e atualizada em até 30 dias após qualquer alteração. Leia o DPA →

Logs de auditoria

Cada ação de chave — criação, rotação, alteração de escopo, exclusão — é registrada com ator, timestamp, IP e hash do corpo da requisição. Exportável para seu SIEM (Splunk, Sentinel, QRadar, Chronicle) via webhook ou Kinesis/Firehose.

BYOK / HSM

Traga sua própria chave. O Plugsky nunca vê sua chave — você a importa para nossa integração HSM (AWS KMS, GCP KMS, Azure Key Vault, HashiCorp Vault, Thales Luna, AWS CloudHSM). Rotação de chaves, revogação e auditoria são todas suas.

Tratamento de PII

Três modos: sem-PII (filtro rigoroso, PII com redação automática), somente-detecção (PII marcada, mas não modificada), passagem (sua responsabilidade). O padrão é somente-detecção para inferência e sem-PII para embeddings. Execute a lista de verificação de residência →

Cobrança

Planos

Taxa mensal fixa por workspace. Todos os modelos do catálogo incluídos em todos os planos pagos — sem cobrança por token, sem cobrança por requisição, sem taxas de excedente, sem surpresas na fatura. Cancele ou faça downgrade a qualquer momento.

PlanoTaxa mensalO que está incluídoMelhor para
FreeUS$ 0Modelos de IA gratuitos (plugsky-micro, plugsky-lite), Playground + Playground Beta, 30 RPM, 500 requisições/dia (uso justo), chaves de API ilimitadas, 1 assento. Recursos pagos (Agents, Tools, RAG, Marketplace, Integrations, Teams) estão bloqueados.Primeira chamada, avaliação, chat de hobby
TrialUS$ 0 / 14 diasTeste de acesso total: modelos até plugsky-plus, Tools, RAG, Integrations, 60 RPM, chaves de API ilimitadas, sem necessidade de cartãoAvaliar a plataforma completa
HobbyUS$ 8 / mêsTodos os modelos, 300 RPM, 1 assento, chaves ilimitadasProjetos de hobby, desenvolvedores independentes
StarterUS$ 20 / mêsTodos os modelos, 600 RPM, 1 assento, chaves ilimitadasDesenvolvedores solo, projetos paralelos
BuilderUS$ 60 / mêsTodos os modelos, incl. visão, 1.500 RPM, 5 assentos, chaves ilimitadasEquipes de produção
ScaleUS$ 120 / mêsTodos os modelos, incluindo frontier, 5.000 RPM, 25 assentos, chaves ilimitadas, SSOSaaS de alto volume
EnterpriseContrato anualUso ilimitado, 10K+ RPM, assentos ilimitados, on-prem, BYOK, SLA de 99,99%, DPA, BAA, engenheiro dedicadoBancos, governo, regulados

A cobrança anual economiza 20% (Hobby: 50%). Os planos Enterprise são contratos anuais com preço conforme sua implantação, segurança e requisitos de volume — mustafa@plugsky.com ou mustafa@plugsky.com · WhatsApp +973 3659 9909.

Plano gratuito — o que você recebe

O plano Free é permanente (US$ 0, sem cartão) e foi criado para testar a plataforma e uso leve:

  • Modelos de IA gratuitos — plugsky-micro e plugsky-lite (chat + JSON, uso justo ilimitado, 30 requisições/min).
  • Playground e Playground Beta — acesso total a chat, comparação de modelos e ferramentas de prompt.
  • Acesso à API — chaves de API ilimitadas, endpoint compatível com OpenAI, somente modelos gratuitos.
  • Uso e análises, catálogo de modelos, cobrança e configurações da conta.

Bloqueado até você fazer upgrade: modelos pagos (plugsky-plus e superiores), Agent Cloud, Tools & Connectors (function calling), Knowledge / RAG, Model Fusion, Marketplace, Integrations e Teams multiusuário.

Toda nova conta também começa com um teste de acesso total de 14 dias — sem necessidade de cartão — que desbloqueia modelos até plugsky-plus, Tools, RAG e Integrations para que você possa avaliar tudo antes de escolher um plano.

Uso e medição

Uso ilimitado em todos os planos. Sem cobrança por token, sem cobrança por requisição, sem taxas de excedente. O único limite é o RPM de uso justo do seu nível (60 trial · 300 · 600 · 1.500 · 5.000 · 10K+ no Enterprise). As contagens de tokens ainda são retornadas em cada resposta (usage.prompt_tokens, usage.completion_tokens) para observabilidade — mas não geram cobrança.

Faturas e impostos

Cobrança mensal no dia 1º. Faturas em PDF enviadas por e-mail automaticamente. Em conformidade com IVA para EAU (5%), Arábia Saudita (15%), UE (reverse charge) e EUA (sem imposto sobre vendas em SaaS na maioria dos estados). Transferência bancária, ACH, SEPA e principais cartões de crédito. Contratos anuais: preço por implantação, pagamento antecipado.

Cotas e limites

Limites rígidos de US$ no nível do projeto evitam gastos descontrolados. Alertas suaves em 50%, 80%, 95%. Bloqueio rígido em 100% (rejeição automática 402). Você pode definir overage_behavior=allow com uma chave aprovada pelo financeiro para permitir excedente de até 3× o limite com cobrança automática.

Guias de migração

Do OpenAI

  1. Gere uma chave Plugsky no Dashboard
  2. No seu código, altere base_url para https://plugsky.com/v1
  3. Opcionalmente, mapeie gpt-4o → plugsky-pro, gpt-4o-mini → plugsky-lite para economizar custos
  4. Execute suas avaliações existentes — devem passar sem alterações
  5. Alterne o DNS / faça o corte quando estiver pronto

Precisa de um passo a passo de migração por linguagem? Guia completo → ou gere código para sua stack →

Do Anthropic

Roadmap: um endpoint /v1/messages nativo compatível com Anthropic está planejado. Hoje, aponte o modo de compatibilidade com OpenAI do SDK Anthropic para https://plugsky.com/v1 e mapeie claude-3-5-sonnet → plugsky-pro (mesmo nível de qualidade, economia de 40%+).

Do Azure OpenAI

Aponte seu SDK Azure para https://plugsky.com/v1 (o SDK Azure suporta endpoints personalizados). Os modelos mantêm seus nomes Azure com o prefixo azure/. Os filtros de conteúdo existentes e os recursos específicos do Azure têm equivalentes no Plugsky — veja a matriz de compatibilidade completa →

Do AWS Bedrock

Use o parâmetro endpoint_url do SDK Bedrock. Roadmap: um endpoint nativo Bedrock Converse está planejado. Hoje, use o modo compatível com OpenAI do SDK Bedrock com endpoint_url=https://plugsky.com/v1 e IDs de modelo como plugsky-pro.

Referência

Glossário

TermoDefinição
TokenA unidade atômica de cobrança. ~4 caracteres em inglês. ~1,5 caracteres em árabe.
Janela de contextoMáximo de tokens que um modelo pode ver em uma única chamada (entrada + saída).
EmbeddingUma representação vetorial de comprimento fixo do texto. Usada para busca semântica.
RAGGeração Aumentada por Recuperação: recupere documentos relevantes, insira no prompt, gere.
Function callingO modelo retorna uma chamada de ferramenta estruturada em vez de texto livre. Você executa e retorna o resultado.
Fine-tuningContinuar o treinamento de um modelo base com seus dados. SFT (supervisionado) ou DPO (preferência).
DestilaçãoTreinar um modelo pequeno para imitar um grande. Mais barato, mais rápido, qualidade semelhante.
AgenteModelo + ferramentas + memória + loop de planejamento. Execução autônoma de tarefas em várias etapas.
Armazenamento vetorialEmbeddings indexados para busca rápida de similaridade. O Plugsky inclui um pronto para uso.
BYOKTraga sua própria chave. Você controla as chaves de criptografia. Não podemos ler seus dados.
SoberanoHospedado inteiramente dentro de uma jurisdição, sem acesso estrangeiro. Em conformidade com PDPL.

Changelog

/changelog — histórico completo de versões. Assine o RSS ou o webhook model.deprecated.

Suporte

Perguntas frequentes

O Plugsky é compatível com OpenAI?

Sim — a API espelha o formato da OpenAI (chat completions, embeddings, models), então os SDKs existentes funcionam após alterar a URL base e a chave de API.

Como obtenho uma chave de API?

Crie uma conta gratuita, abra Dashboard → API Keys e crie uma chave. O plano gratuito inclui dois modelos gratuitos, sem necessidade de cartão de crédito.

Onde reporto um problema com a API?

Inclua o request id da resposta de erro e abra um ticket de suporte pelo dashboard; os tickets são acompanhados e respondidos pela equipe.