Plugsky MCP
Plugsky é um servidor Model Context Protocol ao vivo — conecte ChatGPT, Claude, Cursor, VS Code ou Windsurf a 20 ferramentas ao vivo: todos os modelos, busca na web, transcrições de vídeo, áudio, visão, geração de imagens, memória persistente, navegação e um sandbox de código — por meio de uma única URL.
Documentação
Começando
Cinco minutos do zero até sua primeira resposta do modelo. A API Plugsky é 100% compatível com OpenAI — altere seu base_url e seu código existente, SDK e prompts continuarão funcionando.
Instalação
# Python (OpenAI SDK — works as-is)
pip install openai
# Node.js / TypeScript
npm install openai
# Go
go get github.com/sashabaranov/go-openai
# Or use raw HTTP — no SDK required
Sua primeira chamada de API
from openai import OpenAI
client = OpenAI(
api_key="sk-live-…", # your Plugsky key
base_url="https://plugsky.com/v1", # the only line that changes
)
resp = client.chat.completions.create(
model="plugsky-pro",
messages=[{"role": "user", "content": "Say hello in 5 languages"}],
max_tokens=200,
)
print(resp.choices[0].message.content)
É isso. Mesmo formato de requisição, mesmo formato de resposta, mesmo streaming, mesmo function-calling, mesmo modo JSON. Referência completa de compatibilidade com OpenAI →
✓
Substituição direta. Seus clientes OpenAI existentes em Python, Node, Go, Java, .NET e cURL funcionam sem alterações de código. Ferramentas como LangChain, LlamaIndex, Vercel AI SDK e OpenAI Playground são totalmente suportadas.
Conceitos principais
- Modelo. O mecanismo de inferência.
plugsky-microatéplugsky-frontier, além de 13+ modelos de terceiros (opencode.ai, NVIDIA NIM, Mistral, Cohere, Stability). - Requisição. Uma única chamada de API. Contabilizada por tokens. Precificada.
- Thread / Run. Conversa multi-turno com estado (Assistants API).
- Ferramenta. Uma função que você expõe ao modelo para function-calling.
- Base de conhecimento / Vector store. Documentos indexados que o modelo pode consultar (RAG).
- Endpoint / Região. Onde o modelo é executado.
me-central-1(EAU),eu-west-1,us-east-1, além de VPC do cliente e on-premises.
Autenticação
A Plugsky usa chaves de API com bearer token. As chaves são escopadas por projeto, por função e podem ser rotacionadas sem tempo de inatividade.
Chaves de API
Gere chaves no Dashboard → API keys. Cada chave possui um escopo e um projeto. Três funções integradas:
| Função | Pode fazer | Não pode fazer |
|---|---|---|
read | Listar modelos, obter uso, visualizar logs de auditoria | Inferência, criação de chaves |
infer | Chat / embeddings / imagem / áudio / batch | Administração, cobrança, criação de chaves |
admin | Tudo acima + gerenciamento de chaves + cobrança + RBAC | Configurações de nível organizacional (somente root) |
Variáveis de ambiente
export PLUGSKY_API_KEY="sk-live-…"
export PLUGSKY_BASE_URL="https://plugsky.com/v1"
export PLUGSKY_PROJECT="prj_8x2…" # optional, defaults to your first project
export PLUGSKY_REGION="me-central-1"
Escopos e funções
Cada chave possui uma lista de escopos separada por vírgulas. Exemplos: chat:write,embeddings:write,files:read. Use o escopo mais restrito que funcionar — chaves de produção nunca devem ter admin.
OAuth 2.0 (aplicativos de terceiros)
A Plugsky suporta o fluxo padrão de código de autorização OAuth 2.0 com PKCE para aplicativos SaaS que desejam oferecer "Entrar com Plugsky" ou acessar os workspaces Plugsky de seus usuários. Leia o guia completo de OAuth →
⚠
Rotacione as chaves trimestralmente. Chaves antigas permanecem válidas por 24 horas após a rotação para que implantações possam ser atualizadas sem interrupção. Rotacione agora →
Referência da API
Cada endpoint, cada parâmetro, cada código de status. Compatível com o namespace /v1/* da OpenAI; extensões específicas da Plugsky ficam em /v1/plugsky/*.
Chat completions
POST /v1/chat/completions
O endpoint principal de inferência. Suporta streaming, function-calling, modo JSON, saídas estruturadas, visão e uso de ferramentas.
Obrigatório: model, messages · Opcional: temperature, top_p, n, stream, stop, max_tokens, presence_penalty, frequency_penalty, tools, tool_choice, response_format, seed, user
from openai import OpenAI
client = OpenAI(api_key="sk-live-…", base_url="https://plugsky.com/v1")
stream = client.chat.completions.create(
model="plugsky-pro",
messages=[{"role": "user", "content": "Write a haiku about GCC summers"}],
stream=True,
temperature=0.7,
)
for chunk in stream:
print(chunk.choices[0].delta.content or "", end="")
Completions legados
POST/v1/completionsem breve
Endpoint de completions cru pré-chat. Retrocompatível. Prefira /v1/chat/completions para novas integrações.
Embeddings
POST/v1/embeddings
Embeddings vetoriais para busca semântica, RAG, agrupamento e recomendações. Modelos →
resp = client.embeddings.create(
model="plugsky-embed",
input=["Plugsky is a sovereign AI cloud", "GCC banks run on us"],
)
print(len(resp.data[0].embedding), "dimensions") # 2048
Geração de imagens
POST/v1/images/generationsem breve
Em breve — geração de imagens compatível com OpenAI. Aliases de modelo planejados: dall-e-3 (Flux Dev), dall-e-2 (Flux Schnell). O endpoint atualmente retorna 501 até que um modelo de imagem seja habilitado no catálogo upstream.
Áudio (ASR / TTS)
POST/v1/audio/transcriptionsem breve
Fala para texto. 99 idiomas, suporte a dialetos árabes, streaming em tempo real. Modelo whisper-plugsky.
POST/v1/audio/speechem breve
Texto para fala. Mais de 30 vozes, SSML, árabe e inglês, tempo real.
Moderação
POST/v1/moderationsem breve
Classifica texto para conteúdo prejudicial. Retorna pontuações por categoria (ódio, violência, sexual, automutilação, PII). Extensão Plugsky: pii, prompt-injection.
Arquivos
POST/v1/filesem breve
Envie arquivos para fine-tuning, batch ou ingestão em vector store. Até 512 MB por arquivo. PDF, DOCX, MD, TXT, JSON, CSV, áudio, vídeo.
API Batch
POST/v1/batchesem breve
Processe até 50.000 requisições de forma assíncrona. SLA de 24 horas, 50% mais barato que síncrono. Retorna resultados em JSONL.
Fine-tuning
POST/v1/fine_tuning/jobsem breve
Fine-tuning supervisionado (SFT) e DPO. Modelos base: plugsky-micro, plugsky-lite, plugsky-pro. Seus dados, sua região, suas chaves.
Assistants / Agentes
POST/v1/assistantsem breve
Agentes com estado compatíveis com OpenAI Assistants, com ferramentas (interpretador de código, busca de arquivos, function calling). 100% compatível com a API OpenAI Assistants.
Function calling / ferramentas
Passe um array tools com definições de função em JSON-Schema. O modelo retorna um payload estruturado tool_calls que você executa e depois retorna o resultado. Streaming e chamadas de ferramentas paralelas são suportados. Gere seu schema de função →
Responses (com estado)
POST/v1/responsesem breve
Endpoint com estado compatível com OpenAI Responses. RAG integrado, busca na web, interpretador de código e uso de computador. Recomendado para novas construções de agentes.
Extensões Plugsky
GET/v1/plugsky/usageem breve
Uso por chave, por modelo, por dia. Retorna o mesmo formato usado pelo Dashboard.
POST/v1/plugsky/routeem breve
Roteamento inteligente — passe model="auto" e a Plugsky escolhe o melhor modelo para o prompt, seu alvo de custo e seu alvo de latência.
Modelos
Todos os modelos nos níveis gratuito, pago e embeddings — servidos atrás de um único endpoint compatível com OpenAI, cobrados em uma única fatura, governados por um único conjunto de políticas. A tabela é preenchida ao vivo a partir de GET /v1/models (a fonte única de verdade). Passe o mouse sobre o ícone ⓘ para detalhes completos.
| Modelo | Contexto | Melhor para | Nível |
|---|---|---|---|
| Carregando modelos… | |||
Roteamento inteligente e Model Fusion
Duas maneiras de obter economia de custos automaticamente. Defina model="plugsky-fusion" para usar a cadeia padrão do dashboard (sequencial, paralela, economia de custos — sua escolha). Para roteamento baseado em classificador, use POST /v1/plugsky/route (o padrão é model="auto"); model="auto" não é aceito por /v1/chat/completions. Economia típica: 60-80% no tráfego de produção. Veja Model Fusion no dashboard para a interface completa.
# Option 1: use your configured Fusion chain
resp = client.chat.completions.create(
model="plugsky-fusion", # runs the workspace's default chain
messages=[{"role": "user", "content": "Hello!"}],
)
print(resp.model) # which model actually answered (e.g. "plugsky-micro")
# Option 2: smart routing with cost hint
resp = client.chat.completions.create(
model="auto", # classifier picks the best model
route_hint="cost", # cost | quality | latency
max_cost_per_1m=0.50,
messages=[{"role": "user", "content": "Hello!"}],
)
print(resp.model) # the model Plugsky chose
SDKs
O SDK da OpenAI funciona como está. Também oferecemos SDKs idiomáticos de primeira parte que adicionam recursos específicos da Plugsky (roteamento inteligente, batch, fixação regional).
v2.1.0
Python
3.8+. pip install openai. Defina base_url para Plugsky. Streaming, async, type hints.
v1.4.0
Node.js / TypeScript
18+. npm install openai. Defina baseURL para Plugsky. Browser, Bun, Deno, Cloudflare Workers.
v0.9.0
Go
1.21+. go get github.com/sashabaranov/go-openai. Defina BaseURL para Plugsky. Ciente de contexto.
v1.1.0
Java / Kotlin
JDK 11+. Maven & Gradle. Coroutines, Reactor, sync.
v0.6.0
Rust
1.74+. cargo add openai. tokio, async-std, sync.
v1.0
cURL & HTTP bruto
Qualquer cliente HTTP. Especificação OpenAPI 3.1 publicada em /v1/openapi.json.
Integrações com frameworks
- LangChain —
ChatOpenAI(base_url="https://plugsky.com/v1") - LlamaIndex —
OpenAI(base_url=…) - Vercel AI SDK —
openai("…", { baseURL: "https://plugsky.com/v1" }) - Haystack —
OpenAIGenerator(api_base=…) - Semantic Kernel —
OpenAIChatCompletion(…endpoint=…) - AutoGen —
OpenAIWrapper(base_url=…) - OpenAI Playground — Campo de URL base personalizada. Testado diariamente.
Exemplo: streaming com back-pressure
import openai
client = openai.OpenAI(api_key="sk-live-…", base_url="https://plugsky.com/v1")
with client.chat.completions.stream(
model="plugsky-pro",
messages=[{"role":"user","content":"Tell me a 500-word story about Plugsky"}],
) as stream:
for text in stream.text_stream:
print(text, end="", flush=True)
final = stream.get_final_completion()
print("\n--- usage:", final.usage)
Software oficial e instaladores
Aplicativos desktop, CLI e self-hosted de primeira parte — todos open-source sob MIT / Apache-2.0, com a marca Plugsky e pré-configurados para falar com a API Plugsky. Instale com um comando.
Plugsky CLI
Agente nativo de codificação por IA no terminal — binário único compilado com Bun, com loop de agente integrado, edição de arquivos, sandbox de shell, cliente MCP, indexação RAG e roteamento automático de modelo. Sem necessidade de configuração de provedor — basta plugsky login.
# macOS / Linux (one-line install)
curl -fsSL https://plugsky.com/install | sh
# Authenticate
plugsky login
# One-shot agentic task
plugsky "explain this project"
# Interactive TUI (REPL)
plugsky
Referência rápida:
plugsky "add tests" | Tarefa agêntica de uso único |
|---|---|
plugsky | Abrir TUI interativa |
plugsky chat "hi" | Resposta em streaming, sem ferramentas |
plugsky models | Listar escada de modelos |
plugsky index | Construir índice RAG |
plugsky -m auto "task" | Roteamento automático de modelo |
plugsky --resume | Retomar última sessão |
Modos de aprovação: suggest (solicita confirmação para edições + shell) · auto-edit (edições automáticas, solicita confirmação para shell) · full-auto (sem solicitações)
Ver no GitHub → · Guia completo do usuário → · Documentação do CLI no Dashboard →
Plugsky Desktop (baseado em Jan)
Cliente nativo de chat com IA para macOS, Linux, Windows. Construído sobre o projeto open-source Jan (Apache-2.0). Com a marca Plugsky, pré-configurado com plugsky-pro como modelo padrão.
curl -fsSL https://plugsky.com/install-desktop | bash
plugsky-desktop
Disponível para macOS (Apple Silicon + Intel), Linux (x64), Windows (x64).
Plugsky Web (baseado em Open WebUI)
Interface de chat com IA self-hosted no seu navegador. Construído sobre o projeto open-source Open WebUI. Instalação via Docker ou pip, ambos os backends suportados. O modelo plugsky-fusion está pré-listado.
curl -fsSL https://plugsky.com/install-web | bash
plugsky-web start
# → opens http://localhost:8080
Últimos lançamentos (Plugsky CLI v0.1.2 — 05/07/2026)
[
v0.1.2
Plugsky CLI
macOS arm64, macOS x64, Linux x64, Linux arm64, Windows x64, Windows arm64. curl -fsSL https://plugsky.com/install | bash
](https://github.com/coinplannet/plugskyCLI/releases/tag/v0.1.2)[
v0.1.0
Plugsky Desktop (Jan)
macOS arm64/x64 (universal), Linux x64 AppImage, instalador Windows x64. ~150 MB. curl -fsSL https://plugsky.com/install-desktop | bash
](https://github.com/coinplannet/plugskyCLI/releases)[
v0.1.0
Plugsky Web (Open WebUI)
Imagem Docker (1,5 GB) ou instalação via pip. curl -fsSL https://plugsky.com/install-web | bash
](https://github.com/coinplannet/plugskyCLI/releases)
Todos os três são licenciados sob MIT. Veja NOTICE para atribuição completa upstream.
Operações
Limites de taxa e cotas
Todos os planos incluem uso ilimitado dentro dos limites de taxa de uso justo — sem cobrança por token, sem cobrança por requisição, sem taxas de excedente. O único limite é a taxa de requisições por minuto (RPM) do seu nível. Aumente os limites pelo Dashboard ou enviando e-mail para support@plugsky.com.
| Plano | Taxa mensal | RPM de uso justo | Concorrentes | Chaves de API | Assentos |
|---|---|---|---|---|---|
| Gratuito | $0 / 14 dias | 60 | 5 | Ilimitadas | 1 |
| Hobby | $8 / mês | 300 | 5 | Ilimitadas | 1 |
| Starter | $20 / mês | 600 | 10 | Ilimitadas | 1 |
| Builder | $60 / mês | 1.500 | 50 | Ilimitadas | 5 |
| Scale | $120 / mês | 5.000 | 200 | Ilimitadas | 25 |
| Enterprise | Contrato anual | Personalizado (10K+) | Personalizado | Ilimitadas | Ilimitados |
Mesma taxa fixa em todos os modelos — sem precificação separada para plugsky-frontier vs plugsky-micro. Todo modelo do catálogo está incluído em todos os planos pagos. Recebeu um 429? A resposta inclui um cabeçalho Retry-After. Os SDKs fazem novas tentativas com backoff exponencial automaticamente.
MCP (Model Context Protocol)
A Plugsky oferece um endpoint MCP remoto e um servidor stdio local, para que ChatGPT, Claude, Cursor, VS Code, Windsurf e Zed possam usar seus modelos, coleções RAG, ferramentas da plataforma e ingestão de documentos diretamente.
- Remoto (Streamable HTTP):
https://plugsky.com/mcpcomAuthorization: Bearer sk-live-…— ferramentas:plugsky_chat,plugsky_models,plugsky_fusion. Abra plugsky.com/mcp para o cartão do servidor e exemplos ao vivo. - Local (stdio):
npx -y @plugsky/mcpcomPLUGSKY_API_KEY(os grupos RAG/uso/ferramentas/arquivos também precisam dePLUGSKY_EMAIL/PLUGSKY_PASSWORD). Filtre ferramentas com--groups=chat,models,rag,usage,tools,files. - Configurações prontas: Dashboard → IA → Servidores MCP (conectores Claude Desktop, Cursor, Windsurf, VS Code, ChatGPT).
Novas tentativas e idempotência
Todos os endpoints POST aceitam um cabeçalho Idempotency-Key. Reenviar a mesma chave retorna o resultado em cache por 24 horas. Isso torna seus POSTs seguros para repetição sem cobrança duplicada ou criação duplicada de recursos.
curl -X POST https://plugsky.com/v1/chat/completions \
-H "Authorization: Bearer $PLUGSKY_API_KEY" \
-H "Idempotency-Key: $(uuidgen)" \
-H "Content-Type: application/json" \
-d '{"model":"plugsky-pro","messages":[{"role":"user","content":"hello"}]}'
Erros e códigos de status
| Código | Significado | O que fazer |
|---|---|---|
400 | Requisição inválida — JSON malformado, parâmetro inválido | Valide localmente antes de enviar |
401 | Chave de API inválida ou ausente | Verifique o cabeçalho Authorization |
403 | A chave não possui o escopo necessário | Verifique a função da chave no Dashboard |
404 | Modelo ou recurso não encontrado | Liste /v1/models para ver o que está disponível |
409 | Conflito (chave de idempotência duplicada com corpo diferente) | Gere uma nova chave por requisição lógica |
429 | Limite de taxa atingido | Respeite Retry-After |
413 | Corpo da requisição > 16 MB | Reduza o histórico da conversa ou divida a requisição |
400 (contexto) | Janela de contexto excedida | A mensagem inclui contagens exatas de tokens — reduza o histórico ou max_tokens |
500 | Erro interno | Repita com backoff. Abra um ticket se persistir. |
502 | Falha do provedor upstream (após failover automático) | Repita com backoff. Página de status: /status |
503 | Provedor upstream indisponível | Requisições com roteamento inteligente fazem failover automaticamente |
Todos os erros de API usam o esquema de erro da OpenAI: {"error":{"message","type","code","param"}} — somente JSON, nunca HTML. O tamanho máximo do corpo da requisição é 16 MB.
Webhooks
Assine 9 tipos de eventos: batch.completed, fine_tuning.completed, invoice.paid, key.rotated, quota.warning, quota.exceeded, model.deprecated, usage.threshold, audit.alert. Assinados com HMAC-SHA256. Configure em Dashboard → Webhooks.
Logs e observabilidade
Cada requisição é registrada com: timestamp, modelo, tokens, latência, status, ID da chave, ID do projeto, região, ID da requisição, tag opcional user. Exporte para Datadog, Splunk, Grafana, New Relic, OpenTelemetry ou seu SIEM.
Status e SLAs
Status ao vivo: /status. Histórico público de incidentes. SLAs de disponibilidade:
- Builder / Scale: 99,9% de disponibilidade mensal, crédito de 10% em caso de descumprimento
- Enterprise: 99,95% de disponibilidade mensal, crédito de 25%, 99,99% em implantações multirregionais
Topologias de implantação
Mesma API, quatro modelos de implantação. Escolha um ou combine-os entre equipes.
DEFAULT
Plugsky Cloud
SaaS multilocatário. Primário em me-central-1 (EAU), eu-west-1, us-east-1, ap-southeast-1. Mais rápido para começar.
ENTERPRISE
Implantação em VPC
O Plugsky roda dentro da sua VPC AWS / GCP / Azure / OCI. Sua rede, seu peering, seu KMS, suas chaves.
REGULATED
On-premises
Helm chart ou instalador air-gap para seu data center. Pool de GPUs: H100, H200, MI300X ou somente CPU.
SOVEREIGN
Air-gapped
Sem internet alguma. O pacote é enviado em mídia física. Atualização mensal de modelos por transportadora.
FINANCIAL
Traga sua própria nuvem
O plano de controle do Plugsky roda na nossa nuvem; a inferência roda na sua conta de nuvem. Você paga seu hyperscaler diretamente.
SAAS
White-label
Sua marca no dashboard, seu domínio, suas cores. Revenda IA sob seu próprio SKU.
Matriz de decisão
| Você precisa… | Use |
|---|---|
| Lançar em 1 dia, sem conformidade | Plugsky Cloud |
| Dados permanecem em me-central-1 | Plugsky Cloud (região fixa) |
| Nenhum dado sai da sua conta AWS / Azure / GCP | Implantação em VPC |
| Trilha de auditoria SAMA / CBUAE / NSD | Implantação em VPC + chaves gerenciadas pelo cliente |
| Air-gap, sem internet | On-prem ou air-gapped |
| Revender IA sob sua marca | White-label |
Segurança e conformidade
Modelo de segurança
- Criptografia em trânsito: somente TLS 1.3, HSTS, cifras modernas
- Criptografia em repouso: AES-256-GCM, chaves gerenciadas pelo cliente disponíveis
- Isolamento de rede: VPC por locatário, security groups, sem kernel compartilhado
- Isolamento de locatário: lógico (RBAC + chaves com escopo) ou físico (seu próprio cluster)
- Higiene de segredos: chaves nunca são registradas, nunca retornadas em respostas, com hash em repouso usando Argon2id
- Testes de penetração: trimestrais pela HackerOne + uma empresa externa. Relatórios sob NDA.
- Bug bounty: até US$ 25.000. security@plugsky.com
Residência de dados
Escolha por requisição ou fixe globalmente. Regiões: me-central-1 (EAU — GCC padrão), sa-central-1 (Riad — Enterprise), eu-west-1 (Dublin), eu-central-1 (Frankfurt), us-east-1, us-west-2, ap-southeast-1 (Singapura). Os dados nunca saem da região fixada. Mergulho profundo →
Conformidade e certificações
- SOC 2 Tipo II — auditado anualmente, relatório sob NDA
- ISO 27001 — Gestão de segurança da informação
- ISO 27701 — Gestão de privacidade
- ISO 27017 / 27018 — Nuvem e PII
- GDPR — Proteção de dados da UE
- HIPAA — Saúde (Enterprise + BAA)
- PCI DSS — Segurança de dados de cartão (sem inferência em dados de cartão, exceto on-prem)
- FedRAMP Moderate — Em processo, disponível no Enterprise
- PDPL dos EAU — Lei Federal de Proteção de Dados
- DIFC DPL — Centro Financeiro Internacional de Dubai
- SAMA CSF — Estrutura cibernética do Banco Central da Arábia Saudita
- NSD — Alinhamento à Diretriz de Segurança Nacional (Enterprise on-prem)
DPA e aspectos legais
Cláusulas Contratuais Padrão (SCCs) incorporadas ao DPA. Lista de subprocessadores publicada e atualizada em até 30 dias após qualquer alteração. Leia o DPA →
Logs de auditoria
Cada ação de chave — criação, rotação, alteração de escopo, exclusão — é registrada com ator, timestamp, IP e hash do corpo da requisição. Exportável para seu SIEM (Splunk, Sentinel, QRadar, Chronicle) via webhook ou Kinesis/Firehose.
BYOK / HSM
Traga sua própria chave. O Plugsky nunca vê sua chave — você a importa para nossa integração HSM (AWS KMS, GCP KMS, Azure Key Vault, HashiCorp Vault, Thales Luna, AWS CloudHSM). Rotação de chaves, revogação e auditoria são todas suas.
Tratamento de PII
Três modos: sem-PII (filtro rigoroso, PII com redação automática), somente-detecção (PII marcada, mas não modificada), passagem (sua responsabilidade). O padrão é somente-detecção para inferência e sem-PII para embeddings. Execute a lista de verificação de residência →
Cobrança
Planos
Taxa mensal fixa por workspace. Todos os modelos do catálogo incluídos em todos os planos pagos — sem cobrança por token, sem cobrança por requisição, sem taxas de excedente, sem surpresas na fatura. Cancele ou faça downgrade a qualquer momento.
| Plano | Taxa mensal | O que está incluído | Melhor para |
|---|---|---|---|
| Free | US$ 0 | Modelos de IA gratuitos (plugsky-micro, plugsky-lite), Playground + Playground Beta, 30 RPM, 500 requisições/dia (uso justo), chaves de API ilimitadas, 1 assento. Recursos pagos (Agents, Tools, RAG, Marketplace, Integrations, Teams) estão bloqueados. | Primeira chamada, avaliação, chat de hobby |
| Trial | US$ 0 / 14 dias | Teste de acesso total: modelos até plugsky-plus, Tools, RAG, Integrations, 60 RPM, chaves de API ilimitadas, sem necessidade de cartão | Avaliar a plataforma completa |
| Hobby | US$ 8 / mês | Todos os modelos, 300 RPM, 1 assento, chaves ilimitadas | Projetos de hobby, desenvolvedores independentes |
| Starter | US$ 20 / mês | Todos os modelos, 600 RPM, 1 assento, chaves ilimitadas | Desenvolvedores solo, projetos paralelos |
| Builder | US$ 60 / mês | Todos os modelos, incl. visão, 1.500 RPM, 5 assentos, chaves ilimitadas | Equipes de produção |
| Scale | US$ 120 / mês | Todos os modelos, incluindo frontier, 5.000 RPM, 25 assentos, chaves ilimitadas, SSO | SaaS de alto volume |
| Enterprise | Contrato anual | Uso ilimitado, 10K+ RPM, assentos ilimitados, on-prem, BYOK, SLA de 99,99%, DPA, BAA, engenheiro dedicado | Bancos, governo, regulados |
A cobrança anual economiza 20% (Hobby: 50%). Os planos Enterprise são contratos anuais com preço conforme sua implantação, segurança e requisitos de volume — mustafa@plugsky.com ou mustafa@plugsky.com · WhatsApp +973 3659 9909.
Plano gratuito — o que você recebe
O plano Free é permanente (US$ 0, sem cartão) e foi criado para testar a plataforma e uso leve:
- Modelos de IA gratuitos —
plugsky-microeplugsky-lite(chat + JSON, uso justo ilimitado, 30 requisições/min). - Playground e Playground Beta — acesso total a chat, comparação de modelos e ferramentas de prompt.
- Acesso à API — chaves de API ilimitadas, endpoint compatível com OpenAI, somente modelos gratuitos.
- Uso e análises, catálogo de modelos, cobrança e configurações da conta.
Bloqueado até você fazer upgrade: modelos pagos (plugsky-plus e superiores), Agent Cloud, Tools & Connectors (function calling), Knowledge / RAG, Model Fusion, Marketplace, Integrations e Teams multiusuário.
Toda nova conta também começa com um teste de acesso total de 14 dias — sem necessidade de cartão — que desbloqueia modelos até plugsky-plus, Tools, RAG e Integrations para que você possa avaliar tudo antes de escolher um plano.
Uso e medição
Uso ilimitado em todos os planos. Sem cobrança por token, sem cobrança por requisição, sem taxas de excedente. O único limite é o RPM de uso justo do seu nível (60 trial · 300 · 600 · 1.500 · 5.000 · 10K+ no Enterprise). As contagens de tokens ainda são retornadas em cada resposta (usage.prompt_tokens, usage.completion_tokens) para observabilidade — mas não geram cobrança.
Faturas e impostos
Cobrança mensal no dia 1º. Faturas em PDF enviadas por e-mail automaticamente. Em conformidade com IVA para EAU (5%), Arábia Saudita (15%), UE (reverse charge) e EUA (sem imposto sobre vendas em SaaS na maioria dos estados). Transferência bancária, ACH, SEPA e principais cartões de crédito. Contratos anuais: preço por implantação, pagamento antecipado.
Cotas e limites
Limites rígidos de US$ no nível do projeto evitam gastos descontrolados. Alertas suaves em 50%, 80%, 95%. Bloqueio rígido em 100% (rejeição automática 402). Você pode definir overage_behavior=allow com uma chave aprovada pelo financeiro para permitir excedente de até 3× o limite com cobrança automática.
Guias de migração
Do OpenAI
- Gere uma chave Plugsky no Dashboard
- No seu código, altere
base_urlparahttps://plugsky.com/v1 - Opcionalmente, mapeie
gpt-4o→plugsky-pro,gpt-4o-mini→plugsky-litepara economizar custos - Execute suas avaliações existentes — devem passar sem alterações
- Alterne o DNS / faça o corte quando estiver pronto
Precisa de um passo a passo de migração por linguagem? Guia completo → ou gere código para sua stack →
Do Anthropic
Roadmap: um endpoint /v1/messages nativo compatível com Anthropic está planejado. Hoje, aponte o modo de compatibilidade com OpenAI do SDK Anthropic para https://plugsky.com/v1 e mapeie claude-3-5-sonnet → plugsky-pro (mesmo nível de qualidade, economia de 40%+).
Do Azure OpenAI
Aponte seu SDK Azure para https://plugsky.com/v1 (o SDK Azure suporta endpoints personalizados). Os modelos mantêm seus nomes Azure com o prefixo azure/. Os filtros de conteúdo existentes e os recursos específicos do Azure têm equivalentes no Plugsky — veja a matriz de compatibilidade completa →
Do AWS Bedrock
Use o parâmetro endpoint_url do SDK Bedrock. Roadmap: um endpoint nativo Bedrock Converse está planejado. Hoje, use o modo compatível com OpenAI do SDK Bedrock com endpoint_url=https://plugsky.com/v1 e IDs de modelo como plugsky-pro.
Referência
Glossário
| Termo | Definição |
|---|---|
| Token | A unidade atômica de cobrança. ~4 caracteres em inglês. ~1,5 caracteres em árabe. |
| Janela de contexto | Máximo de tokens que um modelo pode ver em uma única chamada (entrada + saída). |
| Embedding | Uma representação vetorial de comprimento fixo do texto. Usada para busca semântica. |
| RAG | Geração Aumentada por Recuperação: recupere documentos relevantes, insira no prompt, gere. |
| Function calling | O modelo retorna uma chamada de ferramenta estruturada em vez de texto livre. Você executa e retorna o resultado. |
| Fine-tuning | Continuar o treinamento de um modelo base com seus dados. SFT (supervisionado) ou DPO (preferência). |
| Destilação | Treinar um modelo pequeno para imitar um grande. Mais barato, mais rápido, qualidade semelhante. |
| Agente | Modelo + ferramentas + memória + loop de planejamento. Execução autônoma de tarefas em várias etapas. |
| Armazenamento vetorial | Embeddings indexados para busca rápida de similaridade. O Plugsky inclui um pronto para uso. |
| BYOK | Traga sua própria chave. Você controla as chaves de criptografia. Não podemos ler seus dados. |
| Soberano | Hospedado inteiramente dentro de uma jurisdição, sem acesso estrangeiro. Em conformidade com PDPL. |
Changelog
/changelog — histórico completo de versões. Assine o RSS ou o webhook model.deprecated.
Suporte
- E-mail: support@plugsky.com (24/5 no Builder+, 24/7 no Scale+)
- Slack Connect: para clientes Enterprise
- Horário comercial: chamada comunitária semanal, qui às 16h GST — participe →
- Status: /status
- Problemas de segurança: security@plugsky.com (chave PGP em
/.well-known/security.txt)
Perguntas frequentes
O Plugsky é compatível com OpenAI?
Sim — a API espelha o formato da OpenAI (chat completions, embeddings, models), então os SDKs existentes funcionam após alterar a URL base e a chave de API.
Como obtenho uma chave de API?
Crie uma conta gratuita, abra Dashboard → API Keys e crie uma chave. O plano gratuito inclui dois modelos gratuitos, sem necessidade de cartão de crédito.
Onde reporto um problema com a API?
Inclua o request id da resposta de erro e abra um ticket de suporte pelo dashboard; os tickets são acompanhados e respondidos pela equipe.