Plugsky MCP
Plugsky es un servidor de Model Context Protocol en vivo: conecta ChatGPT, Claude, Cursor, VS Code o Windsurf a 20 herramientas en vivo: cada modelo, búsqueda web, transcripciones de video, audio, visión, generación de imágenes, memoria persistente, navegación y un sandbox de código, a través de una sola URL.
Documentación
Primeros pasos
Cinco minutos desde cero hasta tu primera respuesta del modelo. La API de Plugsky es 100% compatible con OpenAI: cambia tu base_url y tu código existente, SDK y prompts seguirán funcionando.
Instalación
# Python (OpenAI SDK — works as-is)
pip install openai
# Node.js / TypeScript
npm install openai
# Go
go get github.com/sashabaranov/go-openai
# Or use raw HTTP — no SDK required
Tu primera llamada a la API
from openai import OpenAI
client = OpenAI(
api_key="sk-live-…", # your Plugsky key
base_url="https://plugsky.com/v1", # the only line that changes
)
resp = client.chat.completions.create(
model="plugsky-pro",
messages=[{"role": "user", "content": "Say hello in 5 languages"}],
max_tokens=200,
)
print(resp.choices[0].message.content)
Eso es todo. Misma forma de solicitud, misma forma de respuesta, mismo streaming, mismo function-calling, mismo modo JSON. Referencia completa de compatibilidad con OpenAI →
✓
Sustitución directa. Tus clientes existentes de OpenAI en Python, Node, Go, Java, .NET y cURL funcionan sin cambios de código. Herramientas como LangChain, LlamaIndex, Vercel AI SDK y OpenAI Playground son compatibles de primera clase.
Conceptos principales
- Modelo. El motor de inferencia.
plugsky-microhastaplugsky-frontier, más 13+ modelos de terceros (opencode.ai, NVIDIA NIM, Mistral, Cohere, Stability). - Solicitud. Una única llamada a la API. Se cuenta por tokens. Tiene precio.
- Hilo / Ejecución. Conversación multi-turno con estado (API de Assistants).
- Herramienta. Una función que expones al modelo para function-calling.
- Base de conocimiento / Almacén de vectores. Documentos indexados que el modelo puede recuperar (RAG).
- Endpoint / Región. Dónde se ejecuta el modelo.
me-central-1(EAU),eu-west-1,us-east-1, además de VPC de cliente y on-prem.
Autenticación
Plugsky utiliza claves de API con token bearer. Las claves están limitadas por proyecto, por rol y se pueden rotar sin tiempo de inactividad.
Claves de API
Genera claves en el Dashboard → API keys. Cada clave tiene un alcance y un proyecto. Tres roles integrados:
| Rol | Puede hacer | No puede hacer |
|---|---|---|
read | Listar modelos, obtener uso, ver registros de auditoría | Inferencia, creación de claves |
infer | Chat / embeddings / imagen / audio / batch | Administración, facturación, creación de claves |
admin | Todo lo anterior + gestión de claves + facturación + RBAC | Configuración a nivel de organización (solo root) |
Variables de entorno
export PLUGSKY_API_KEY="sk-live-…"
export PLUGSKY_BASE_URL="https://plugsky.com/v1"
export PLUGSKY_PROJECT="prj_8x2…" # optional, defaults to your first project
export PLUGSKY_REGION="me-central-1"
Alcances y roles
Cada clave tiene una lista de alcances separada por comas. Ejemplos: chat:write,embeddings:write,files:read. Usa el alcance más restringido que funcione — las claves de producción nunca deben tener admin.
OAuth 2.0 (aplicaciones de terceros)
Plugsky admite el flujo estándar de código de autorización OAuth 2.0 con PKCE para aplicaciones SaaS que quieran ofrecer "Iniciar sesión con Plugsky" o acceder a los espacios de trabajo de Plugsky de sus usuarios. Lee la guía completa de OAuth →
⚠
Rota las claves trimestralmente. Las claves antiguas siguen siendo válidas durante 24 horas después de la rotación para que los despliegues puedan actualizarse sin interrupciones. Rotar ahora →
Referencia de la API
Cada endpoint, cada parámetro, cada código de estado. Compatible con el espacio de nombres /v1/* de OpenAI; las extensiones específicas de Plugsky están bajo /v1/plugsky/*.
Completions de chat
POST /v1/chat/completions
El endpoint principal de inferencia. Admite streaming, function-calling, modo JSON, salidas estructuradas, visión y uso de herramientas.
Obligatorio: model, messages · Opcional: temperature, top_p, n, stream, stop, max_tokens, presence_penalty, frequency_penalty, tools, tool_choice, response_format, seed, user
from openai import OpenAI
client = OpenAI(api_key="sk-live-…", base_url="https://plugsky.com/v1")
stream = client.chat.completions.create(
model="plugsky-pro",
messages=[{"role": "user", "content": "Write a haiku about GCC summers"}],
stream=True,
temperature=0.7,
)
for chunk in stream:
print(chunk.choices[0].delta.content or "", end="")
Completions heredados
POST/v1/completionspróximamente
Endpoint de completion sin procesar anterior al chat. Compatible hacia atrás. Prefiere /v1/chat/completions para nuevas integraciones.
Embeddings
POST/v1/embeddings
Embeddings vectoriales para búsqueda semántica, RAG, agrupamiento y recomendaciones. Modelos →
resp = client.embeddings.create(
model="plugsky-embed",
input=["Plugsky is a sovereign AI cloud", "GCC banks run on us"],
)
print(len(resp.data[0].embedding), "dimensions") # 2048
Generación de imágenes
POST/v1/images/generationspróximamente
Próximamente — generación de imágenes compatible con OpenAI. Alias de modelo planificados: dall-e-3 (Flux Dev), dall-e-2 (Flux Schnell). El endpoint actualmente devuelve 501 hasta que se habilite un modelo de imagen en el catálogo upstream.
Audio (ASR / TTS)
POST/v1/audio/transcriptionspróximamente
Voz a texto. 99 idiomas, soporte de dialectos árabes, streaming en tiempo real. Modelo whisper-plugsky.
POST/v1/audio/speechpróximamente
Texto a voz. Más de 30 voces, SSML, árabe e inglés, tiempo real.
Moderación
POST/v1/moderationspróximamente
Clasifica texto para contenido dañino. Devuelve puntuaciones por categoría (odio, violencia, sexual, autolesión, PII). Extensión de Plugsky: pii, prompt-injection.
Archivos
POST/v1/filespróximamente
Sube archivos para fine-tuning, batch o ingesta en almacenes vectoriales. Hasta 512 MB por archivo. PDF, DOCX, MD, TXT, JSON, CSV, audio, video.
API de Batch
POST/v1/batchespróximamente
Procesa hasta 50,000 solicitudes de forma asíncrona. SLA de 24 horas, 50% más barato que síncrono. Devuelve resultados en JSONL.
Fine-tuning
POST/v1/fine_tuning/jobspróximamente
Fine-tuning supervisado (SFT) y DPO. Modelos base: plugsky-micro, plugsky-lite, plugsky-pro. Tus datos, tu región, tus claves.
Assistants / Agentes
POST/v1/assistantspróximamente
Agentes con estado compatibles con OpenAI Assistants con herramientas (intérprete de código, búsqueda de archivos, function calling). 100% compatible con la API de OpenAI Assistants.
Function calling / herramientas
Pasa un array tools con definiciones de funciones en JSON-Schema. El modelo devuelve un payload estructurado tool_calls que ejecutas y luego devuelves el resultado. Se admiten llamadas a herramientas en streaming y en paralelo. Genera tu esquema de función →
Responses (con estado)
POST/v1/responsespróximamente
Endpoint con estado compatible con OpenAI Responses. RAG integrado, búsqueda web, intérprete de código y uso de computadora. Recomendado para nuevas construcciones de agentes.
Extensiones de Plugsky
GET/v1/plugsky/usagepróximamente
Uso por clave, por modelo, por día. Devuelve la misma forma utilizada por el Dashboard.
POST/v1/plugsky/routepróximamente
Enrutamiento inteligente — pasa model="auto" y Plugsky elige el mejor modelo para el prompt, tu objetivo de costo y tu objetivo de latencia.
Modelos
Todos los modelos en niveles gratuitos, de pago y de embeddings — servidos detrás de un único endpoint compatible con OpenAI, facturados en una sola factura, gobernados por un solo conjunto de políticas. La tabla se completa en vivo desde GET /v1/models (la única fuente de verdad). Pasa el cursor sobre el icono ⓘ para ver los detalles completos.
| Modelo | Contexto | Mejor para | Nivel |
|---|---|---|---|
| Cargando modelos… | |||
Enrutamiento inteligente y Model Fusion
Dos formas de obtener ahorros de costos automáticamente. Configura model="plugsky-fusion" para usar la cadena predeterminada del dashboard (secuencial, paralela, ahorradora de costos — tú eliges). Para enrutamiento basado en clasificadores usa POST /v1/plugsky/route (por defecto es model="auto"); model="auto" no es aceptado por /v1/chat/completions. Ahorros típicos: 60-80% en tráfico de producción. Consulta Model Fusion en el dashboard para la interfaz completa.
# Option 1: use your configured Fusion chain
resp = client.chat.completions.create(
model="plugsky-fusion", # runs the workspace's default chain
messages=[{"role": "user", "content": "Hello!"}],
)
print(resp.model) # which model actually answered (e.g. "plugsky-micro")
# Option 2: smart routing with cost hint
resp = client.chat.completions.create(
model="auto", # classifier picks the best model
route_hint="cost", # cost | quality | latency
max_cost_per_1m=0.50,
messages=[{"role": "user", "content": "Hello!"}],
)
print(resp.model) # the model Plugsky chose
SDKs
El SDK de OpenAI funciona tal cual. También ofrecemos SDKs propios idiomáticos que añaden características específicas de Plugsky (enrutamiento inteligente, batch, fijación regional).
v2.1.0
Python
3.8+. pip install openai. Configura base_url a Plugsky. Streaming, async, type hints.
v1.4.0
Node.js / TypeScript
18+. npm install openai. Configura baseURL a Plugsky. Navegador, Bun, Deno, Cloudflare Workers.
v0.9.0
Go
1.21+. go get github.com/sashabaranov/go-openai. Configura BaseURL a Plugsky. Consciente del contexto.
v1.1.0
Java / Kotlin
JDK 11+. Maven y Gradle. Coroutines, Reactor, sync.
v0.6.0
Rust
1.74+. cargo add openai. tokio, async-std, sync.
v1.0
cURL y HTTP puro
Cualquier cliente HTTP. Especificación OpenAPI 3.1 publicada en /v1/openapi.json.
Integraciones con frameworks
- LangChain —
ChatOpenAI(base_url="https://plugsky.com/v1") - LlamaIndex —
OpenAI(base_url=…) - Vercel AI SDK —
openai("…", { baseURL: "https://plugsky.com/v1" }) - Haystack —
OpenAIGenerator(api_base=…) - Semantic Kernel —
OpenAIChatCompletion(…endpoint=…) - AutoGen —
OpenAIWrapper(base_url=…) - OpenAI Playground — Campo de URL base personalizada. Probado diariamente.
Ejemplo: streaming con contrapresión
import openai
client = openai.OpenAI(api_key="sk-live-…", base_url="https://plugsky.com/v1")
with client.chat.completions.stream(
model="plugsky-pro",
messages=[{"role":"user","content":"Tell me a 500-word story about Plugsky"}],
) as stream:
for text in stream.text_stream:
print(text, end="", flush=True)
final = stream.get_final_completion()
print("\n--- usage:", final.usage)
Software oficial e instaladores
Aplicaciones de escritorio, CLI y autoalojadas de primera parte — todas de código abierto bajo MIT / Apache-2.0, con la marca Plugsky y preconfiguradas para hablar con la API de Plugsky. Instala con un solo comando.
Plugsky CLI
Agente nativo de codificación por IA en terminal — binario único compilado con Bun con bucle de agente integrado, edición de archivos, sandbox de shell, cliente MCP, indexación RAG y enrutamiento automático de modelos. Sin necesidad de configuración de proveedor — solo plugsky login.
# macOS / Linux (one-line install)
curl -fsSL https://plugsky.com/install | sh
# Authenticate
plugsky login
# One-shot agentic task
plugsky "explain this project"
# Interactive TUI (REPL)
plugsky
Referencia rápida:
plugsky "add tests" | Tarea agéntica de un solo uso |
|---|---|
plugsky | Abrir TUI interactivo |
plugsky chat "hi" | Respuesta en streaming, sin herramientas |
plugsky models | Listar escalera de modelos |
plugsky index | Construir índice RAG |
plugsky -m auto "task" | Enrutamiento automático de modelos |
plugsky --resume | Reanudar última sesión |
Modos de aprobación: suggest (pide confirmación para ediciones + shell) · auto-edit (ediciones automáticas, pide confirmación para shell) · full-auto (sin confirmaciones)
Ver en GitHub → · Guía de usuario completa → · Documentación CLI del Dashboard →
Plugsky Desktop (basado en Jan)
Cliente nativo de chat con IA para macOS, Linux, Windows. Construido sobre el proyecto de código abierto Jan (Apache-2.0). Con la marca Plugsky, preconfigurado con plugsky-pro como modelo predeterminado.
curl -fsSL https://plugsky.com/install-desktop | bash
plugsky-desktop
Disponible para macOS (Apple Silicon + Intel), Linux (x64), Windows (x64).
Plugsky Web (basado en Open WebUI)
Interfaz de chat con IA autoalojada en tu navegador. Construido sobre el proyecto de código abierto Open WebUI. Docker o instalación con pip, ambos backends compatibles. El modelo plugsky-fusion está prelistado.
curl -fsSL https://plugsky.com/install-web | bash
plugsky-web start
# → opens http://localhost:8080
Últimas versiones (Plugsky CLI v0.1.2 — 2026-07-05)
[
v0.1.2
Plugsky CLI
macOS arm64, macOS x64, Linux x64, Linux arm64, Windows x64, Windows arm64. curl -fsSL https://plugsky.com/install | bash
](https://github.com/coinplannet/plugskyCLI/releases/tag/v0.1.2)[
v0.1.0
Plugsky Desktop (Jan)
macOS arm64/x64 (universal), Linux x64 AppImage, Windows x64 instalador. ~150 MB. curl -fsSL https://plugsky.com/install-desktop | bash
](https://github.com/coinplannet/plugskyCLI/releases)[
v0.1.0
Plugsky Web (Open WebUI)
Imagen Docker (1.5 GB) o instalación con pip. curl -fsSL https://plugsky.com/install-web | bash
](https://github.com/coinplannet/plugskyCLI/releases)
Los tres tienen licencia MIT. Consulta NOTICE para la atribución completa upstream.
Operaciones
Límites de tasa y cuotas
Todos los planes incluyen uso ilimitado dentro de los límites de tasa de uso justo — sin cargos por token, sin cargos por solicitud, sin cargos por exceso. El único límite es la tasa de solicitudes por minuto (RPM) de tu nivel. Aumenta los límites desde el Dashboard o enviando un correo a support@plugsky.com.
| Plan | Cuota mensual | RPM de uso justo | Concurrentes | Claves de API | Asientos |
|---|---|---|---|---|---|
| Gratuito | $0 / 14 días | 60 | 5 | Ilimitadas | 1 |
| Hobby | $8 / mes | 300 | 5 | Ilimitadas | 1 |
| Starter | $20 / mes | 600 | 10 | Ilimitadas | 1 |
| Builder | $60 / mes | 1,500 | 50 | Ilimitadas | 5 |
| Scale | $120 / mes | 5,000 | 200 | Ilimitadas | 25 |
| Enterprise | Contrato anual | Personalizado (10K+) | Personalizado | Ilimitadas | Ilimitados |
Misma tarifa plana en todos los modelos — sin precios separados para plugsky-frontier vs plugsky-micro. Cada modelo del catálogo está incluido en todos los planes de pago. ¿Recibiste un 429? La respuesta incluye un encabezado Retry-After. Los SDKs reintentan con backoff exponencial automáticamente.
MCP (Model Context Protocol)
Plugsky ofrece un endpoint MCP remoto y un servidor stdio local, para que ChatGPT, Claude, Cursor, VS Code, Windsurf y Zed puedan usar tus modelos, colecciones RAG, herramientas de plataforma e ingesta de documentos directamente.
- Remoto (HTTP Streamable):
https://plugsky.com/mcpconAuthorization: Bearer sk-live-…— herramientas:plugsky_chat,plugsky_models,plugsky_fusion. Abre plugsky.com/mcp para la tarjeta del servidor y ejemplos en vivo. - Local (stdio):
npx -y @plugsky/mcpconPLUGSKY_API_KEY(los grupos RAG/uso/herramientas/archivos también necesitanPLUGSKY_EMAIL/PLUGSKY_PASSWORD). Filtra herramientas con--groups=chat,models,rag,usage,tools,files. - Configuraciones listas: Dashboard → AI → MCP Servers (conectores para Claude Desktop, Cursor, Windsurf, VS Code, ChatGPT).
Reintentos e idempotencia
Todos los endpoints de POST aceptan un encabezado Idempotency-Key. Reenviar la misma clave devuelve el resultado en caché durante 24 horas. Esto hace que tus POSTs sean seguros de reintentar sin doble facturación ni creación duplicada de recursos.
curl -X POST https://plugsky.com/v1/chat/completions \
-H "Authorization: Bearer $PLUGSKY_API_KEY" \
-H "Idempotency-Key: $(uuidgen)" \
-H "Content-Type: application/json" \
-d '{"model":"plugsky-pro","messages":[{"role":"user","content":"hello"}]}'
Errores y códigos de estado
| Código | Significado | Qué hacer |
|---|---|---|
400 | Solicitud incorrecta: JSON malformado, parámetro inválido | Validar localmente antes de enviar |
401 | Clave API inválida o faltante | Verificar el encabezado Authorization |
403 | La clave carece del alcance requerido | Verificar el rol de la clave en el Panel |
404 | Modelo o recurso no encontrado | Listar /v1/models para ver qué está disponible |
409 | Conflicto (clave de idempotencia duplicada con cuerpo diferente) | Generar una clave nueva por solicitud lógica |
429 | Límite de velocidad alcanzado | Respetar Retry-After |
413 | Cuerpo de solicitud > 16 MB | Recortar el historial de conversación o dividir la solicitud |
400 (contexto) | Ventana de contexto excedida | El mensaje incluye recuentos exactos de tokens: reduce el historial o max_tokens |
500 | Error interno | Reintentar con retroceso. Abrir un ticket si persiste. |
502 | Fallo del proveedor ascendente (después de conmutación automática) | Reintentar con retroceso. Página de estado: /status |
503 | Proveedor ascendente caído | Las solicitudes con enrutamiento inteligente conmutan automáticamente |
Todos los errores de API usan el esquema de error de OpenAI: {"error":{"message","type","code","param"}} — solo JSON, nunca HTML. El cuerpo máximo de solicitud es de 16 MB.
Webhooks
Suscríbete a 9 tipos de eventos: batch.completed, fine_tuning.completed, invoice.paid, key.rotated, quota.warning, quota.exceeded, model.deprecated, usage.threshold, audit.alert. Firmados con HMAC-SHA256. Configúralos en Panel → Webhooks.
Registros y observabilidad
Cada solicitud se registra con: marca de tiempo, modelo, tokens, latencia, estado, ID de clave, ID de proyecto, región, ID de solicitud, etiqueta opcional user. Exporta a Datadog, Splunk, Grafana, New Relic, OpenTelemetry o tu SIEM.
Estado y SLA
Estado en vivo: /status. Historial público de incidentes. SLA de disponibilidad:
- Builder / Scale: 99.9% de disponibilidad mensual, 10% de crédito en caso de incumplimiento
- Enterprise: 99.95% de disponibilidad mensual, 25% de crédito, 99.99% en implementaciones multirregión
Topologías de implementación
Misma API, cuatro modelos de implementación. Elige uno o combínalos entre equipos.
DEFAULT
Plugsky Cloud
SaaS multiinquilino. me-central-1 (EAU) principal, eu-west-1, us-east-1, ap-southeast-1. Lo más rápido para comenzar.
ENTERPRISE
Implementación en VPC
Plugsky se ejecuta dentro de tu VPC de AWS / GCP / Azure / OCI. Tu red, tu interconexión, tu KMS, tus claves.
REGULATED
En las instalaciones
Gráfico de Helm o instalador de aislamiento para tu centro de datos. Grupo de GPU: H100, H200, MI300X o solo CPU.
SOVEREIGN
Aislado
Sin internet en absoluto. El paquete se envía en medios físicos. Actualización mensual de modelos por mensajería.
FINANCIAL
Trae tu propia nube
El plano de control de Plugsky se ejecuta en nuestra nube; la inferencia se ejecuta en tu cuenta de nube. Pagas a tu hiperescalador directamente.
SAAS
Etiqueta blanca
Tu marca en el panel, tu dominio, tus colores. Revende IA bajo tu propio SKU.
Matriz de decisión
| Necesitas… | Usa |
|---|---|
| Lanzar en 1 día, sin cumplimiento | Plugsky Cloud |
| Los datos permanecen en me-central-1 | Plugsky Cloud (región fijada) |
| Ningún dato sale de tu cuenta de AWS / Azure / GCP | Implementación en VPC |
| Rastro de auditoría SAMA / CBUAE / NSD | Implementación en VPC + claves administradas por el cliente |
| Aislamiento, sin internet | En las instalaciones o aislado |
| Revender IA bajo tu marca | Etiqueta blanca |
Seguridad y cumplimiento
Modelo de seguridad
- Cifrado en tránsito: solo TLS 1.3, HSTS, cifrados modernos
- Cifrado en reposo: AES-256-GCM, claves administradas por el cliente disponibles
- Aislamiento de red: VPC por inquilino, grupos de seguridad, sin kernel compartido
- Aislamiento de inquilinos: lógico (RBAC + claves con alcance) o físico (tu propio clúster)
- Higiene de secretos: las claves nunca se registran, nunca se devuelven en respuestas, con hash en reposo con Argon2id
- Pruebas de penetración: trimestrales por HackerOne + una firma externa. Informes bajo NDA.
- Programa de recompensas: hasta $25,000. security@plugsky.com
Residencia de datos
Elige por solicitud o fija globalmente. Regiones: me-central-1 (EAU — GCC predeterminado), sa-central-1 (Riad — Enterprise), eu-west-1 (Dublín), eu-central-1 (Fráncfort), us-east-1, us-west-2, ap-southeast-1 (Singapur). Los datos nunca salen de la región fijada. Inmersión profunda →
Cumplimiento y certificaciones
- SOC 2 Tipo II — auditado anualmente, informe bajo NDA
- ISO 27001 — Gestión de seguridad de la información
- ISO 27701 — Gestión de privacidad
- ISO 27017 / 27018 — Nube y PII
- GDPR — Protección de datos de la UE
- HIPAA — Salud (Enterprise + BAA)
- PCI DSS — Seguridad de datos de tarjetas (sin inferencia sobre datos de tarjetas salvo en las instalaciones)
- FedRAMP Moderado — En proceso, disponible en Enterprise
- PDPL de EAU — Ley Federal de Protección de Datos
- DPL de DIFC — Centro Financiero Internacional de Dubái
- SAMA CSF — Marco cibernético del Banco Central de Arabia Saudita
- NSD — Alineación con la Directiva de Seguridad Nacional (Enterprise en las instalaciones)
DPA y legal
Cláusulas Contractuales Estándar (SCC) integradas en el DPA. Lista de subprocesadores publicada y actualizada dentro de los 30 días posteriores a cualquier cambio. Lee el DPA →
Registros de auditoría
Cada acción de clave — creación, rotación, cambio de alcance, eliminación — se registra con actor, marca de tiempo, IP y hash del cuerpo de la solicitud. Exportable a tu SIEM (Splunk, Sentinel, QRadar, Chronicle) mediante webhook o Kinesis/Firehose.
BYOK / HSM
Trae tu propia clave. Plugsky nunca ve tu clave: la importas a nuestra integración HSM (AWS KMS, GCP KMS, Azure Key Vault, HashiCorp Vault, Thales Luna, AWS CloudHSM). Rotación de claves, revocación y auditoría, todo tuyo.
Manejo de PII
Tres modos: sin PII (filtro estricto, PII redactada automáticamente), solo detección (PII etiquetada pero no modificada), passthrough (tu responsabilidad). El predeterminado es solo detección para inferencia, sin PII para incrustaciones. Ejecuta la lista de verificación de residencia →
Facturación
Planes
Tarifa mensual fija por espacio de trabajo. Cada modelo del catálogo incluido en cada plan de pago — sin cargos por token, sin cargos por solicitud, sin tarifas por exceso, sin facturas sorpresa. Cancela o cambia a un plan inferior en cualquier momento.
| Plan | Tarifa mensual | Qué incluye | Mejor para |
|---|---|---|---|
| Gratis | $0 | Modelos de IA gratuitos (plugsky-micro, plugsky-lite), Playground + Playground Beta, 30 RPM, 500 solicitudes/día (uso justo), claves API ilimitadas, 1 asiento. Las funciones de pago (Agentes, Herramientas, RAG, Marketplace, Integraciones, Equipos) están bloqueadas. | Primera llamada, evaluación, chat de pasatiempo |
| Prueba | $0 / 14 días | Prueba de acceso completo: modelos hasta plugsky-plus, Herramientas, RAG, Integraciones, 60 RPM, claves API ilimitadas, sin tarjeta requerida | Evaluar la plataforma completa |
| Hobby | $8 / mes | Cada modelo, 300 RPM, 1 asiento, claves ilimitadas | Proyectos de pasatiempo, desarrolladores independientes |
| Starter | $20 / mes | Cada modelo, 600 RPM, 1 asiento, claves ilimitadas | Desarrolladores solitarios, proyectos secundarios |
| Builder | $60 / mes | Cada modelo incl. visión, 1,500 RPM, 5 asientos, claves ilimitadas | Equipos de producción |
| Scale | $120 / mes | Cada modelo incl. frontera, 5,000 RPM, 25 asientos, claves ilimitadas, SSO | SaaS de alto volumen |
| Enterprise | Contrato anual | Uso ilimitado, 10K+ RPM, asientos ilimitados, en las instalaciones, BYOK, SLA 99.99%, DPA, BAA, ingeniero dedicado | Bancos, gobierno, regulados |
La facturación anual ahorra 20% (Hobby: 50%). Los planes Enterprise son contratos anuales con precios según tu implementación, seguridad y requisitos de volumen — mustafa@plugsky.com o mustafa@plugsky.com · WhatsApp +973 3659 9909.
Plan gratuito — qué obtienes
El plan Gratuito es permanente ($0, sin tarjeta) y está diseñado para probar la plataforma y uso ligero:
- Modelos de IA gratuitos —
plugsky-microyplugsky-lite(chat + JSON, uso justo ilimitado, 30 solicitudes/min). - Playground y Playground Beta — acceso completo a chat, comparar modelos y herramientas de prompts.
- Acceso API — claves API ilimitadas, endpoint compatible con OpenAI, solo modelos gratuitos.
- Uso y análisis, catálogo de modelos, configuración de facturación y cuenta.
Bloqueado hasta que actualices: modelos de pago (plugsky-plus y superiores), Agent Cloud, Herramientas y Conectores (llamada de funciones), Conocimiento / RAG, Model Fusion, Marketplace, Integraciones y Equipos multiasiento.
Cada cuenta nueva también comienza con una prueba de acceso completo de 14 días — sin tarjeta requerida — que desbloquea modelos hasta plugsky-plus, Herramientas, RAG e Integraciones para que puedas evaluar todo antes de elegir un plan.
Uso y medición
Uso ilimitado en cada plan. Sin cargos por token, sin cargos por solicitud, sin tarifas por exceso. El único límite es el RPM de uso justo para tu nivel (60 prueba · 300 · 600 · 1,500 · 5,000 · 10K+ en Enterprise). Los recuentos de tokens aún se devuelven en cada respuesta (usage.prompt_tokens, usage.completion_tokens) para observabilidad — pero no impulsan la facturación.
Facturas e impuestos
Facturación mensual el día 1. Facturas en PDF enviadas automáticamente por correo. Cumplimiento de IVA para EAU (5%), KSA (15%), UE (cargo inverso) y EE. UU. (sin impuesto a las ventas en SaaS en la mayoría de los estados). Transferencia bancaria, ACH, SEPA y principales tarjetas de crédito. Contratos anuales: precio por implementación, pagados por adelantado.
Cuotas y límites
Límites duros de $ a nivel de proyecto evitan gastos descontrolados. Alertas suaves de advertencia al 50%, 80%, 95%. Bloqueo duro al 100% (rechazo automático 402). Puedes configurar overage_behavior=allow con una clave aprobada por finanzas para permitir exceso hasta 3× el límite con facturación automática.
Guías de migración
Desde OpenAI
- Genera una clave de Plugsky en el Panel
- En tu código, cambia
base_urlahttps://plugsky.com/v1 - Opcionalmente mapea
gpt-4o→plugsky-pro,gpt-4o-mini→plugsky-litepara ahorrar costos - Ejecuta tus evaluaciones existentes — deberían pasar sin cambios
- Cambia DNS / corta cuando estés listo
¿Necesitas una guía de migración por lenguaje? Guía completa → o genera código para tu stack →
Desde Anthropic
Hoja de ruta: se planea un endpoint nativo compatible con Anthropic /v1/messages. Hoy, apunta el modo de compatibilidad con OpenAI del SDK de Anthropic a https://plugsky.com/v1 y mapea claude-3-5-sonnet → plugsky-pro (mismo nivel de calidad, 40%+ de ahorro).
Desde Azure OpenAI
Apunta tu SDK de Azure a https://plugsky.com/v1 (el SDK de Azure admite endpoints personalizados). Los modelos mantienen sus nombres de Azure con el prefijo azure/. Los filtros de contenido existentes y las funciones específicas de Azure tienen equivalentes en Plugsky — consulta la matriz de compatibilidad completa →
Desde AWS Bedrock
Usa el parámetro endpoint_url del SDK de Bedrock. Hoja de ruta: se planea un endpoint nativo de Bedrock Converse. Hoy, usa el modo compatible con OpenAI del SDK de Bedrock con endpoint_url=https://plugsky.com/v1 e IDs de modelo como plugsky-pro.
Referencia
Glosario
| Término | Definición |
|---|---|
| Token | La unidad atómica de facturación. ~4 caracteres en inglés. ~1.5 caracteres en árabe. |
| Ventana de contexto | Máximo de tokens que un modelo puede ver en una sola llamada (entrada + salida). |
| Incrustación | Representación vectorial de longitud fija del texto. Se usa para búsqueda semántica. |
| RAG | Generación aumentada por recuperación: recupera documentos relevantes, los inserta en el prompt, genera. |
| Llamada de funciones | El modelo devuelve una llamada de herramienta estructurada en lugar de texto libre. Tú ejecutas, devuelves el resultado. |
| Ajuste fino | Continuar entrenando un modelo base con tus datos. SFT (supervisado) o DPO (preferencia). |
| Destilación | Entrenar un modelo pequeño para imitar a uno grande. Más barato, más rápido, calidad similar. |
| Agente | Modelo + herramientas + memoria + bucle de planificación. Ejecución autónoma de tareas de múltiples pasos. |
| Almacén vectorial | Incrustaciones indexadas para búsqueda rápida de similitud. Plugsky incluye uno listo para usar. |
| BYOK | Trae tu propia clave. Tú controlas las claves de cifrado. No podemos leer tus datos. |
| Soberano | Alojado completamente dentro de una jurisdicción, sin acceso extranjero. Cumple con PDPL. |
Registro de cambios
/changelog — historial completo de versiones. Suscríbete al RSS o al webhook de model.deprecated.
Soporte
- Correo electrónico: support@plugsky.com (24/5 en Builder+, 24/7 en Scale+)
- Slack Connect: para clientes Enterprise
- Horario de oficina: llamada comunitaria semanal, jueves 4pm GST — únete →
- Estado: /status
- Problemas de seguridad: security@plugsky.com (clave PGP en
/.well-known/security.txt)
Preguntas frecuentes
¿Plugsky es compatible con OpenAI?
Sí — la API replica la forma de OpenAI (chat completions, embeddings, models), por lo que los SDK existentes funcionan tras cambiar la URL base y la clave de API.
¿Cómo obtengo una clave de API?
Crea una cuenta gratuita, abre Dashboard → API Keys y crea una clave. El plan gratuito incluye dos modelos gratuitos sin necesidad de tarjeta de crédito.
¿Dónde reporto un problema con la API?
Incluye el request id de la respuesta de error y abre un ticket de soporte desde el panel; los tickets se rastrean y son respondidos por el equipo.