Photoshoot AI Design

Servidor MCP oficial de Photoshoot.app. Genera fotos de producto con IA de calidad de estudio, ideas para sesiones de fotos y visuales comerciales directamente desde Claude, Cursor, Codex y otros clientes MCP.

Documentación

PhotoShoot AI Design

License: MIT MCP Claude Code Pi Agent OpenLLM

Herramientas de diseño fotográfico impulsadas por IA con servidores MCP, habilidades reutilizables y agentes inteligentes. Compatible con WaveSpeed AI, Nano Banana, OpenAI, Stability AI e integración con PhotoShoot App.

Configuración rápida → | Documentación → | Ejemplos →

Descripción general

PhotoShoot AI Design extiende la plataforma photoshoot.app con capacidades avanzadas de agentes de IA a través del Protocolo de Contexto de Modelos (MCP). Este proyecto proporciona una interfaz unificada para múltiples servicios de generación de imágenes por IA, permitiendo la automatización de sesiones fotográficas sin interrupciones para:

  • Comercio electrónico - Fotografía de productos para Amazon, Shopify y tiendas en línea
  • Moda - Contenido OOTD (Atuendo del Día) para redes sociales
  • Marketing - Visuales para campañas y contenido de marca
  • Retratos - Retratos profesionales y marca personal

Características

Integración de Proveedores de IA

Cambia sin problemas entre múltiples proveedores de IA:

ProveedorModelosIdeal paraPrecios
WaveSpeed AIMás de 700 modelos, incluyendo FLUX, Stable Diffusion, Kling, Veo, SoraFotografía de productos, contenido de videoTarifas competitivas
Nano BananaGeneración de imágenes nativa de Google GeminiModa, OOTD, estilo de vida~$0.02/imagen
OpenAIDALL-E 3, GPT-4Retratos profesionales, conceptos creativosPrecios estándar de OpenAI
Stability AIStable Diffusion XLEstilos personalizados, contenido artístico$0.004-$0.02/imagen
PhotoShoot AppModelos de sesión fotográfica propietariosComercio electrónico, consistencia de marcaPrecios de plataforma
fal.aiInferencia rápidaPrototipado rápido, procesamiento por lotesPago por uso

Herramientas MCP

Conjunto completo de herramientas del Protocolo de Contexto de Modelos:

  • photoshoot_generate - Genera fotos con IA a partir de texto o imágenes de referencia
  • photoshoot_edit - Edita y mejora imágenes existentes
  • photoshoot_template - Obtén plantillas y estilos disponibles
  • photoshoot_batch - Procesa múltiples imágenes en lote
  • photoshoot_variations - Genera variaciones de imágenes
  • photoshoot_upscale - Aumenta la resolución de imágenes

Sistema de Habilidades

Habilidades modulares y reutilizables para flujos de trabajo de diseño comunes:

HabilidadDescripciónCasos de uso
product-photographyGeneración profesional de fotos de productosComercio electrónico, listados de productos, catálogos
ootd-fashionCreación de contenido de moda y estilo de vidaInstagram, TikTok, moda en Pinterest
image-enhancementEdición y retoque de fotos con IAPostprocesamiento, optimización
brand-styleGeneración de visuales consistentes con la marcaCampañas, materiales de marketing
batch-productionProcesamiento por lotes de alto volumenProducción de catálogos, operaciones masivas

Agentes de IA

Agentes autónomos para flujos de trabajo complejos:

DesignerAgent

  • Analiza imágenes de referencia y extrae parámetros de estilo
  • Genera fotos basadas en pautas de marca
  • Crea contenido específico para plataformas (Amazon, Instagram, TikTok)
  • Gestiona bibliotecas de plantillas

OptimizerAgent

  • Mejora de imágenes por lotes
  • Optimización para plataformas (Amazon, Shopify, redes sociales)
  • Eliminación y reemplazo de fondos
  • Marcas de agua y formato

Instalación

Inicio rápido (3 minutos)

# Clone the repository
git clone git@github.com:photoshootapp/photoshoot-ai-design.git
cd photoshoot-ai-design

# Install dependencies
npm install

# Configure API keys
cp .env.example .env
# Edit .env and add your API keys

# Start MCP server
npm run mcp:start

Consulta SETUP.md para instrucciones detalladas de configuración y obtención de claves API.

Plugin para Claude Code

# Install from plugin marketplace
claude plugin install photoshoot-ai-design

# Or manually configure in .claude/settings.json
{
  "mcpServers": {
    "photoshoot": {
      "command": "node",
      "args": ["packages/mcp-server/dist/index.js"],
      "cwd": "/path/to/photoshoot-ai-design"
    }
  }
}

Plugin para Pi Agent

pi-agent plugin add photoshoot-ai-design

Plugin para OpenLLM

import openllm

plugin = openllm.load_plugin("photoshoot-ai-design")
model = openllm.start("vllm/nano-banana", plugins=[plugin])

Uso

Ejemplos de Herramientas MCP

// Generate product photography
await mcpClient.callTool({
  name: "photoshoot_generate",
  arguments: {
    type: "product",
    provider: "wavespeed",
    prompt: "Professional product photo of wireless headphones",
    style: "studio",
    quantity: 4
  }
});

// Generate OOTD fashion content
await mcpClient.callTool({
  name: "photoshoot_generate",
  arguments: {
    type: "ootd",
    provider: "nano-banana",
    prompt: "Streetwear fashion photoshoot, urban setting",
    style: "vibrant",
    quantity: 6
  }
});

// Edit and enhance images
await mcpClient.callTool({
  name: "photoshoot_edit",
  arguments: {
    image: "https://example.com/product.jpg",
    provider: "auto",
    edits: {
      lighting: "studio",
      background: "white",
      retouch: true
    }
  }
});

Ejemplos de Habilidades

# Product photography
/photoshoot-design product --reference="product.jpg" --style=studio --platform=amazon

# OOTD fashion
/photoshoot-design ootd --reference="outfit.jpg" --style=streetwear --location=urban

# Image enhancement
/photoshoot-design enhance --image="photo.jpg" --intensity=medium

Ejemplos de Agentes

import { DesignerAgent, createPhotoShootClient } from '@photoshoot/agents';

const client = await createPhotoShootClient();
const agent = new DesignerAgent(client, {
  defaultStyle: 'studio',
  defaultQuantity: 4
});

// Generate product photography
await agent.generateProductPhotography({
  productImage: 'shoe.jpg',
  style: 'minimalist',
  platform: 'amazon',
  quantity: 8
});

// Create OOTD content
await agent.createOOTDContent({
  outfitImage: 'outfit.jpg',
  style: 'luxury',
  location: 'rooftop',
  vibe: 'chic'
});

// Optimize for platforms
await agent.optimizeForPlatform({
  images: ['img1.jpg', 'img2.jpg'],
  platform: 'instagram'
});

Arquitectura

photoshoot-ai-design/
├── packages/
│   ├── mcp-server/          # MCP server with all AI providers
│   │   ├── src/
│   │   │   ├── api/clients/ # Individual API clients
│   │   │   │   ├── wavespeed.ts
│   │   │   │   ├── nanobanana.ts
│   │   │   │   ├── openai.ts
│   │   │   │   ├── stability.ts
│   │   │   │   ├── photoshoot.ts
│   │   │   │   └── fal.ts
│   │   │   ├── config.ts
│   │   │   └── index.ts
│   │   └── .env.example
│   │
│   ├── mcp-client/          # MCP client SDK
│   ├── skills/              # Skill definitions (Markdown)
│   ├── agents/              # AI agent implementations
│   │
│   └── plugins/
│       ├── claude-code/     # Claude Code plugin
│       ├── pi-agent/        # Pi Agent plugin
│       └── openllm/         # OpenLLM plugin
│
├── docs/                    # Documentation
├── examples/                # Usage examples
├── .env.example             # Environment configuration template
├── SETUP.md                 # Quick setup guide
└── README.md                # This file

Referencia de API

Herramientas MCP

photoshoot_generate

Genera imágenes de sesiones fotográficas usando IA.

{
  type: 'product' | 'ootd' | 'portrait',
  provider?: 'wavespeed' | 'nano-banana' | 'openai' | 'stability' | 'auto',
  prompt: string,
  reference?: string,
  style?: string,
  quantity?: number,
  width?: number,
  height?: number
}

photoshoot_edit

Edita y mejora imágenes.

{
  image: string,
  provider?: 'wavespeed' | 'nano-banana' | 'openai' | 'stability' | 'auto',
  prompt?: string,
  edits?: {
    lighting?: string,
    background?: string,
    retouch?: boolean,
    enhance?: boolean
  }
}

photoshoot_batch

Procesa múltiples imágenes en lote.

{
  images: string[],
  operation: 'enhance' | 'resize' | 'format' | 'watermark' | 'remove-background',
  options?: Record<string, unknown>
}

Configuración

Variables de Entorno

# WaveSpeed AI (recommended for product photography)
WAVESPEED_API_KEY=your_key_here
WAVESPEED_API_URL=https://api.wavespeed.ai/v1

# Nano Banana (Google Gemini - recommended for fashion)
NANO_BANANA_API_KEY=your_key_here
NANO_BANANA_API_URL=https://generativelanguage.googleapis.com/v1beta

# OpenAI (DALL-E)
OPENAI_API_KEY=your_key_here
OPENAI_API_URL=https://api.openai.com/v1

# Stability AI (Stable Diffusion)
STABILITY_API_KEY=your_key_here
STABILITY_API_URL=https://api.stability.ai/v1

# PhotoShoot App
PHOTOSHOOT_API_KEY=your_key_here
PHOTOSHOOT_API_URL=https://api.photoshoot.app

# fal.ai
FAL_API_KEY=your_key_here
FAL_API_URL=https://fal.ai

Selección de Proveedor

El sistema selecciona automáticamente el mejor proveedor según:

  1. Claves API disponibles - Solo se utilizan los proveedores configurados
  2. Tipo de contenido - Diferentes proveedores destacan en diferentes tipos
  3. Preferencia del usuario - Anulación manual disponible

Lógica de selección automática:

  • Fotografía de productos → WaveSpeed AI
  • Moda/OOTD → Nano Banana
  • Retratos → OpenAI DALL-E
  • Estilos personalizados → Stability AI
  • Respaldo → PhotoShoot App (modo demo sin clave API)

Contribuciones

¡Agradecemos las contribuciones! Consulta CONTRIBUTING.md para las pautas.

Áreas para Contribuir

  • Nuevas integraciones de proveedores de IA
  • Definiciones adicionales de habilidades
  • Mejoras en las capacidades de los agentes
  • Soporte de plugins para otras plataformas
  • Documentación y ejemplos

Desarrollo

# Install dependencies
npm install

# Build all packages
npm run build

# Run MCP server
npm run mcp:start

# Run tests
npm test

# Development mode with hot reload
npm run dev

Rendimiento

  • Procesamiento por lotes: Procesa hasta 100 imágenes simultáneamente
  • Caché automática: Reduce llamadas API redundantes con caché inteligente
  • Solicitudes concurrentes: Límites de solicitudes concurrentes configurables
  • Protección de tiempo de espera: Tiempo de espera integrado para todas las llamadas API

Hoja de ruta

  • Soporte de generación de video (Kling, Veo, Sora vía WaveSpeed)
  • Generación de modelos 3D
  • Funciones de edición avanzada (inpainting, outpainting)
  • Transferencia de estilo en tiempo real
  • Integración con aplicaciones móviles
  • Integración con almacenamiento en la nube
  • Funciones de colaboración en equipo

Licencia

Licencia MIT - consulta LICENSE para más detalles.

Enlaces

Soporte

Agradecimientos

Construido con:


Construido con ❤️ para la comunidad de fotografía con IA