Photoshoot AI Design

Servidor MCP oficial do Photoshoot.app. Gere fotos de produtos com IA em qualidade de estúdio, ideias de ensaios fotográficos e visuais comerciais diretamente do Claude, Cursor, Codex e outros clientes MCP.

Documentação

PhotoShoot AI Design

License: MIT MCP Claude Code Pi Agent OpenLLM

Ferramentas de design de fotografia com IA, alimentadas por servidores MCP, habilidades reutilizáveis e agentes inteligentes. Suporta integração com WaveSpeed AI, Nano Banana, OpenAI, Stability AI e PhotoShoot App.

Configuração Rápida → | Documentação → | Exemplos →

Visão Geral

O PhotoShoot AI Design estende a plataforma photoshoot.app com capacidades avançadas de agentes de IA através do Model Context Protocol (MCP). Este projeto fornece uma interface unificada para múltiplos serviços de geração de imagens com IA, permitindo automação contínua de sessões de fotografia para:

  • E-commerce - Fotografia de produtos para Amazon, Shopify e lojas online
  • Moda - Conteúdo OOTD (Look do Dia) para redes sociais
  • Marketing - Visuais de campanhas e conteúdo de marca
  • Retratos - Headshots profissionais e branding pessoal

Recursos

Integração de Provedores de IA

Alterne facilmente entre múltiplos provedores de IA:

ProvedorModelosMelhor ParaPreço
WaveSpeed AIMais de 700 modelos, incluindo FLUX, Stable Diffusion, Kling, Veo, SoraFotografia de produtos, conteúdo em vídeoTaxas competitivas
Nano BananaGeração de imagens nativa do Google GeminiModa, OOTD, estilo de vida~$0,02/imagem
OpenAIDALL-E 3, GPT-4Retratos profissionais, conceitos criativosPreço padrão da OpenAI
Stability AIStable Diffusion XLEstilos personalizados, conteúdo artístico$0,004-$0,02/imagem
PhotoShoot AppModelos proprietários de fotografiaE-commerce, consistência de marcaPreço da plataforma
fal.aiInferência rápidaPrototipagem rápida, processamento em lotePagamento por uso

Ferramentas MCP

Conjunto completo de ferramentas do Model Context Protocol:

  • photoshoot_generate - Gere fotos com IA a partir de texto ou imagens de referência
  • photoshoot_edit - Edite e aprimore imagens existentes
  • photoshoot_template - Obtenha modelos e estilos disponíveis
  • photoshoot_batch - Processe múltiplas imagens em lote
  • photoshoot_variations - Gere variações de imagens
  • photoshoot_upscale - Aumente a resolução de imagens

Sistema de Habilidades

Habilidades modulares e reutilizáveis para fluxos de trabalho de design comuns:

HabilidadeDescriçãoCasos de Uso
product-photographyGeração profissional de fotos de produtosE-commerce, listagens de produtos, catálogos
ootd-fashionCriação de conteúdo de moda e estilo de vidaModa no Instagram, TikTok, Pinterest
image-enhancementEdição e retoque de fotos com IAPós-processamento, otimização
brand-styleGeração de visuais consistentes com a marcaCampanhas, materiais de marketing
batch-productionProcessamento em lote de alto volumeProdução de catálogos, operações em massa

Agentes de IA

Agentes autônomos para fluxos de trabalho complexos:

DesignerAgent

  • Analisar imagens de referência e extrair parâmetros de estilo
  • Gerar fotos com base nas diretrizes da marca
  • Criar conteúdo específico para plataformas (Amazon, Instagram, TikTok)
  • Gerenciar bibliotecas de modelos

OptimizerAgent

  • Aprimoramento de imagens em lote
  • Otimização para plataformas (Amazon, Shopify, redes sociais)
  • Remoção e substituição de fundo
  • Marca d'água e formatação

Instalação

Início Rápido (3 minutos)

# Clone the repository
git clone git@github.com:photoshootapp/photoshoot-ai-design.git
cd photoshoot-ai-design

# Install dependencies
npm install

# Configure API keys
cp .env.example .env
# Edit .env and add your API keys

# Start MCP server
npm run mcp:start

Consulte SETUP.md para instruções detalhadas de configuração e obtenção de chaves de API.

Plugin para Claude Code

# Install from plugin marketplace
claude plugin install photoshoot-ai-design

# Or manually configure in .claude/settings.json
{
  "mcpServers": {
    "photoshoot": {
      "command": "node",
      "args": ["packages/mcp-server/dist/index.js"],
      "cwd": "/path/to/photoshoot-ai-design"
    }
  }
}

Plugin para Pi Agent

pi-agent plugin add photoshoot-ai-design

Plugin para OpenLLM

import openllm

plugin = openllm.load_plugin("photoshoot-ai-design")
model = openllm.start("vllm/nano-banana", plugins=[plugin])

Uso

Exemplos de Ferramentas MCP

// Generate product photography
await mcpClient.callTool({
  name: "photoshoot_generate",
  arguments: {
    type: "product",
    provider: "wavespeed",
    prompt: "Professional product photo of wireless headphones",
    style: "studio",
    quantity: 4
  }
});

// Generate OOTD fashion content
await mcpClient.callTool({
  name: "photoshoot_generate",
  arguments: {
    type: "ootd",
    provider: "nano-banana",
    prompt: "Streetwear fashion photoshoot, urban setting",
    style: "vibrant",
    quantity: 6
  }
});

// Edit and enhance images
await mcpClient.callTool({
  name: "photoshoot_edit",
  arguments: {
    image: "https://example.com/product.jpg",
    provider: "auto",
    edits: {
      lighting: "studio",
      background: "white",
      retouch: true
    }
  }
});

Exemplos de Habilidades

# Product photography
/photoshoot-design product --reference="product.jpg" --style=studio --platform=amazon

# OOTD fashion
/photoshoot-design ootd --reference="outfit.jpg" --style=streetwear --location=urban

# Image enhancement
/photoshoot-design enhance --image="photo.jpg" --intensity=medium

Exemplos de Agentes

import { DesignerAgent, createPhotoShootClient } from '@photoshoot/agents';

const client = await createPhotoShootClient();
const agent = new DesignerAgent(client, {
  defaultStyle: 'studio',
  defaultQuantity: 4
});

// Generate product photography
await agent.generateProductPhotography({
  productImage: 'shoe.jpg',
  style: 'minimalist',
  platform: 'amazon',
  quantity: 8
});

// Create OOTD content
await agent.createOOTDContent({
  outfitImage: 'outfit.jpg',
  style: 'luxury',
  location: 'rooftop',
  vibe: 'chic'
});

// Optimize for platforms
await agent.optimizeForPlatform({
  images: ['img1.jpg', 'img2.jpg'],
  platform: 'instagram'
});

Arquitetura

photoshoot-ai-design/
├── packages/
│   ├── mcp-server/          # MCP server with all AI providers
│   │   ├── src/
│   │   │   ├── api/clients/ # Individual API clients
│   │   │   │   ├── wavespeed.ts
│   │   │   │   ├── nanobanana.ts
│   │   │   │   ├── openai.ts
│   │   │   │   ├── stability.ts
│   │   │   │   ├── photoshoot.ts
│   │   │   │   └── fal.ts
│   │   │   ├── config.ts
│   │   │   └── index.ts
│   │   └── .env.example
│   │
│   ├── mcp-client/          # MCP client SDK
│   ├── skills/              # Skill definitions (Markdown)
│   ├── agents/              # AI agent implementations
│   │
│   └── plugins/
│       ├── claude-code/     # Claude Code plugin
│       ├── pi-agent/        # Pi Agent plugin
│       └── openllm/         # OpenLLM plugin
│
├── docs/                    # Documentation
├── examples/                # Usage examples
├── .env.example             # Environment configuration template
├── SETUP.md                 # Quick setup guide
└── README.md                # This file

Referência da API

Ferramentas MCP

photoshoot_generate

Gere imagens de sessões de fotografia usando IA.

{
  type: 'product' | 'ootd' | 'portrait',
  provider?: 'wavespeed' | 'nano-banana' | 'openai' | 'stability' | 'auto',
  prompt: string,
  reference?: string,
  style?: string,
  quantity?: number,
  width?: number,
  height?: number
}

photoshoot_edit

Edite e aprimore imagens.

{
  image: string,
  provider?: 'wavespeed' | 'nano-banana' | 'openai' | 'stability' | 'auto',
  prompt?: string,
  edits?: {
    lighting?: string,
    background?: string,
    retouch?: boolean,
    enhance?: boolean
  }
}

photoshoot_batch

Processe múltiplas imagens em lote.

{
  images: string[],
  operation: 'enhance' | 'resize' | 'format' | 'watermark' | 'remove-background',
  options?: Record<string, unknown>
}

Configuração

Variáveis de Ambiente

# WaveSpeed AI (recommended for product photography)
WAVESPEED_API_KEY=your_key_here
WAVESPEED_API_URL=https://api.wavespeed.ai/v1

# Nano Banana (Google Gemini - recommended for fashion)
NANO_BANANA_API_KEY=your_key_here
NANO_BANANA_API_URL=https://generativelanguage.googleapis.com/v1beta

# OpenAI (DALL-E)
OPENAI_API_KEY=your_key_here
OPENAI_API_URL=https://api.openai.com/v1

# Stability AI (Stable Diffusion)
STABILITY_API_KEY=your_key_here
STABILITY_API_URL=https://api.stability.ai/v1

# PhotoShoot App
PHOTOSHOOT_API_KEY=your_key_here
PHOTOSHOOT_API_URL=https://api.photoshoot.app

# fal.ai
FAL_API_KEY=your_key_here
FAL_API_URL=https://fal.ai

Seleção de Provedor

O sistema seleciona automaticamente o melhor provedor com base em:

  1. Chaves de API disponíveis - Apenas provedores configurados são usados
  2. Tipo de conteúdo - Diferentes provedores se destacam em diferentes tipos
  3. Preferência do usuário - Substituição manual disponível

Lógica de seleção automática:

  • Fotografia de produtos → WaveSpeed AI
  • Moda/OOTD → Nano Banana
  • Retratos → OpenAI DALL-E
  • Estilos personalizados → Stability AI
  • Fallback → PhotoShoot App (modo demo sem chave de API)

Contribuição

Aceitamos contribuições! Consulte CONTRIBUTING.md para diretrizes.

Áreas para Contribuição

  • Novas integrações de provedores de IA
  • Definições adicionais de habilidades
  • Aprimoramentos de capacidades dos agentes
  • Suporte a plugins para outras plataformas
  • Documentação e exemplos

Desenvolvimento

# Install dependencies
npm install

# Build all packages
npm run build

# Run MCP server
npm run mcp:start

# Run tests
npm test

# Development mode with hot reload
npm run dev

Desempenho

  • Processamento em Lote: Processe até 100 imagens simultaneamente
  • Cache Automático: Reduza chamadas de API redundantes com cache inteligente
  • Requisições Concorrentes: Limites configuráveis de requisições concorrentes
  • Proteção de Timeout: Timeout integrado para todas as chamadas de API

Roadmap

  • Suporte a geração de vídeo (Kling, Veo, Sora via WaveSpeed)
  • Geração de modelos 3D
  • Recursos avançados de edição (inpainting, outpainting)
  • Transferência de estilo em tempo real
  • Integração com aplicativo móvel
  • Integração com armazenamento em nuvem
  • Recursos de colaboração em equipe

Licença

Licença MIT - consulte LICENSE para detalhes.

Links

Suporte

Agradecimentos

Construído com:


Construído com ❤️ para a comunidade de fotografia com IA