apify-sdk-integration

por apify

Integra Apify en una aplicación existente de JavaScript/TypeScript o Python usando el paquete apify-client. Úsalo al agregar web scraping, automatización o datos…

npx skills add https://github.com/apify/apify-claude-code-plugin --skill apify-sdk-integration

Apify SDK Integration

Add Apify Actor execution to an existing application. This skill covers the apify-client package for JS/TS and Python, plus the REST API for other languages.

When to Use This Skill

  • Adding web scraping or automation to an existing app
  • Calling Apify Actors programmatically from application code
  • Building a product that uses Apify as a backend service
  • Integrating Actor results into a data pipeline

Critical: Package Naming

apify-client is the API client for calling Actors from your app. apify is the SDK for building Actors (wrong package for this use case).

Always install apify-client. Never install apify for integration work.

Prerequisites

The user needs an APIFY_TOKEN. Direct them to Console > Settings > Integrations at https://console.apify.com/settings/integrations to create one. If they don't have an account: https://console.apify.com/sign-up (free, no credit card).

Store the token securely — environment variable or secrets manager, never hardcoded.

Finding the Right Actor

Before writing integration code, find the Actor that fits the user's needs. Use the MCP tools if available:

  • search-actors — search the Apify Store by keyword
  • fetch-actor-details — get the Actor's input schema, output format, and pricing

Alternatively, browse https://apify.com/store. Append .md to any Actor's Store URL to get its docs in markdown.

JavaScript / TypeScript

Install

npm install apify-client

Synchronous Execution (wait for results)

import { ApifyClient } from 'apify-client';

const client = new ApifyClient({ token: process.env.APIFY_TOKEN });

const run = await client.actor('apify/web-scraper').call({
    startUrls: [{ url: 'https://example.com' }],
    maxPagesPerCrawl: 10,
});

const { items } = await client.dataset(run.defaultDatasetId).listItems();

.call() blocks until the Actor finishes. Use for short-running Actors (under a few minutes).

Asynchronous Execution (start and poll/retrieve later)

const run = await client.actor('apify/web-scraper').start({
    startUrls: [{ url: 'https://example.com' }],
});

// Poll for completion
const finishedRun = await client.run(run.id).waitForFinish();

// Retrieve results
const { items } = await client.dataset(finishedRun.defaultDatasetId).listItems();

Use .start() + .waitForFinish() for long-running Actors or when you need the run ID immediately.

Retrieving Results

// Dataset items (structured data from pushData)
const { items } = await client.dataset(run.defaultDatasetId).listItems({
    limit: 100,
    offset: 0,
});

// Key-value store (files, screenshots, etc.)
const record = await client.keyValueStore(run.defaultKeyValueStoreId).getRecord('OUTPUT');

Error Handling

try {
    const run = await client.actor('apify/web-scraper').call(input);

    if (run.status !== 'SUCCEEDED') {
        const log = await client.log(run.id).get();
        throw new Error(`Actor failed with status ${run.status}: ${log}`);
    }

    const { items } = await client.dataset(run.defaultDatasetId).listItems();
} catch (error) {
    if (error.message?.includes('not found')) {
        // Actor ID is wrong or Actor was deleted
    } else if (error.statusCode === 401) {
        // Invalid or missing APIFY_TOKEN
    }
    throw error;
}

Python

Install

pip install apify-client

Synchronous Execution

from apify_client import ApifyClient
import os

client = ApifyClient(token=os.environ['APIFY_TOKEN'])

run = client.actor('apify/web-scraper').call(run_input={
    'startUrls': [{'url': 'https://example.com'}],
    'maxPagesPerCrawl': 10,
})

items = client.dataset(run['defaultDatasetId']).list_items().items

Asynchronous Execution

run = client.actor('apify/web-scraper').start(run_input={
    'startUrls': [{'url': 'https://example.com'}],
})

# Poll for completion
finished_run = client.run(run['id']).wait_for_finish()

items = client.dataset(finished_run['defaultDatasetId']).list_items().items

Async Client (asyncio)

from apify_client import ApifyClientAsync

client = ApifyClientAsync(token=os.environ['APIFY_TOKEN'])

run = await client.actor('apify/web-scraper').call(run_input={
    'startUrls': [{'url': 'https://example.com'}],
})

items = (await client.dataset(run['defaultDatasetId']).list_items()).items

REST API (Any Language)

For languages without an official client, use the REST API directly.

Start a Run

POST https://api.apify.com/v2/actors/{actorId}/runs
Authorization: Bearer <APIFY_TOKEN>
Content-Type: application/json

{ "startUrls": [{ "url": "https://example.com" }] }

Get Run Status

GET https://api.apify.com/v2/actor-runs/{runId}
Authorization: Bearer <APIFY_TOKEN>

Get Dataset Items

GET https://api.apify.com/v2/datasets/{datasetId}/items?format=json
Authorization: Bearer <APIFY_TOKEN>

Full API reference: https://docs.apify.com/api/v2

Best Practices

  • Set timeouts: Pass timeoutSecs in the Actor input or use waitSecs on .call() to avoid indefinite waits.
  • Paginate large datasets: Use limit and offset when retrieving dataset items. Default limit is 250K items.
  • Reuse clients: Create one ApifyClient instance and reuse it across calls.
  • Handle Actor-specific input: Every Actor has its own input schema. Use fetch-actor-details MCP tool or append .md to the Actor's Store URL to get the schema before constructing input.

Documentation

If the Apify MCP server is available, use search-apify-docs and fetch-apify-docs tools for contextual documentation lookups during development.

Más skills de apify

apify-influencer-brand-collabs
apify
Descubre asociaciones entre marcas y creadores de Instagram encadenando Apify Actors. Úsalo cuando el usuario pregunte quién colabora con una marca, qué marcas ha hecho pagadas un creador…
apify-actor-development
apify
Crear, depurar e implementar programas en la nube sin servidor para web scraping, automatización y procesamiento de datos. Compatible con plantillas de JavaScript, TypeScript y Python con las bibliotecas integradas Crawlee, Playwright y Cheerio para rastreo HTTP y basado en navegador. Incluye pruebas locales mediante apify run con almacenamiento aislado, validación de esquemas para entradas/salidas e implementación en la plataforma Apify mediante apify push. Requiere autenticación de Apify CLI y metadatos obligatorios generatedBy en .actor/actor.json para IA...
apify-actorization
apify
Convierte proyectos existentes en Apify Actors sin servidor con integración de SDK específica para cada lenguaje. Soporta JavaScript/TypeScript (con Actor.init() / Actor.exit()), Python (gestor de contexto asíncrono) y cualquier lenguaje mediante envoltorio CLI. Proporciona un flujo de trabajo estructurado: apify init para crear la estructura, aplicar envoltorio SDK, configurar esquemas de entrada/salida, probar localmente con apify run y luego desplegar con apify push. Incluye validación de esquemas de entrada y salida, contenedorización Docker y opcional pago por evento...
apify-content-analytics
apify
Análisis de contenido multiplataforma a través de Apify Actors para Instagram, Facebook, YouTube y TikTok. Soporta más de 17 Actors especializados que cubren publicaciones, reels, historias, comentarios, hashtags, seguidores y anuncios en las cuatro plataformas. Obtiene dinámicamente los esquemas de los Actors usando mcpc CLI para determinar las entradas requeridas y los campos de salida disponibles. Presenta los resultados en tres formatos: visualización rápida en chat, exportación CSV o exportación JSON con recuentos de resultados personalizables. Requiere token de Apify en el archivo .env y Node.js 20.6+...
apify-ecommerce
apify
Extrae datos de productos, precios, reseñas e información de vendedores de más de 50 mercados de comercio electrónico. Tres modos de flujo de trabajo: Productos y Precios (seguimiento de precios, análisis de competidores), Reseñas de Clientes (análisis de sentimiento, problemas de calidad) e Inteligencia de Vendedores (descubrimiento de proveedores a través de Google Shopping). Compatible con Amazon (más de 20 regiones), Walmart, eBay, IKEA, Costco y minoristas europeos; entrada mediante URL de productos, URL de categorías o búsqueda por palabras clave. Análisis opcional impulsado por IA que genera información sobre precios...
apify-generate-output-schema
apify
Generar esquemas de salida (dataset_schema.json, output_schema.json, key_value_store_schema.json) para un Apify Actor analizando su código fuente. Úselo cuando…
apify-influencer-discovery
apify
Descubre y evalúa influencers en Instagram, Facebook, YouTube y TikTok utilizando Apify Actors. Enruta solicitudes de descubrimiento a más de 15 Actors especializados que cubren scraping de perfiles, búsqueda por hashtags, análisis de engagement y descubrimiento de nichos en todas las plataformas principales. Obtiene dinámicamente los esquemas de los Actors a través de mcpc para determinar las entradas requeridas y los campos de salida disponibles antes de la ejecución. Soporta tres modos de exportación: visualización en chat en línea, archivo CSV o salida en archivo JSON con recuentos de resultados personalizables...
apify-ultimate-scraper
apify
Raspador web automatizado que selecciona los Actores óptimos para más de 55 plataformas, incluyendo Instagram, TikTok, YouTube, Facebook, Google Maps y más. Cubre más de 55 Actores preconfigurados en 8 plataformas principales con orientación de selección específica para casos de uso (generación de leads, descubrimiento de influencers, monitoreo de marca, análisis de competencia, investigación de tendencias). Admite tres formatos de salida: visualización rápida en chat, exportación CSV o exportación JSON con límites de resultados personalizables. Incluye patrones de flujo de trabajo con múltiples Actores para casos complejos...