cudf-analytics

Use para análise de dados acelerada por GPU em conjuntos de dados, CSVs ou dados tabulares usando NVIDIA cuDF. Aciona quando tarefas envolvem agregações groupby, estatísticas…

npx skills add https://github.com/langchain-ai/deepagents --skill cudf-analytics

cuDF Analytics Skill

GPU-accelerated data analysis using NVIDIA RAPIDS cuDF. cuDF provides a pandas-like API that runs on NVIDIA GPUs, enabling massive speedups on large datasets.

When to Use This Skill

Use this skill when:

  • Analyzing CSV files, datasets, or tabular data
  • Computing statistical summaries (mean, median, std, quartiles)
  • Performing groupby aggregations
  • Detecting anomalies or outliers in data
  • Profiling datasets with millions of rows
  • Computing correlation matrices

Initialization (REQUIRED)

Always start every script with this boilerplate. It tests actual GPU operations, not just import.

import pandas as pd

try:
    import cudf
    # Smoke-test: verify GPU compute AND host transfer both work
    _test = cudf.Series([1, 2, 3])
    assert _test.sum() == 6
    assert _test.to_pandas().tolist() == [1, 2, 3]
    GPU = True
except Exception as e:
    print(f"[GPU] cudf unavailable, falling back to pandas: {e}")
    GPU = False

def read_csv(path):
    return cudf.read_csv(path) if GPU else pd.read_csv(path)

def to_pd(df):
    """Convert cuDF DataFrame/Series to pandas. Use this instead of .to_pandas() directly."""
    if not GPU:
        return df
    try:
        return df.to_pandas()
    except Exception as e:
        print(f"[GPU] .to_pandas() failed, using Arrow fallback: {e}")
        return df.to_arrow().to_pandas()

Quick Reference

cuDF mirrors the pandas API. Common operations:

Read Data

df = read_csv("data.csv")

Statistical Summary

# Use to_pd() when you need pandas output
summary = to_pd(df[["value", "score"]].describe())

# Scalar values work directly with float()
mean_val = float(df["value"].mean())
q1 = float(df["value"].quantile(0.25))

# Correlation
corr = float(df["value"].corr(df["score"]))

Groupby Aggregation

result = df.groupby("category").agg({
    "revenue": ["sum", "mean", "count"],
    "quantity": ["sum", "mean"],
})
result_pd = to_pd(result)

Anomaly Detection (IQR Method)

col = "value"
Q1 = float(df[col].quantile(0.25))
Q3 = float(df[col].quantile(0.75))
IQR = Q3 - Q1
lower = Q1 - 1.5 * IQR
upper = Q3 + 1.5 * IQR
outliers = to_pd(df[(df[col] < lower) | (df[col] > upper)])

Anomaly Detection (Z-Score Method)

mean = float(df[col].mean())
std = float(df[col].std())
df["z_score"] = (df[col] - mean) / std
anomalies = to_pd(df[df["z_score"].abs() > 3])

Filtering and Selection

# Filter rows
filtered = df[df["status"] == "active"]

# Select columns
subset = df[["name", "revenue", "date"]]

# Sort
sorted_df = df.sort_values("revenue", ascending=False)

# Convert to pandas for final output / iteration
result_pd = to_pd(sorted_df)

Data Type Requirements

cuDF requires explicit type specification for optimal performance:

  • Use float32 or float64 for numeric data
  • Use int32 or int64 for integer data
  • String columns use cuDF's string dtype automatically

Output Guidelines

When reporting analysis results:

  • Include dataset dimensions (rows x columns)
  • Show key statistics in formatted tables
  • Highlight notable patterns, trends, or anomalies
  • Provide both summary statistics and specific examples
  • Note any data quality issues (missing values, outliers)

Mais skills de langchain-ai

langgraph-docs
langchain-ai
Acesse a documentação do LangGraph para construir agentes com estado e fluxos de trabalho multiagente. Busca a documentação oficial do LangGraph em Python, abordando máquinas de estado, design de agentes baseado em grafos e padrões com intervenção humana. Prioriza a documentação relevante por tipo de consulta: guias de implementação para perguntas de "como fazer", páginas conceituais para teoria, tutoriais para exemplos completos e referências de API para detalhes técnicos. Seleciona automaticamente de 2 a 4 URLs de documentação mais relevantes e recupera seu conteúdo para responder...
official
langgraph-human-in-the-loop
langchain-ai
Pausar a execução do grafo para revisão, aprovação ou validação humana e, em seguida, retomar com a contribuição do usuário. Requer três componentes: um checkpointer (InMemorySaver ou PostgresSaver), um ID de thread na configuração e payloads de interrupção serializáveis em JSON. interrupt(value) pausa e exibe dados; Command(resume=value) retoma e retorna esse valor ao nó pausado. Todo código antes de interrupt() é reexecutado na retomada, portanto, os efeitos colaterais devem ser idempotentes (use upsert, não insert). Suporta fluxos de aprovação,...
official
web-research
langchain-ai
Use esta habilidade para solicitações relacionadas a pesquisa na web; ela fornece uma abordagem estruturada para realizar pesquisas web abrangentes.
official
langchain-oss-primer
langchain-ai
SEMPRE COMEÇE AQUI para qualquer projeto de construção de agentes LangChain, Deep Agents ou LangGraph. Ponto de partida obrigatório antes de escolher outras habilidades ou escrever qualquer…
official
skill-creator
langchain-ai
Guia para criar skills eficazes que estendem as capacidades do agente com conhecimento especializado, fluxos de trabalho ou integrações de ferramentas. Use esta skill quando o usuário…
official
social-media
langchain-ai
Cria posts para redes sociais específicas da plataforma, com conteúdo baseado em pesquisa e imagens de acompanhamento geradas. Suporta posts no LinkedIn (1.300 caracteres com tom profissional) e threads no Twitter/X (280 caracteres por tweet no formato 1/🧵). Exige delegar a pesquisa a um subagente antes de escrever e, em seguida, ler os resultados para garantir precisão e relevância. Gera imagens sociais atraentes automaticamente usando a ferramenta generate_social_image, com composições ousadas e de alto contraste otimizadas para telas pequenas...
official
deep-agents-memory
langchain-ai
Backends de memória e arquivos plugáveis para Deep Agents com opções de roteamento efêmero, persistente e híbrido. Quatro tipos de backend: StateBackend (efêmero, com escopo de thread), StoreBackend (persistente entre sessões), FilesystemBackend (acesso real a disco para desenvolvimento local) e CompositeBackend (roteia diferentes caminhos para diferentes backends). FilesystemMiddleware fornece seis ferramentas de operação de arquivos: ls, read_file, write_file, edit_file, glob, grep. CompositeBackend usa correspondência de prefixo mais longo para rotear...
official
deep-agents-orchestration
langchain-ai
Orquestrar subagentes, planejar tarefas de múltiplas etapas e exigir aprovação humana para operações sensíveis. Delegar trabalho a subagentes especializados por meio da ferramenta de tarefas; subagentes personalizados suportam conjuntos de ferramentas isolados e prompts de sistema, enquanto o subagente "de propósito geral" padrão herda a configuração do agente principal. Planejar e acompanhar fluxos de trabalho complexos com write_todos, organizando tarefas entre estados pendente, em andamento e concluído; requer um thread_id para persistência entre invocações. Implementar...
official