data-explorer

Profilage et exploration de données à usage général. À utiliser lors de la première rencontre avec un ensemble de données pour comprendre sa structure, sa qualité et son potentiel d'analyse.

npx skills add https://github.com/google-gemini/gemini-managed-agents-templates --skill data-explorer

Data explorer skill

Profile any tabular dataset (CSV, JSON, Parquet) and produce a structured summary the other skills can consume.

Workflow

  1. Scan workspace: list all data files in the workspace directory.
  2. Load and profile each file:
    • Row count, column count
    • Column names, data types, null counts, unique counts
    • Basic statistics (min, max, mean, median, std for numerics)
    • Value counts for categorical columns (top 10)
    • Correlation matrix for numeric columns
  3. Assess data quality:
    • Missing value percentage per column
    • Potential data type issues (e.g., numbers stored as strings)
    • Duplicate row detection
    • Outlier detection (IQR method)
  4. Output a structured profile as JSON for downstream skills.
  5. Recommend analysis directions based on what you found.

Output format

{
  "files": [
    {
      "filename": "customers.csv",
      "rows": 91,
      "columns": 7,
      "schema": [
        {"name": "CustomerID", "dtype": "object", "nulls": 0, "unique": 91},
        {"name": "CompanyName", "dtype": "object", "nulls": 0, "unique": 91}
      ],
      "quality": {
        "missing_pct": {"Region": 0.60},
        "duplicates": 0
      },
      "recommendations": [
        "CustomerID is a unique string identifier",
        "Region column has a high missing percentage (60%)",
        "Can be joined with orders.csv on CustomerID to analyze customer behavior"
      ]
    }
  ]
}

Key rules

  • Never assume a specific dataset. Profile whatever is present.
  • If no data files are found, inform the user and ask them to upload.
  • Use pandas for profiling. It is pre-installed in the sandbox.
  • Use select_dtypes(include=["object", "str"]) for categorical columns.
  • For large files (>100K rows), profile a sample first and note the sampling.

Plus de skills de google-gemini

greeter
google-gemini
Une compétence d'accueil amicale
official
code-reviewer
google-gemini
Révision automatisée du code pour les modifications locales et les pull requests distantes avec une analyse structurée couvrant la correction, la maintenabilité et la sécurité. Prend en charge les modifications du système de fichiers local (staged et unstaged) et les PR distantes (par numéro ou URL) avec extraction automatique via GitHub CLI. Analyse le code selon sept dimensions : correction, maintenabilité, lisibilité, efficacité, sécurité, gestion des cas limites et couverture de test. Exécute des suites de vérification préalable optionnelles (ex. : npm run preflight) pour détecter...
official
review-duplication
google-gemini
Utilisez cette compétence lors des revues de code pour examiner de manière proactive la base de code à la recherche de fonctionnalités dupliquées, de réinventions de la roue ou d’absence de réutilisation de l’existant…
official
reconciliation
google-gemini
Concilier les dépenses chargées avec la base de données de factures pré-analysées, en signalant les écarts tels que les différences de montant, les factures manquantes et les discordances de commerçant…
official
agent-tui
google-gemini
Main Agents: Do NOT use this skill directly. If you need to test the TUI, invoke the `tui_tester` subagent. Drive terminal UI (TUI) applications…
official
async-pr-review
google-gemini
Déclenchez cette compétence lorsque l'utilisateur souhaite lancer une revue de PR asynchrone, exécuter des vérifications en arrière-plan sur une PR, ou vérifier le statut d'une revue de PR asynchrone déjà lancée…
official
ci
google-gemini
Une compétence spécialisée pour Gemini CLI qui offre des performances élevées et un échec rapide
official
critique
google-gemini
Expertise en audit et correction des scripts de dépôt et des workflows GitHub Actions pour garantir la robustesse technique et la sécurité.
official