cosmos3-setup

par nvidia

Guidez les utilisateurs à travers l’installation de Cosmos3, la configuration de l’environnement, le téléchargement des points de contrôle et la vérification. Utilisez lorsque l’utilisateur demande « comment installer cosmos3 », « comment…

npx skills add https://github.com/nvidia/cosmos-framework --skill cosmos3-setup

Cosmos3 Setup

When to use this skill

  • Use when a user wants to install Cosmos3 or set up a development environment
  • Use when a user asks about system requirements, CUDA versions, or GPU compatibility
  • Use when a user needs to download model checkpoints or configure HuggingFace auth
  • Use when a user wants to run Cosmos3 inside a Docker container or NGC container
  • For errors during setup, hand off to the cosmos3-env-troubleshoot skill

Path convention

All paths below are relative to the cosmos3 package root (../../../ from this skill file). All uv run / python commands should also be run from there.

Where to find answers

The canonical setup reference is docs/setup.md. The README (README.md § Setup) has the shortest quickstart.

User questionGo to
What are the system requirements?docs/setup.md § System Requirements
How do I install with uv? (sync, pip venv, pip system)docs/setup.md § Virtual Environment
How do I install with Docker?docs/setup.md § Docker Container
Custom torch/CUDA versions or attention backends?docs/setup.md § Advanced
Which CUDA version? (cu130 vs cu128)docs/setup.md § CUDA Variants, docs/faq.md § Which CUDA version?
How do I download checkpoints?docs/setup.md § Downloading Base Checkpoints
NGC container issues?docs/setup.md § PyTorch Import Issue
Any installation error../cosmos3-env-troubleshoot/SKILL.md

Setup steps at a glance

  1. Clone the repository and cd into the project root (the directory containing pyproject.toml)
  2. System deps: sudo apt-get install -y --no-install-recommends curl ffmpeg git-lfs libx11-dev tree wget
  3. Install uv: curl -LsSf https://astral.sh/uv/install.sh | sh && source $HOME/.local/bin/env
  4. Install package: uv sync --all-extras --group=cu130-train && source .venv/bin/activate && export LD_LIBRARY_PATH= (use cu128-train on older drivers; the inference-only cu130 / cu128 groups omit the training extras)
  5. Checkpoints: auto-downloaded during inference; requires HuggingFace auth (see docs)
  6. Verify: uv run --all-extras --group=cu130-train python -c "import cosmos_framework; print('ok')"

Things not obvious from the docs

  • NGC container caveat: you must run export LD_LIBRARY_PATH='' before any Python imports when inside an NGC PyTorch container. Easy to miss.
  • CUDA version alignment: the major CUDA version from nvidia-smi must match torch.version.cuda. Mismatches cause cryptic shared-library errors.
  • HF_HOME: controls where checkpoints are cached (default: ~/.cache/huggingface). Set this if disk space is tight or you want a shared cache.
  • Conflicting env vars: stale HF_TOKEN or HUGGING_FACE_HUB_TOKEN env vars can silently override CLI auth. Check with printenv | grep HF_.

Related skills

SkillWhen to use
../cosmos3-inference/SKILL.mdRunning inference after setup is complete
../cosmos3-codebase-nav/SKILL.mdFinding files, parameters, and configs in code
../cosmos3-env-troubleshoot/SKILL.mdDebugging environment and runtime errors

Plus de skills de nvidia

compileiq-debug
nvidia
Utilisez quand quelque chose ne va pas : Search() bloque, toutes les évaluations retournent INVALID_SCORE, les scores ne s'améliorent pas, chaque configuration retourne le même nombre, erreurs ptxas…
create-github-pr
nvidia
Créer des pull requests GitHub en utilisant l'interface en ligne de commande gh. Utiliser lorsque l'utilisateur souhaite créer une nouvelle PR, soumettre du code pour révision, ou ouvrir une pull request. Mots-clés de déclenchement -…
nemoclaw-maintainer-cross-issue-sweep
nvidia
Analyse les autres problèmes ouverts pour trouver ceux qu’une PR donnée pourrait également corriger ou casser accidentellement. Génère des opportunités de correctifs adjacents et des risques de contradiction avec fichier:ligne…
fhir-basics
nvidia
Apprend aux agents comment fonctionnent les API FHIR R4, quelles ressources sont disponibles, comment les interroger avec des paramètres de recherche, et comment analyser correctement tous les formats de réponse…
compileiq-validate-result
nvidia
Utiliser APRÈS qu'une recherche soit terminée et AVANT de réclamer un accélérateur ou d'expédier un ACF. Charge le CSV dump_results, extrait les K meilleurs candidats (mono-objectif)…
changelog-audit
nvidia
Auditer le CHANGELOG.md de Warp avant une publication : récupérer les entrées perdues, trier par impact utilisateur, affiner le langage des entrées, ajuster les retours à la ligne et (en mode branche de publication) mettre à jour la comparaison…
maintain-dynamic-plugins
nvidia
Maintenir les chargeurs de plugins dynamiques NeMo Relay, les manifestes, les SDK natifs Rust, le protocole worker gRPC, le SDK worker Python, la documentation, les tests et la couverture du workflow de publication
dgx-diagnose
nvidia
Diagnostiquer les problèmes courants du DGX Station GB300 — plantages CUDA, ciblage incorrect du GPU, bugs de conteneur vLLM/SGLang, problèmes d'état MIG, erreurs NVLink/Fabric Manager,…