simready-foundation-add-runtime-test

par nvidia

Utiliser pour ajouter des tests d'exécution SimReady, des attentes de l'exécuteur, des notes de lot/tâche/rapport et des preuves de validation.

npx skills add https://github.com/nvidia/simready-foundation --skill simready-foundation-add-runtime-test

SimReady Add Runtime Test

Purpose

Use this skill when static validators are not enough to prove a feature or profile works in a runtime. Runtime tests use the workspace runtime_tests pipeline: batch maker, job runner, and report generator.

Do not hand-edit generated job JSON. Add or update the source test/search configuration that generates it.

Prerequisites

Before editing, read:

  • AGENTS.md
  • nv_core/sr_specs/docs/guides/runtime_testing/runtime_testing.md
  • nv_core/sr_specs/docs/guides/runtime_testing/runtime_tests_overview.md
  • nv_core/sr_specs/docs/guides/runtime_testing/job_runner_deep_dive.md
  • nv_core/sr_specs/docs/guides/runtime_testing/runners_info.md
  • nv_core/sr_specs/docs/guides/runtime_testing/cicd_usage.md
  • relevant feature/profile docs that need runtime evidence

Inputs

Collect or infer:

InputRequirement
runtime_goalBehavior to prove, such as drop/settle, articulation motion, rendering, or importability.
feature_or_profileFeature/profile requiring runtime evidence.
asset_scopeAsset search pattern, modified assets list, or manual assets.
test_identifierExisting or new test definition name.
search_functionExisting or new search function that returns assets for the test.
test_definitionTOML source with TestInfo, RunnerTags, and TestConfig sections.
runnerKit/Isaac/runtime runner requirement.
expected_artifactsLogs, screenshots, metrics, XML, JSON, or HTML report.

Instructions

Use this checklist when changing the repository:

  1. Decide whether runtime evidence is required by the feature/profile or only useful as supplementary confidence.
  2. Locate existing runtime test definitions and search functions for similar behavior.
  3. Add or update source test/search configuration, not generated batch job files.
  4. For search functions, keep the file and function name aligned and return AssetData from the provided search context.
  5. For test definitions, include the guide-required TOML sections:
    • [TestInfo] with name, description, version, search function, and optional feature IDs/versions
    • [RunnerTags] with runner config and script/class fields only when the run mode requires them
    • [TestConfig] for test-specific settings
  6. Ensure runner assumptions are documented in local_run/runners_info.toml guidance or the relevant docs. Do not hard-code user-specific runner paths into committed specs.
  7. Document how to run:
    • workspace runtime_tests batch_maker
    • workspace runtime_tests job_runner
    • workspace runtime_tests report_generator
  8. Record expected outputs under _testing/batch_jobs/, _testing/job_outputs/, and _testing/index.html.
  9. Add expected pass/fail signals and artifacts to the feature/profile docs when runtime testing is part of the acceptance strategy.
  10. Run the narrowest available runtime test when the local Kit/runtime environment exists; otherwise report the blocked runtime dependency.
  11. Preserve report paths and summarize runtime evidence.

Examples

Example request:

Add a runtime test proving a SimReady factory asset connection point imports and aligns correctly in Kit.

Expected result summary:

changed_files: new docs, manifests, indexes, or validation scaffolding
validation: focused static checks and any relevant docs/build checks
remaining_gaps: requirement, validator, adapter, profile, or runtime-test follow-up

Policies

  • Generated job JSON and output folders are artifacts, not source of truth.
  • Runtime tests should be reproducible from project root, test definitions, search functions, and runner config.
  • Keep user/CI-owned runner paths out of source-controlled docs unless intentionally templated.
  • If runtime cannot run locally, still add clear commands and expected artifacts.

Limitations

  • Do not mutate published feature or profile versions in place.
  • Do not invent requirement IDs or validator behavior when the contract is ambiguous; record the question.
  • Do not skip index, manifest, validation, or downstream follow-up notes.

Troubleshooting

  • Error: the new concept overlaps an existing artifact. Solution: update the existing capability, requirement, feature, profile, or adapter instead.
  • Error: names or IDs conflict. Solution: re-check naming conventions and nearby indexes before editing further.
  • Error: validation strategy is unclear. Solution: document deferred validation and the exact follow-up skill.

Resources

  • assets/openai.yaml preserves optional UI metadata for clients that read skill display hints. It is not required for the workflow.

Summary Format

Report:

FieldMeaning
runtime_goalBehavior being tested.
feature_or_profileSpec surface covered.
test_sourcesTest/search files changed.
runner_requirementsKit/Isaac/runtime assumptions.
commandsBatch/job/report commands.
artifactsExpected or produced reports.
validationRuntime test result or blocker.

Plus de skills de nvidia

compileiq-debug
nvidia
Utilisez quand quelque chose ne va pas : Search() bloque, toutes les évaluations retournent INVALID_SCORE, les scores ne s'améliorent pas, chaque configuration retourne le même nombre, erreurs ptxas…
create-github-pr
nvidia
Créer des pull requests GitHub en utilisant l'interface en ligne de commande gh. Utiliser lorsque l'utilisateur souhaite créer une nouvelle PR, soumettre du code pour révision, ou ouvrir une pull request. Mots-clés de déclenchement -…
nemoclaw-maintainer-cross-issue-sweep
nvidia
Analyse les autres problèmes ouverts pour trouver ceux qu’une PR donnée pourrait également corriger ou casser accidentellement. Génère des opportunités de correctifs adjacents et des risques de contradiction avec fichier:ligne…
fhir-basics
nvidia
Apprend aux agents comment fonctionnent les API FHIR R4, quelles ressources sont disponibles, comment les interroger avec des paramètres de recherche, et comment analyser correctement tous les formats de réponse…
compileiq-validate-result
nvidia
Utiliser APRÈS qu'une recherche soit terminée et AVANT de réclamer un accélérateur ou d'expédier un ACF. Charge le CSV dump_results, extrait les K meilleurs candidats (mono-objectif)…
changelog-audit
nvidia
Auditer le CHANGELOG.md de Warp avant une publication : récupérer les entrées perdues, trier par impact utilisateur, affiner le langage des entrées, ajuster les retours à la ligne et (en mode branche de publication) mettre à jour la comparaison…
maintain-dynamic-plugins
nvidia
Maintenir les chargeurs de plugins dynamiques NeMo Relay, les manifestes, les SDK natifs Rust, le protocole worker gRPC, le SDK worker Python, la documentation, les tests et la couverture du workflow de publication
dgx-diagnose
nvidia
Diagnostiquer les problèmes courants du DGX Station GB300 — plantages CUDA, ciblage incorrect du GPU, bugs de conteneur vLLM/SGLang, problèmes d'état MIG, erreurs NVLink/Fabric Manager,…