verify

Verifique as alterações do harness de ponta a ponta sem docker — acione o CLI fixado real contra um servidor stub de captura de cabeçalhos com o env resolve_auth_env() exato…

npx skills add https://github.com/anthropics/defending-code-reference-harness --skill verify

Verifying harness changes on a docker-less host

The pipeline's real surface is the in-container claude -p process and its outbound API requests. Without docker, drive the same pinned CLI binary directly with the env dict the harness would inject via docker -e.

Recipe

  1. Get the pinned CLI (version from harness/agent_image.py:CLAUDE_CODE_VERSION): npm install --no-save @anthropic-ai/claude-code@<pin> in a temp dir → binary at node_modules/@anthropic-ai/claude-code/bin/claude.exe (the .exe name is the real native-binary entry on Linux too, filled in by the package's postinstall — not a Windows leftover).
  2. Stub API server: a tiny HTTP server that appends each request's headers to a JSONL file and returns a 400 invalid_request_error (non-retryable, so the CLI exits fast; exit=1 is expected).
  3. Build the agent env exactly as the pipeline does: python3 -c "from harness.auth import resolve_auth_env; ..." and dump to an export-lines file with shlex.quote (values contain newlines — NEVER pass via env $(...), word-splitting mangles them; source the file).
  4. Emulate the container env: unset ANTHROPIC_CUSTOM_HEADERS (and any other ambient var not in the resolved dict) before sourcing — a Claude Code session in this repo injects .claude/settings.json env into shells, which containers never see.
  5. Run: ANTHROPIC_BASE_URL=http://127.0.0.1:<port> CLAUDECODE= IS_SANDBOX=1 timeout 30 <cli> -p hi --model claude-sonnet-4-5 --max-turns 1, then read the captured JSONL.

Gotchas

  • Unit tests in tests/test_patch.py / tests/test_patch_grade.py need docker and fail on docker-less hosts — pre-existing, not your change.
  • The docker -e injection leg itself can't be exercised without docker; it's the same mechanism that carries ANTHROPIC_API_KEY in production.
  • For the interactive-skills surface, copy .claude/settings.json into a fresh temp dir and run the host claude from there (with ambient ANTHROPIC_CUSTOM_HEADERS unset so settings.json is the only source).

Mais skills de anthropic

access
anthropic
Gerenciar acesso ao canal do Discord — aprovar pareamentos, editar listas de permissão, definir política de DM/grupo. Use quando o usuário pedir para parear, aprovar alguém, verificar quem está autorizado,…
official
session-report
anthropic
Gere um relatório HTML explorável do uso da sessão do Claude Code (tokens, cache, subagentes, habilidades, prompts caros) a partir dos transcrições de ~/.claude/projects.
official
build-mcp-server
anthropic
Esta habilidade deve ser usada quando o usuário pedir para "construir um servidor MCP", "criar um MCP", "fazer uma integração MCP", "encapsular uma API para o Claude", "expor ferramentas para…
official
cookbook-audit
anthropic
Audite um notebook do Anthropic Cookbook com base em uma rubrica. Use sempre que for solicitada uma revisão ou auditoria de notebook.
official
handle-complaint
anthropic
Gerencia uma reclamação de cliente do início ao fim — extrai contexto, redige uma resposta e sugere uma correção operacional. Aceita e-mail ou ID de ticket opcionais…
official
use-case-triage
anthropic
Determina rapidamente se uma atividade de processamento precisa de uma PIA, uma DPIA obrigatória da GDPR ou pode prosseguir — identifica conflitos de política de privacidade e encaminha para o…
official
board-minutes
anthropic
Redige atas de reuniões de diretoria ou comitês no formato da sua empresa. Detecta automaticamente as próximas reuniões de diretoria e comitês do seu calendário, solicita a pauta e…
official
renewal-tracker
anthropic
Mostre contratos com prazos de cancelamento se aproximando e avise antes do fechamento das janelas de aviso prévio, operando a partir de um registro de renovação mantido. Use quando o usuário perguntar…
official