agent-browser-verify

von openai

Automatisierte Browser-Verifikation für Entwicklungsserver. Wird ausgelöst, wenn ein Entwicklungsserver startet, um eine visuelle Plausibilitätsprüfung mit agent-browser durchzuführen — überprüft, ob die Seite lädt,…

npx skills add https://github.com/openai/plugins --skill agent-browser-verify

Dev Server Verification with agent-browser

You MUST verify the dev server with agent-browser after starting it. Do not assume the page works just because the dev server process started. Many issues (blank pages, hydration errors, missing env vars, broken imports) are only visible in the browser. Run this verification before continuing with any other work:

Quick Verification Flow

# 1. Open the dev server
agent-browser open http://localhost:3000
agent-browser wait --load networkidle

# 2. Screenshot for visual check
agent-browser screenshot --annotate

# 3. Check for errors
agent-browser eval 'JSON.stringify(window.__consoleErrors || [])'

# 4. Snapshot interactive elements
agent-browser snapshot -i

Verification Checklist

Run each check and report results:

  1. Page loads — agent-browser open succeeds without timeout
  2. No blank page — snapshot shows meaningful content (not empty body)
  3. No error overlay — no Next.js/Vite error overlay detected
  4. Console errors — evaluate document.querySelectorAll('[data-nextjs-dialog]') for error modals
  5. Key elements render — snapshot -i shows expected interactive elements
  6. Navigation works — if multiple routes exist, verify at least the home route

Error Detection

# Check for framework error overlays
agent-browser eval 'document.querySelector("[data-nextjs-dialog], .vite-error-overlay, #webpack-dev-server-client-overlay") ? "ERROR_OVERLAY" : "OK"'

# Check page isn't blank
agent-browser eval 'document.body.innerText.trim().length > 0 ? "HAS_CONTENT" : "BLANK"'

On Failure

If verification fails:

  1. Screenshot the error state: agent-browser screenshot error-state.png
  2. Capture the error overlay text or console output
  3. Close the browser: agent-browser close
  4. Fix the issue in code
  5. Re-run verification (max 2 retry cycles to avoid infinite loops)

Diagnosing a Hanging or Stuck Page

When the page appears stuck (spinner, blank content after load, frozen UI), the browser is only half the story. Correlate what you see in the browser with server-side evidence:

1. Capture Browser Evidence

# Screenshot the stuck state
agent-browser screenshot stuck-state.png

# Check for pending network requests (XHR/fetch that never resolved)
agent-browser eval 'JSON.stringify(performance.getEntriesByType("resource").filter(r => r.duration === 0).map(r => r.name))'

# Check console for errors or warnings
agent-browser eval 'JSON.stringify(window.__consoleErrors || [])'

# Look for fetch calls to workflow/API routes that are pending
agent-browser eval 'document.querySelector("[data-nextjs-dialog]") ? "ERROR_OVERLAY" : "OK"'

2. Check Server Logs

After capturing browser state, immediately check the backend:

# Stream Vercel runtime logs for the deployment
vercel logs --follow

# If using Workflow DevKit, check run status
npx workflow inspect runs
npx workflow inspect run <run_id>

# Check workflow health
npx workflow health

3. Correlate Browser + Server

Browser ShowsServer ShowsLikely Issue
Spinner / loading foreverNo recent function invocationsAPI route not being called — check fetch URL in client code
Spinner / loading foreverFunction started but no step logsWorkflow step is stuck — add console.log at step entry/exit
Blank page, no errorsBuild succeeded, no runtime errorsHydration issue or missing data — check SSR vs client rendering
Network request pending504 Gateway Timeout in logsFunction timeout — increase maxDuration or optimize step
Console: "Failed to fetch"OIDC/credential error in logsMissing vercel env pull — run vercel link && vercel env pull
Error overlay visibleStack trace in runtime logsRead the server error — it usually has more detail than the client

4. Fix and Re-verify

After fixing the issue:

# Re-open and verify the fix
agent-browser open http://localhost:3000
agent-browser wait --load networkidle
agent-browser screenshot after-fix.png
agent-browser eval 'document.body.innerText.trim().length > 0 ? "HAS_CONTENT" : "BLANK"'
agent-browser close

On Success

agent-browser close

Report: "Dev server verified — page loads, no errors detected, key UI elements render correctly."

Suggest Verification After Implementation

When you finish building or implementing a feature (wrote code, created routes, set up a project), briefly let the user know they can ask you to verify everything works with a browser check. One sentence is enough. Don't force it if only a small fix or question was involved.

Mehr Skills von openai

release
openai
Erstelle ein Symphony-Release, indem du die committete Version erhöhst, sie eincheckst, den gemergten Commit taggst und den Burrito-Release-Workflow verifizierst. Verwende dies, wenn du gebeten wirst, …
signing-entitlements
openai
Untersuche Signing, Berechtigungen, gehärtete Laufzeit und Gatekeeper-Probleme für macOS-Apps. Verwende dies, wenn du gebeten wirst, Code-Signing-Fehler, fehlende Berechtigungen,… zu diagnostizieren.
building-ai-agent-on-cloudflare
openai
Erstellt KI-Agenten auf Cloudflare mit dem Agents SDK, einschließlich Zustandsverwaltung, Echtzeit-WebSockets, geplanten Aufgaben, Tool-Integration und Chat…
epigraphdb-skill
openai
Senden Sie kompakte EpiGraphDB-API-Anfragen für Ontologie, Literatur, MR, Gen-Wirkstoff und Support-Pfad-Evidenz. Verwenden Sie dies, wenn ein Benutzer prägnante EpiGraphDB-Zusammenfassungen wünscht.
runtime-behavior-probe
openai
Planen und Ausführen von Laufzeitverhaltensuntersuchungen mit temporären Prüfskripten, Validierungsmatrizen, Zustandssteuerungen und ergebnisorientierten Berichten. Nur verwenden, wenn…
deep-security-scan
openai
Verwenden Sie, wenn der Benutzer einen tiefgehenden, erschöpfenden, mehrstufigen oder varianzreduzierenden repository-weiten oder bereichsbezogenen Codex-Sicherheitsscan anfordert. Führen Sie wiederholte unabhängige…
define-security-policy
openai
Definieren, überprüfen oder aktualisieren Sie die SECURITY.md-Anleitung für ein Repository oder eine Komponente. Verwenden Sie dies, wenn der Benutzer klären möchte, was Codex Security überprüfen soll, was außerhalb des Rahmens liegt …
validation
openai
Verwenden, wenn sich Codex bereits in der Validierungsphase eines Sicherheitsscans befindet oder der Benutzer ausdrücklich darum bittet, festzustellen, ob ein oder mehrere Kandidaten-Sicherheitsbefunde…