azure-diagnostics
bởi Azure
Gỡ lỗi và khắc phục sự cố sản xuất trên Azure. Bao gồm chẩn đoán Container Apps và Function Apps, phân tích nhật ký với KQL, kiểm tra tình trạng và giải quyết các vấn đề phổ biến.
npx skills add https://github.com/microsoft/GitHub-Copilot-for-Azure --skill azure-diagnosticsAzure Diagnostics
AUTHORITATIVE GUIDANCE — MANDATORY COMPLIANCE
This document is the official source for debugging and troubleshooting Azure production issues. Follow these instructions to diagnose and resolve common Azure service problems systematically.
Triggers
Activate this skill when user wants to:
- Debug or troubleshoot production issues
- Diagnose errors in Azure services
- Analyze application logs or metrics
- Fix image pull, cold start, or health probe issues
- Investigate why Azure resources are failing
- Find root cause of application errors
- Troubleshoot App Service issues (high CPU, deployment failures, crashes, slow responses, TLS/custom domains)
- Respond to prompts like "troubleshoot app service", "app service high CPU", or "app service deployment failure"
- Troubleshoot Azure Function Apps (invocation failures, timeouts, binding errors)
- Find the App Insights or Log Analytics workspace linked to a Function App
- Troubleshoot AKS clusters, nodes, pods, ingress, or Kubernetes networking issues
- Troubleshoot Azure Messaging SDK issues (Event Hubs, Service Bus connection failures, AMQP errors, message lock issues)
Rules
- Start with systematic diagnosis flow
- Use AppLens (MCP) for AI-powered diagnostics when available
- Check resource health before deep-diving into logs
- Select appropriate troubleshooting guide based on service type
- Document findings and attempted remediation steps
- Route AKS incidents to the dedicated AKS troubleshooting document
Quick Diagnosis Flow
- Identify symptoms - What's failing?
- Check resource health - Is Azure healthy?
- Review logs - What do logs show?
- Analyze metrics - Performance patterns?
- Investigate recent changes - What changed?
Troubleshooting Guides by Service
| Service | Common Issues | Reference |
|---|---|---|
| Container Apps | Image pull failures, cold starts, health probes, port mismatches | container-apps/ |
| App Service | High CPU, deployment failures, crashes, slow responses, TLS/custom domains | app-service/ |
| Function Apps | App details, invocation failures, timeouts, binding errors, cold starts, missing app settings | functions/ |
| AKS | Cluster access, nodes, kube-system, scheduling, crash loops, ingress, DNS, upgrades | AKS Troubleshooting |
| Messaging | Event Hubs & Service Bus SDK errors, AMQP failures, message lock, connectivity | Messaging Troubleshooting |
Routing
- Keep Container Apps and Function Apps diagnostics in this parent skill.
- Route active AKS incidents, AKS-specific intake, evidence gathering, and remediation guidance to AKS Troubleshooting.
- Route Azure Messaging SDK troubleshooting (Event Hubs, Service Bus) to Messaging Troubleshooting.
Quick Reference
Common Diagnostic Commands
# Check resource health
az resource show --ids RESOURCE_ID
# View activity log
az monitor activity-log list -g RG --max-events 20
# Container Apps logs
az containerapp logs show --name APP -g RG --follow
# Function App logs (query App Insights traces)
az monitor app-insights query --apps APP-INSIGHTS -g RG \
--analytics-query "traces | where timestamp > ago(1h) | order by timestamp desc | take 50"
AppLens (MCP Tools)
For AI-powered diagnostics, use:
mcp_azure_mcp_applens
intent: "diagnose issues with <resource-name>"
command: "diagnose"
parameters:
resourceId: "<resource-id>"
Provides:
- Automated issue detection
- Root cause analysis
- Remediation recommendations
Azure Monitor (MCP Tools)
For querying logs and metrics:
mcp_azure_mcp_monitor
intent: "query logs for <resource-name>"
command: "logs_query"
parameters:
workspaceId: "<workspace-id>"
query: "<KQL-query>"
See kql-queries.md for common diagnostic queries.
Check Azure Resource Health
Using MCP
mcp_azure_mcp_resourcehealth
intent: "check health status of <resource-name>"
command: "get"
parameters:
resourceId: "<resource-id>"
Using CLI
# Check specific resource health
az resource show --ids RESOURCE_ID
# Check recent activity
az monitor activity-log list -g RG --max-events 20
References
Thêm skills từ Azure
azure-ai
Azure
Sử dụng cho Azure AI: Tìm kiếm, Giọng nói, OpenAI, Trí tuệ Tài liệu. Hỗ trợ tìm kiếm, tìm kiếm vector/kết hợp, chuyển giọng nói thành văn bản, chuyển văn bản thành giọng nói, phiên âm, OCR.
appinsights-instrumentation
Azure
Hướng dẫn về việc đo lường ứng dụng web với Azure Application Insights. Cung cấp các mẫu telemetry, thiết lập SDK và tham chiếu cấu hình.
azure-aigateway
Azure
Cấu hình Azure API Management (APIM) làm AI Gateway để bảo mật, quan sát, kiểm soát các mô hình AI, máy chủ MCP, tác nhân. Hỗ trợ giới hạn tốc độ, bộ nhớ đệm ngữ nghĩa, an toàn nội dung, cân bằng tải.
azure-compliance
Azure
Khả năng kiểm tra tuân thủ và bảo mật toàn diện của Azure bao gồm đánh giá các phương pháp hay nhất, giám sát hết hạn Key Vault và xác thực cấu hình tài nguyên.
azure-compute
Azure
Đề xuất kích thước máy ảo Azure, VM Scale Sets (VMSS) và cấu hình dựa trên yêu cầu khối lượng công việc, nhu cầu hiệu suất và hạn chế ngân sách.
azure-cost-optimization
Azure
Xác định và định lượng các khoản tiết kiệm chi phí trên các đăng ký Azure bằng cách phân tích chi phí thực tế, số liệu sử dụng và đưa ra các khuyến nghị tối ưu hóa có thể thực hiện được.
azure-deploy
Azure
Thực thi triển khai lên Azure. Bước cuối cùng sau khi chuẩn bị và xác thực. Chạy các lệnh azd up, azd deploy hoặc cung cấp hạ tầng.
azure-hosted-copilot-sdk
Azure
Xây dựng và triển khai các ứng dụng GitHub Copilot SDK lên Azure.