Главная · Скиллы · azure-diagnostics

azure-diagnosticsдиагностика проблем в Azure продакшене

microsoft/azure-skills

Систематическая отладка продакшена Azure: Container Apps, Function Apps и AKS. AppLens для root cause, KQL-запросы под конкретные ошибки и crash loops.

Установка

npx -y skills add microsoft/azure-skills --skill azure-diagnostics --agent claude-code

Azure Diagnostics

Официальный источник для отладки и устранения неполадок в Azure production-среде. Следуйте инструкциям для систематической диагностики распространённых проблем Azure-сервисов.

Область применения

Активируйте этот скилл, когда пользователь хочет:

  • Отлаживать или устранять неполадки в production
  • Диагностировать ошибки в Azure-сервисах
  • Анализировать логи или метрики приложений
  • Исправить проблемы с image pull, холодным стартом или health probe
  • Выяснить причину сбоя Azure-ресурсов
  • Найти первопричину ошибок приложения
  • Устранить проблемы App Service (высокий CPU, сбои развёртывания, зависания, медленные ответы, TLS/пользовательские домены)
  • Устранить проблемы Azure Function Apps (сбои вызовов, таймауты, ошибки привязок)
  • Устранить проблемы кластеров AKS, узлов, подов, ingress или сети Kubernetes
  • Устранить проблемы Azure Messaging SDK (Event Hubs, Service Bus, AMQP-ошибки, блокировки сообщений)

Правила

  1. Начинайте с систематического процесса диагностики
  2. Используйте AppLens (MCP) для AI-диагностики, если доступен
  3. Проверьте работоспособность ресурса до углублённого анализа логов
  4. Выбирайте руководство по устранению неполадок в зависимости от типа сервиса
  5. Документируйте выводы и предпринятые шаги по исправлению
  6. Направляйте инциденты AKS в специализированный документ по устранению неполадок AKS

Быстрый процесс диагностики

  1. Определить симптомы — что именно не работает?
  2. Проверить работоспособность ресурса — Azure работает нормально?
  3. Изучить логи — что показывают логи?
  4. Проанализировать метрики — паттерны производительности?
  5. Исследовать недавние изменения — что изменилось?

Руководства по устранению неполадок по типу сервиса

СервисТипичные проблемы
Container AppsОшибки image pull, холодный старт, health probe, несоответствие портов
App ServiceВысокий CPU, сбои развёртывания, зависания, медленные ответы, TLS/пользовательские домены
Function AppsСбои вызовов, таймауты, ошибки привязок, холодный старт, отсутствующие настройки приложения
AKSДоступ к кластеру, узлы, kube-system, планирование, crash loops, ingress, DNS, обновления
MessagingОшибки SDK Event Hubs и Service Bus, сбои AMQP, блокировка сообщений, подключение

Маршрутизация

  • Диагностика Container Apps и Function Apps выполняется в этом скилле.
  • Активные инциденты AKS → AKS Troubleshooting.
  • Проблемы Azure Messaging SDK (Event Hubs, Service Bus) → Messaging Troubleshooting.

Краткий справочник

Общие диагностические команды

# Проверка работоспособности ресурса
az resource show --ids RESOURCE_ID
# Журнал активности
az monitor activity-log list -g RG --max-events 20
# Логи Container Apps
az containerapp logs show --name APP -g RG --follow
# Логи Function App (запрос трассировок App Insights)
az monitor app-insights query --apps APP-INSIGHTS -g RG \
  --analytics-query "traces | where timestamp > ago(1h) | order by timestamp desc | take 50"

AppLens (MCP-инструменты)

Для AI-диагностики используйте:

mcp_azure_mcp_applens
  intent: "diagnose issues with <resource-name>"
  command: "diagnose"
  parameters:
    resourceId: "<resource-id>"

Предоставляет: автоматическое обнаружение проблем, анализ первопричин, рекомендации по исправлению.

Azure Monitor (MCP-инструменты)

Для запроса логов и метрик:

mcp_azure_mcp_monitor
  intent: "query logs for <resource-name>"
  command: "logs_query"
  parameters:
    workspaceId: "<workspace-id>"
    query: "<KQL-query>"

Проверка работоспособности ресурса Azure

Через MCP

mcp_azure_mcp_resourcehealth
  intent: "check health status of <resource-name>"
  command: "get"
  parameters:
    resourceId: "<resource-id>"

Через CLI

# Проверка работоспособности конкретного ресурса
az resource show --ids RESOURCE_ID

# Проверка недавней активности
az monitor activity-log list -g RG --max-events 20

Из того же репозитория

microsoft-foundryполный цикл AI-агентов на Foundry
microsoft/azure-skills
Деплой, оценка и управление AI-агентами на Microsoft Foundry: контейнеризация, ACR, создание агентов, batch-оценки и оптимизация промптов по данным продакшена.
1.1k364.2k установок
azure-aiAI-сервисы Azure для разработчиков
microsoft/azure-skills
Инструменты Azure AI через MCP для разработчиков: AI Search, Speech, OpenAI и Document Intelligence — интеграция в приложения без управления инфраструктурой.
1.1k362.1k установок
azure-prepareгенерация Azure-инфраструктуры
microsoft/azure-skills
Генерирует Bicep/Terraform, azure.yaml и Dockerfile для новых и существующих приложений перед деплоем в Azure. Обязательный первый шаг трёхэтапного воркфлоу.
1.1k361.7k установок
azure-deployдеплой подготовленных Azure-приложений
microsoft/azure-skills
Выполняет деплой приложений с готовой инфраструктурой: azd up, azd deploy с проверками и обработкой ошибок. Требует предварительной подготовки через azure-prepare.
1.1k361.7k установок
azure-storageхранилище Azure для разработчиков
microsoft/azure-skills
Управление Azure Storage через MCP или CLI: Blob, File Shares, Queue, Table и Data Lake. Сравнение сервисов, уровни доступа, операции с blob через MCP-инструменты.
1.1k361.4k установок
azure-validatepre-deployment валидация Azure
microsoft/azure-skills
Предварительная валидация перед деплоем: конфигурация, Bicep/Terraform, RBAC, managed identity и what-if анализ. Фиксирует результаты в плане деплоя.
1.1k361.1k установок