ml ai

Turn on AI + ML features in Grafana Cloud — Grafana Assistant (NL → PromQL/LogQL/TraceQL, dashboard build, incident investigation, MCP integration), Dynamic Alerting (Prophet forecasting + DBSCAN outlier detection), Sift (8-analysis automated root-cause), Knowledge Graph + RCA Workbench, and the LLM Plugin (OpenAI / Anthropic / Azure / Ollama / vLLM / LiteLLM). Use when you want anomaly alerts

GLGrafana Labs official Данные

Что делает навык

Skill интегрирует функции AI и ML в Grafana Cloud, обеспечивая прогнозирование метрик, обнаружение аномалий, автоматизированный поиск первопричин (RCA) и взаимодействие с LLM через Grafana Assistant. Он позволяет создавать динамические оповещения на основе исторических данных и проводить расследования инцидентов с помощью алгоритмов машинного обучения.

Когда применять

  • Настройка прогнозирующих оповещений для метрик с сезонностью (например, нагрузка CPU) с использованием алгоритма Prophet.
  • Обнаружение сервисов-аномалий, отклоняющихся от группы однотипных сервисов, с помощью алгоритма DBSCAN.
  • Автоматизированное расследование инцидентов (Sift) для поиска первопричин сбоев на основе анализа логов, метрик и трасс.
  • Интеграция Grafana Assistant для ответов на вопросы на естественном языке (NL) к PromQL/LogQL/TraceQL и анализа панелей.
  • Подключение внешних LLM-провайдеров (OpenAI, Anthropic, Azure, Ollama и др.) для расширения возможностей анализа данных.

Как работает

  1. Подготовьте стек Grafana Cloud (Pro/Advanced) и API-токен с правами plugins:write.
  2. Создайте задачу прогнозирования (forecast) или обнаружения выбросов (outlier) через API ML App, указав метрику, источник данных и параметры алгоритма.
  3. Проверьте создание целевых метрик (например, ml_forecast_upper или ml_outlier_score) в Prometheus/Explore.
  4. Настройте правило алертинга, срабатывающее при превышении фактических значений над прогнозируемыми границами или порогом аномальности.
  5. Для расследования инцидентов запустите Sift-запрос через API, указав временной интервал и фильтры, затем откройте результат в UI.
  6. Настройте LLM Plugin через provisioning или UI, проверьте статус здоровья эндпоинта и используйте иконку Assistant на панелях.

Примеры запросов агенту

Создай задачу прогнозирования нагрузки CPU на 7 дней вперед, используя 90-дневную историю, и настрой алерт при превышении верхней границы.
Найди сервисы, которые генерируют аномально много ошибок 5xx по сравнению с другими, используя алгоритм DBSCAN.
Запусти расследование инцидента для сервиса checkout в период с 10:00 до 10:30 1 февраля 2024 года.

Что понадобится

  • Стек Grafana Cloud (Pro или Advanced)
  • API-токен с правами plugins:write
  • История метрик минимум 14 дней (рекомендуется 90 дней) для алгоритмов прогнозирования

Описание составлено по SKILL.md навыка, сверено 05.10.2026.

Как подключить

1Скачать навык
# возьмите папку навыка «ml-ai» из репозитория: # https://github.com/grafana/skills
2Положить папку с SKILL.md к навыкам ассистента
# положите папку навыка туда, где ассистент ищет skills: cp -r ml-ai/ ~/.claude/skills/ml-ai/

Навык — папка с файлом SKILL.md (описание + инструкции) и опциональными скриптами. Ассистент (Claude, Claude Code и совместимые) подхватывает его по описанию и следует шагам.