Yandex Cloud
Поиск
Связаться с экспертомПопробовать бесплатно
  • Кейсы
  • Документация
  • Блог
  • Все сервисы
    • Cloud Interconnect
    • Cloud Backup
    • Compute Cloud
    • Object Storage
    • Managed Service for Kubernetes®
    • Managed Service for PostgreSQL
    • Managed Service for ClickHouse®
    • Monium
    • Cloud CDN
    • Network Load Balancer
    • Virtual Private Cloud
    • Cloud DNS
    • Application Load Balancer
    • Yandex Cloud Router
    • Managed Service for MySQL®
    • Managed Service for Valkey™
    • Managed Service for Apache Spark™
    • Managed Service for OpenSearch
    • Managed Service for Apache Kafka®
    • Data Transfer
    • Yandex MPP Analytics Engine for PostgreSQL
    • Managed Service for YDB
    • SpeechKit
    • Yandex Identity Hub
    • Key Management Service
    • Certificate Manager
    • Yandex Lockbox
    • Audit Trails
    • Container Registry
    • Managed Service for Prometheus®
    • Message Queue
    • Identity and Access Management
    • Yandex Cloud Console
    • Resource Manager
    • Yandex Cloud Billing
    • Cloud Apps
    • Yandex AI Studio
    • Yandex BareMetal
    • Smart Web Security
    • Security Deck
    • Yandex Cloud Video
    • Stackland
    • Yandex Managed Service for Apache Airflow®
    • Data Processing
    • Yandex MetaData Hub
    • Yandex WebSQL
    • DataLens
    • Yandex Search API
    • SpeechSense
    • DataSphere
    • Vision OCR
    • Translate
    • Cloud Registry
    • SmartCaptcha
    • Cloud Desktop
    • Yandex SIEM
    • SourceCraft Code Assistant
    • Managed Service for GitLab
    • Cloud Functions
    • API Gateway
    • Yandex Cloud Postbox
    • Serverless Integrations
    • IoT Core
    • Serverless Containers
    • Cloud Notification Service
    • Yandex Query
  • Статус работы сервисов
  • Marketplace
    • Доступны в регионе
    • Инфраструктура и сеть
    • Платформа данных
    • Искусственный интеллект
    • Безопасность
    • Инструменты DevOps
    • Бессерверные вычисления
    • Управление ресурсами
  • Все решения
    • По отраслям
    • По типу задач
    • Экономика платформы
    • Безопасность
    • Техническая поддержка
    • Каталог партнёров
    • Обучение и сертификация
    • Облако для стартапов
    • Облако для крупного бизнеса
    • Центр технологий для общества
    • Партнёрская программа
    • Поддержка IT-бизнеса
    • Облако для фрилансеров
    • Обучение и сертификация
    • Блог
    • Документация
    • Мероприятия и вебинары
    • Контакты, чаты и сообщества
    • Идеи
    • Калькулятор цен
    • Тарифы
    • Акции и free tier
  • Кейсы
  • Документация
  • Блог
Создавайте контент и получайте гранты!Готовы написать своё руководство? Участвуйте в контент-программе и получайте гранты на работу с облачными сервисами!
Подробнее о программе
Проект Яндекса
© 2026 ТОО «Облачные Сервисы Казахстан»
Yandex Cloud Stackland
  • Что нового
  • Установка
    • Все руководства
    • Установить Stackland на Yandex BareMetal
    • Установка Stackland на Yandex BareMetal через PXE
    • Установка Stackland на виртуальные машины в Yandex Cloud
    • Настройка внешнего доступа к поду в кластере
    • Все инструкции
    • Проекты
    • Ресурсная модель
    • Масштабирование кластера
    • Лицензирование
      • Обзор
      • Certificate Manager
      • DNS
      • IAM
      • Logging Stack
      • Managed Service for Apache Kafka®
      • Managed Service for PostgreSQL
      • Managed Service for ClickHouse®
      • Iceberg REST Catalog
      • Managed Service for Trino
      • YTsaurus
      • DataLens
      • Monitoring
      • Object Storage
      • Дисковая подсистема
      • Поддержка NVIDIA® GPU
      • Policy Manager
      • Secrets Store
      • SpeechSense
  • Управление доступом
  • Правила тарификации
  • Диагностика и устранение неполадок

В этой статье:

  • Интерфейс Grafana
  • Управление доступом
  • Дашборды метрик
  • Логи
  • Алерты
  • Конфигурация
  • Общий вид
  1. Концепции
  2. Компоненты
  3. Monitoring

Monitoring

Статья создана
Yandex Cloud
Обновлена 3 августа 2026 г.
Открыть в Markdown
  • Интерфейс Grafana
  • Управление доступом
  • Дашборды метрик
  • Логи
  • Алерты
  • Конфигурация
    • Общий вид

Stackland позволяет организовать мониторинг кластера и платформенных компонентов с помощью Prometheus, Grafana и Alertmanager.

  • Prometheus — средство сбора метрик кластера и платформенных компонентов.
  • Grafana — интерфейс для просмотра и визуализации метрик и логов.
  • Alertmanager — средство управления правилами алертинга и отправки уведомлений о проблемах.

Сбор и хранение логов выполняет отдельный компонент Logging Stack. Он подключает источники данных Loki к Grafana.

Интерфейс GrafanaИнтерфейс Grafana

Интерфейс Grafana доступен по адресу https://grafana.sys.<домен кластера>. Для входа используйте кнопку Sign in with Stackland Auth.

Компонент Monitoring подключает к Grafana источники данных prometheus и alertmanager. Компонент Logging Stack добавляет источники stackland-logs и audit-logs. Чтобы проверить подключенные источники, откройте страницу Data sources во вкладке Connections. Для просмотра метрик и логов откройте вкладку Explore.

Управление доступомУправление доступом

В зависимости от роли в кластере пользователю будет назначаться глобальная роль в Grafana. Если пользователь входит в группу stackland-cluster-admins, то в Grafana пользователь сразу получит права администратора. Если входит в stackland-cluster-editors — роль editor. Если пользователь не состоит в группе, то он получит роль viewer.

После входа можно управлять правами на уровне отдельных ресурсов Grafana и отдельных пользователей. Подробнее об управлении доступами читайте в документации Grafana.

Доступ к источникам логов дополнительно проверяет tenant proxy компонента Logging Stack. По умолчанию логи доступны только участникам группы stackland-cluster-admins; роль Grafana Viewer или Editor сама по себе не предоставляет к ним доступ.

Дашборды метрикДашборды метрик

На вкладке Dashboards находятся готовые дашборды: в папке stackland-monitoring находятся дашборды с метриками кластера. В других папках — дашборды с метриками платформенных компонентов, например, stackland-managed-postgres.

Помимо готовых дашбордов, вы можете создать собственные и добавить на них метрики ваших приложений. Про создание дашбордов читайте в разделе Создать дашборд.

ЛогиЛоги

Системные логи можно просмотреть на вкладке Explore с помощью источника stackland-logs, аудитные логи Kubernetes API — с помощью audit-logs. Подробнее см. в разделе Посмотреть логи.

АлертыАлерты

Настройка правил алертинга позволяет получать уведомления о проблемах в кластере или приложениях. Уведомления можно отправлять с помощью электронной почты, очередей сообщений или мессенджеров.

Про создание каналов уведомлений читайте в разделе Создать канал уведомлений.

КонфигурацияКонфигурация

Общий видОбщий вид

apiVersion: stackland.yandex.cloud/v1alpha1
kind: MonitoringConfig
metadata:
  name: main
status:
  datasourceConfigured: true
  grafanaReady: true
  s3ExtensionProvisioned: true
  message: Grafana is ready
  observedGeneration: 1
spec:
  enabled: true
  settings:
    clusterIssuer: stackland-default
    prometheus:
      enabled: true
      replicas: 2
      retention: 15d
      ingressEnabled: true
      storage:
        size: "10Gi"
      resources:
        requests:
          cpu: "1"
          memory: "2Gi"
        limits:
          cpu: "1"
          memory: "2Gi"
      thanos:
        longTermStorage:
          stackland: {}
    alertmanager:
      enabled: true
      replicas: 3
      retention: "240h"
      ingressEnabled: true
      storage:
        enabled: true
        size: "1Gi"
      resources:
        requests:
          cpu: "100m"
          memory: "256Mi"
        limits:
          cpu: "500m"
          memory: "1Gi"
    grafanaOperator:
      enabled: true
      resources:
        requests:
          memory: "128Mi"
          cpu: "50m"
        limits:
          cpu: "200m"
          memory: "512Mi"
    grafana:
      enabled: true
      resources:
        requests:
          cpu: "200m"
          memory: "512Mi"
        limits:
          cpu: "1"
          memory: "2Gi"
    hardwareMonitoring:
      enabled: true
      resources:
        requests:
          cpu: "50m"
          memory: "64Mi"
        limits:
          cpu: "200m"
          memory: "256Mi"

Состояние компонента мониторингаСостояние компонента мониторинга

status:
  datasourceConfigured: true
  grafanaReady: true
  s3ExtensionProvisioned: true
  message: Grafana is ready
  observedGeneration: 1
  • datasourceConfigured — включенные источники данных Prometheus и Alertmanager созданы в Grafana.
  • grafanaReady — Grafana готова к работе.
  • s3ExtensionProvisioned — S3-ресурсы для долгосрочного хранения метрик Thanos переданы под управление Monitoring. Поле имеет значение true, если задан thanos.longTermStorage.stackland и контроллер начал создавать связанные ресурсы.
  • message — сообщение о состоянии Grafana.
  • observedGeneration — активная версия конфигурации.

Общие настройкиОбщие настройки

clusterIssuer: stackland-default
  • clusterIssuer — имя ClusterIssuer для TLS-сертификатов.

AlertmanagerAlertmanager

alertmanager:
  enabled: true
  replicas: 3
  retention: "240h"
  ingressEnabled: true
  storage:
    enabled: true
    storageClass: stackland-ssd
    size: "1Gi"
  resources:
    requests:
      cpu: "100m"
      memory: "256Mi"
    limits:
      cpu: "500m"
      memory: "1Gi"
  • enabled — включает Alertmanager.
  • replicas — количество реплик Alertmanager.
  • retention — срок хранения данных Alertmanager.
  • storage.enabled — включает PVC для состояния Alertmanager. По умолчанию хранилище включено.
  • storage.storageClass — StorageClass для PVC. Если параметр не указан, используется StorageClass кластера по умолчанию.
  • storage.size — размер PVC. Если параметр не указан, используется 1Gi.
  • ingressEnabled — открывает доступ к Alertmanager через Ingress.
  • resources — требования к ресурсам.

Поля storage.enabled, storage.storageClass и storage.size нельзя изменить после создания MonitoringConfig. Для изменения хранилища пересоздайте ресурс.

GrafanaGrafana

grafana:
  enabled: true
  resources:
    requests:
      cpu: "200m"
      memory: "512Mi"
    limits:
      cpu: "1"
      memory: "2Gi"
  • enabled — включает Grafana.
  • resources — требования к ресурсам.

Grafana OperatorGrafana Operator

grafanaOperator:
  enabled: true
  resources:
    requests:
      memory: "128Mi"
      cpu: "50m"
    limits:
      cpu: "200m"
      memory: "512Mi"
  • enabled — включает Grafana Operator.
  • resources — требования к ресурсам.

PrometheusPrometheus

prometheus:
  enabled: true
  replicas: 2
  retention: 15d
  ingressEnabled: true
  storage:
    storageClass: stackland-ssd
    size: "10Gi"
  resources:
    requests:
      cpu: "1"
      memory: "2Gi"
    limits:
      cpu: "1"
      memory: "2Gi"
  thanos:
    longTermStorage:
      stackland: {}
  • enabled — включает Prometheus.
  • replicas — количество реплик Prometheus.
  • retention — срок хранения данных Prometheus.
  • ingressEnabled — открывает доступ к Prometheus через Ingress.
  • resources — требования к ресурсам.
  • storage.storageClass — StorageClass для PVC. Если параметр не указан, используется StorageClass кластера по умолчанию.
  • storage.size — размер PVC; локальная глубина истории ограничивается автоматически как 80% от размера PVC.
  • thanos.longTermStorage.stackland — включает долгосрочное хранение метрик во внутреннем S3. Для использования параметра должен быть включен компонент Object Storage.

Поля storage.storageClass и storage.size нельзя изменить после создания MonitoringConfig. Для изменения хранилища пересоздайте ресурс.

Мониторинг оборудованияМониторинг оборудования

hardwareMonitoring:
  enabled: true
  resources:
    requests:
      cpu: "50m"
      memory: "64Mi"
    limits:
      cpu: "200m"
      memory: "256Mi"
  • enabled — включает сбор метрик состояния оборудования.
  • resources — требования к ресурсам агента мониторинга оборудования.

Была ли статья полезна?

Предыдущая
DataLens
Следующая
Object Storage
Создавайте контент и получайте гранты!Готовы написать своё руководство? Участвуйте в контент-программе и получайте гранты на работу с облачными сервисами!
Подробнее о программе
Проект Яндекса
© 2026 ТОО «Облачные Сервисы Казахстан»