Yandex Cloud
Поиск
Связаться с экспертомПопробовать бесплатно
  • Кейсы
  • Документация
  • Блог
  • Все сервисы
    • Cloud Interconnect
    • Cloud Backup
    • Compute Cloud
    • Object Storage
    • Managed Service for Kubernetes®
    • Managed Service for PostgreSQL
    • Managed Service for ClickHouse®
    • Monium
    • Cloud CDN
    • Network Load Balancer
    • Virtual Private Cloud
    • Cloud DNS
    • Application Load Balancer
    • Yandex Cloud Router
    • Managed Service for MySQL®
    • Managed Service for Valkey™
    • Managed Service for Apache Spark™
    • Managed Service for OpenSearch
    • Managed Service for Apache Kafka®
    • Data Transfer
    • Yandex MPP Analytics Engine for PostgreSQL
    • Managed Service for YDB
    • SpeechKit
    • Yandex Identity Hub
    • Key Management Service
    • Certificate Manager
    • Yandex Lockbox
    • Audit Trails
    • Container Registry
    • Managed Service for Prometheus®
    • Message Queue
    • Identity and Access Management
    • Yandex Cloud Console
    • Resource Manager
    • Yandex Cloud Billing
    • Cloud Apps
    • Yandex AI Studio
    • Yandex BareMetal
    • Smart Web Security
    • Security Deck
    • Yandex Cloud Video
    • Stackland
    • Yandex Managed Service for Apache Airflow®
    • Data Processing
    • Yandex MetaData Hub
    • Yandex WebSQL
    • DataLens
    • Yandex Search API
    • SpeechSense
    • DataSphere
    • Vision OCR
    • Translate
    • Cloud Registry
    • SmartCaptcha
    • Cloud Desktop
    • Yandex SIEM
    • SourceCraft Code Assistant
    • Managed Service for GitLab
    • Cloud Functions
    • API Gateway
    • Yandex Cloud Postbox
    • Serverless Integrations
    • IoT Core
    • Serverless Containers
    • Cloud Notification Service
    • Yandex Query
  • Статус работы сервисов
  • Marketplace
    • Доступны в регионе
    • Инфраструктура и сеть
    • Платформа данных
    • Искусственный интеллект
    • Безопасность
    • Инструменты DevOps
    • Бессерверные вычисления
    • Управление ресурсами
  • Все решения
    • По отраслям
    • По типу задач
    • Экономика платформы
    • Безопасность
    • Техническая поддержка
    • Каталог партнёров
    • Обучение и сертификация
    • Облако для стартапов
    • Облако для крупного бизнеса
    • Центр технологий для общества
    • Партнёрская программа
    • Поддержка IT-бизнеса
    • Облако для фрилансеров
    • Обучение и сертификация
    • Блог
    • Документация
    • Мероприятия и вебинары
    • Контакты, чаты и сообщества
    • Идеи
    • Калькулятор цен
    • Тарифы
    • Акции и free tier
  • Кейсы
  • Документация
  • Блог
Создавайте контент и получайте гранты!Готовы написать своё руководство? Участвуйте в контент-программе и получайте гранты на работу с облачными сервисами!
Подробнее о программе
Проект Яндекса
© 2026 ТОО «Облачные Сервисы Казахстан»
Yandex Managed Service for Sharded PostgreSQL
RU
  • Начало работы
    • Все инструкции
    • Получение информации об имеющихся кластерах
    • Создание кластера
    • Изменение кластера
    • Управление хостами кластера
    • Управление шардами
    • Подключение к базе данных
    • Управление доступом к кластеру
    • Управление резервными копиями
    • Техническое обслуживание
    • Просмотр логов кластера
    • Мониторинг состояния кластера и хостов
    • Управление пользователями
    • Управление базами данных
    • Удаление кластера
    • Обновление цепочки TLS-сертификатов
  • Управление доступом
  • Инспекции и рекомендации
  • Правила тарификации
  • Справочник Terraform
  • Метрики Monitoring
  • Аудитные логи Audit Trails
  • Публичные материалы
  • История изменений

В этой статье:

  • Мониторинг состояния кластера
  • Мониторинг состояния хостов
  • Настройка алертов в Yandex Monitoring
  • Состояние и статус кластера
  • Состояния кластера
  • Статусы кластера
  1. Пошаговые инструкции
  2. Мониторинг состояния кластера и хостов

Мониторинг состояния кластера Sharded PostgreSQL и хостов

Статья создана
Yandex Cloud
Обновлена 5 октября 2026 г.
Открыть в Markdown
  • Мониторинг состояния кластера
  • Мониторинг состояния хостов
  • Настройка алертов в Yandex Monitoring
  • Состояние и статус кластера
    • Состояния кластера
    • Статусы кластера

Данные о состоянии кластера и его хостов доступны в консоли управления. Их можно посмотреть на вкладке Мониторинг страницы управления кластером или в сервисе Yandex Monitoring.

Диагностическая информация о состоянии кластера представлена в виде графиков.

Период обновления графиков:

  • Для хостов стандартной конфигурации и хостов с увеличенным соотношением количества гигабайт RAM к количеству vCPU (memory-optimized): 15 секунд.
  • Для хостов с гарантированной долей vCPU ниже 100% (burstable): 150 секунд.

Примечание

На графиках автоматически применяются наиболее подходящие кратные единицы измерения (мегабайты, гигабайты и т. д.).

Вы можете настроить алерты в сервисе Yandex Monitoring для получения уведомлений о сбоях в работе кластера. В Yandex Monitoring используются два порога срабатывания алерта: Warning и Alarm. При превышении заданного порога вы получите оповещения через настроенные каналы уведомлений.

Мониторинг состояния кластераМониторинг состояния кластера

Чтобы посмотреть детальную информацию о состоянии кластера Managed Service for Sharded PostgreSQL:

  1. Перейдите в сервис Yandex Managed Service for Sharded PostgreSQL.

  2. Нажмите на имя нужного кластера и выберите вкладку Мониторинг.

  3. Чтобы перейти к работе с метриками, дашбордами или алертами в сервисе Yandex Monitoring, нажмите кнопку Открыть в Monium на панели сверху.

На странице появятся следующие графики:

  • В блоке Cluster:

    • SPQR is Alive, [boolean] — работоспособность хостов-роутеров.
    • ETCD is Alive, [boolean] — работоспособность хостов-координаторов.
    • Maximum CPU usage — пиковая загрузка процессорных ядер.
    • Average CPU usage — средняя загрузка процессорных ядер.
    • Maximum memory usage — пиковое использование оперативной памяти (в байтах). При высоких нагрузках значение параметра Free уменьшается, остальные — растут.
  • Sessions → Sessions count — количество активных клиентских подключений к роутеру.

  • Connections → Backend connections count — количество активных подключений от роутера к хостам шардов.

  • В блоке Network:

    • Packets received/sent — интенсивность обмена данными по сети (пакетов/с).
    • Network received/sent bytes — объем полученных и отправленных данных (в байтах).
  • В блоке Time quantiles:

    • Router time quantiles, ms — время выполнения клиентских запросов к каждому роутеру в квантилях, заданных настройкой Time Quantiles.
    • Shard time quantiles, ms — время выполнения запросов от каждого роутера к хостам шардов в квантилях, заданных настройкой Time Quantiles.

Мониторинг состояния хостовМониторинг состояния хостов

Чтобы посмотреть детальную информацию о состоянии отдельных хостов Managed Service for Sharded PostgreSQL:

  1. Перейдите в сервис Yandex Managed Service for Sharded PostgreSQL.
  2. Нажмите на имя нужного кластера и выберите вкладку Мониторинг → Хосты.
  3. Нажмите на строку нужного хоста в списке.

На этой странице выводятся графики, показывающие нагрузку на отдельный хост кластера:

  • CPU usage — загрузка процессорных ядер. При повышении нагрузки значение Idle уменьшается.
  • Memory usage — использование оперативной памяти (в байтах). При высоких нагрузках значение параметра Free уменьшается, остальные — растут.
  • Packets received/sent — интенсивность обмена данными по сети (пакетов/с).
  • Network received/sent bytes — объем полученных и отправленных данных (в байтах).
  • В блоке Time quantiles:
    • Router time quantiles, ms — время выполнения клиентских запросов к роутеру в квантилях, заданных настройкой Time Quantiles.
    • Shard time quantiles, ms — время выполнения запросов от роутера к хостам шардов в квантилях, заданных настройкой Time Quantiles.

Настройка алертов в Yandex MonitoringНастройка алертов в Yandex Monitoring

Чтобы настроить автоматический мониторинг основных показателей состояния кластера:

Консоль управления
  1. В консоли управления выберите каталог с кластером, для которого нужно настроить алерты.
  2. Перейдите в сервис  Monitoring.
  3. В блоке Сервисные дашборды выберите:
    • Managed Service for Sharded PostgreSQL — Cluster Overview для настройки алертов кластера;
    • Managed Service for Sharded PostgreSQL — Host Overview для настройки алертов хостов.
  4. На нужном графике нажмите на значок и выберите пункт Создать алерт.
  5. Если на графике несколько показателей, выберите запрос данных для формирования метрики и нажмите Продолжить. Подробнее о языке запросов читайте в документации Yandex Monitoring.
  6. Задайте значения порогов Alarm и Warning для срабатывания алерта.
  7. Нажмите кнопку Создать алерт.

Чтобы настроить автоматический мониторинг других показателей состояния кластера:

Консоль управления
  1. Создайте алерт.
  2. Добавьте метрику состояния.
  3. В параметрах алерта задайте значения порогов для оповещения.

Рекомендуемые значения порогов для некоторых метрик:

Метрика Обозначение Alarm Warning
Количество работоспособных хостов-роутеров spqr-is-alive <количество_хостов-роутеров> - 2 <количество_хостов-роутеров> - 1
Количество работоспособных хостов-координаторов etcd-is-alive <количество_хостов-координаторов> - 2 <количество_хостов-координаторов> - 1

Состояние и статус кластераСостояние и статус кластера

Состояние кластера указывает на исправность его хостов, а Статус показывает, запущен кластер, остановлен или находится в промежуточном состоянии.

Чтобы посмотреть состояние и статус кластера:

  1. Перейдите на страницу каталога и выберите Yandex Managed Service for Sharded PostgreSQL.
  2. Наведите курсор на индикатор в столбце Доступность в строке нужного кластера.

Состояния кластераСостояния кластера

Состояние Описание Предлагаемые действия
ALIVE Кластер работает в штатном режиме. Действий не требуется.
DEGRADED Кластер работает не на полную мощность: минимум один из хостов имеет состояние, отличное от ALIVE. Выполните диагностику:
  • Перейдите на вкладку Хосты и посмотрите, какие из них в нерабочем состоянии.
  • Перейдите на вкладку Операции и убедитесь, что все операции завершились.
  • Убедитесь, что кластер не находится в процессе технического обслуживания.
Если причины не удалось выяснить самостоятельно, обратитесь в службу поддержки.
DEAD Кластер неработоспособен: ни один его хост не работает. Составьте обращение в службу поддержки, указав:
  • Идентификатор кластера.
  • Идентификаторы последних операций, которые на нем выполнялись.
  • Время по графикам доступности, когда кластер перешел в состояние DEAD.
UNKNOWN Состояние кластера неизвестно. Составьте обращение в службу поддержки, указав:
  • Идентификатор кластера.
  • Идентификаторы последних операций, которые на нем выполнялись.
  • Время по графикам доступности, когда кластер перешел в состояние UNKNOWN.

Восстановление кластера в состоянии DEADВосстановление кластера в состоянии DEAD

Если кластер находится в состоянии DEAD, создайте запрос в техническую поддержку. Если кластер небольшой, можно попробовать восстановить его из резервной копии, не дожидаясь обработки обращения. Время восстановления зависит от объема данных и конфигурации нового кластера.

При восстановлении будет создан отдельный кластер. Выберите доступную резервную копию или момент восстановления с учетом допустимой потери последних изменений: данные, записанные позже выбранного момента, в новый кластер не попадут. После восстановления переключите приложения на новый кластер.

Если причиной недоступности стала высокая нагрузка, восстановление из резервной копии само по себе ее не устранит. До возобновления полной нагрузки ограничьте интенсивность запросов, а после восстановления проанализируйте потребление ресурсов и оптимизируйте нагрузку, чтобы проблема не повторилась.

  1. Восстановите кластер из резервной копии.

    Резервная копия Managed Service for Sharded PostgreSQL содержит конфигурацию шардов, а данные шардов хранятся в резервных копиях соответствующих кластеров Managed Service for PostgreSQL. Если недоступен кластер с данными шарда, восстановите его отдельно. Подробнее о составе копий — в разделе Резервные копии.

  2. Обновите параметры подключения в приложениях и проверьте доступ к данным в новом кластере.

  3. Проверьте нагрузку на роутеры, координаторы и хосты шардов. Используйте рекомендации по выбору ресурсов.

Статусы кластераСтатусы кластера

Статус Описание Предлагаемые действия
CREATING Идет подготовка к первому запуску Подождите немного и приступайте к работе. Время создания кластера зависит от класса хостов.
RUNNING Кластер работает в штатном режиме Действий не требуется.
STOPPING Кластер останавливается Через некоторое время кластеру будет присвоен статус STOPPED, и он будет выведен из работы. Действий не требуется.
STOPPED Кластер остановлен Запустите кластер, чтобы вернуть его в работу.
STARTING Остановленный ранее кластер запускается Через некоторое время кластеру будет присвоен статус RUNNING. Подождите немного и приступайте к работе.
UPDATING Обновляется конфигурация кластера По завершении обновления кластеру будет присвоен статус, который был до обновления: RUNNING или STOPPED.
ERROR Произошла ошибка при выполнении операции с кластером или во время окна технического обслуживания Если кластер долго находится в этом статусе, обратитесь в службу поддержки. Доступность кластера можно определить по его состоянию.
STATUS_UNKNOWN Кластер не может определить свой статус Если кластер долго находится в этом статусе, обратитесь в службу поддержки.

Была ли статья полезна?

Предыдущая
Просмотр логов кластера
Следующая
Управление пользователями
Создавайте контент и получайте гранты!Готовы написать своё руководство? Участвуйте в контент-программе и получайте гранты на работу с облачными сервисами!
Подробнее о программе
Проект Яндекса
© 2026 ТОО «Облачные Сервисы Казахстан»