Yandex Cloud
Поиск
Связаться с экспертомПопробовать бесплатно
  • Кейсы
  • Документация
  • Блог
  • Все сервисы
    • Cloud Interconnect
    • Cloud Backup
    • Cloud Registry
    • Yandex AI Studio
    • Compute Cloud
    • Object Storage
    • Managed Service for Kubernetes®
    • Yandex BareMetal
    • Smart Web Security
    • Security Deck
    • Managed Service for PostgreSQL
    • Managed Service for ClickHouse®
    • Monium
    • Cloud CDN
    • Network Load Balancer
    • Virtual Private Cloud
    • Cloud DNS
    • Application Load Balancer
    • Yandex Cloud Video
    • Stackland
    • Yandex Cloud Router
    • Yandex Managed Service for Trino
    • Managed Service for MySQL®
    • Managed Service for Valkey™
    • Managed Service for Apache Spark™
    • Yandex StoreDoc
    • Managed Service for OpenSearch
    • Managed Service for Apache Kafka®
    • Data Transfer
    • Yandex MPP Analytics Engine for PostgreSQL
    • Yandex Managed Service for Apache Airflow®
    • Data Processing
    • Yandex MetaData Hub
    • Managed Service for YDB
    • Managed Service for Sharded PostgreSQL
    • Managed Service for YTsaurus
    • Yandex WebSQL
    • DataLens
    • Yandex Search API
    • SpeechSense
    • SpeechKit
    • DataSphere
    • Vision OCR
    • Translate
    • Yandex Neurosupport
    • Yandex Cloud Detection and Response
    • Yandex Identity Hub
    • Key Management Service
    • Certificate Manager
    • Yandex Lockbox
    • Audit Trails
    • SmartCaptcha
    • Cloud Desktop
    • GOST Gateway
    • Yandex SIEM
    • SourceCraft Code Assistant
    • Container Registry
    • Managed Service for GitLab
    • SourceCraft
    • Managed Service for Prometheus®
    • Cloud Functions
    • API Gateway
    • Yandex Cloud Postbox
    • Message Queue
    • Serverless Integrations
    • IoT Core
    • Data Streams
    • Serverless Containers
    • Cloud Notification Service
    • Yandex Query
    • Identity and Access Management
    • Yandex Cloud Console
    • Resource Manager
    • Yandex Cloud Billing
    • Yandex Cloud Quota Manager
    • Cloud Apps
  • Статус работы сервисов
  • Marketplace
    • Популярные
    • Инфраструктура и сеть
    • Платформа данных
    • Искусственный интеллект
    • Безопасность
    • Инструменты DevOps
    • Бессерверные вычисления
    • Управление ресурсами
  • Все решения
    • По отраслям
    • По типу задач
    • Экономика платформы
    • Yandex Cloud Trust
    • Техническая поддержка
    • Каталог партнёров
    • Обучение и сертификация
    • Облако для стартапов
    • Облако для крупного бизнеса
    • Центр технологий для общества
    • Облако для интеграторов
    • Поддержка IT-бизнеса
    • Облако для фрилансеров
    • Обучение и сертификация
    • Блог
    • Документация
    • Контент-программа
    • Мероприятия и вебинары
    • Контакты, чаты и сообщества
    • Идеи
    • Калькулятор цен
    • Тарифы
    • Акции и free tier
  • Кейсы
  • Документация
  • Блог
Создавайте контент и получайте гранты!Готовы написать своё руководство? Участвуйте в контент-программе и получайте гранты на работу с облачными сервисами!
Подробнее о программе
Проект Яндекса
© 2026 ООО «Яндекс.Облако»
Yandex Managed Service for Kubernetes
  • Сопоставление с другими сервисами Yandex Cloud
  • Начало работы
    • Все инструкции
    • Подключение к узлу по SSH
    • Подключение к узлу через OS Login
    • Обновление Kubernetes
    • Настройка автомасштабирования
    • Подключение Terraform-провайдера Kubernetes
    • Установка приложений из Yandex Cloud Marketplace с помощью Terraform
    • Работа с приватными реестрами Docker-образов
      • Информация об имеющихся группах узлов
      • Создание группы узлов
      • Создание группы с узлами из пула резервов ВМ
      • Подключение к узлу по SSH
      • Подключение к узлу через OS Login
      • Настройка автомасштабирования
      • Изменение группы узлов
      • Техническое обслуживание узлов без потери ресурсов
      • Управление Kubernetes-метками узлов
      • Удаление группы узлов
  • Управление доступом
  • Правила тарификации
  • Справочник Terraform
  • Метрики Monitoring
  • Аудитные логи Audit Trails
  • История изменений
  • Обучающие курсы

В этой статье:

  • С использованием пула резервов ВМ
  • С заданием на техническое обслуживание
  1. Пошаговые инструкции
  2. Управление группой узлов
  3. Техническое обслуживание узлов без потери ресурсов

Техническое обслуживание узлов кластера без потери ресурсов

Статья создана
Yandex Cloud
Обновлена 4 сентября 2026 г.
Открыть в Markdown
  • С использованием пула резервов ВМ
  • С заданием на техническое обслуживание

При техническом обслуживании и обновлении может потребоваться перезапустить или пересоздать узлы кластера Managed Service for Kubernetes. При этом ресурсы узлов возвращаются в общий доступ и могут быть заняты другими пользователями.

Резервирование особенно актуально для ресурсов с ограниченной доступностью, например GPU. Если при перезапуске узла с GPU GPU-конфигурация окажется занята, запуск завершится ошибкой.

Сохранить ресурсы при обслуживании можно двумя способами:

  • С использованием пула резервов ВМ — подходит для любых сценариев перезапуска или пересоздания узлов.
  • С заданием на техническое обслуживание — подходит, если в сервисе Compute Cloud есть задание на техническое обслуживание узла.

С использованием пула резервов ВМС использованием пула резервов ВМ

Важно

Пулы резервов ВМ тарифицируются: взимается плата за весь свободный объем зарезервированных вычислительных ресурсов ВМ, кластеров GPU и программно ускоренных сетей согласно правилам тарификации Yandex Compute Cloud. Подробнее в разделе Использование пулов резервов ВМ.

Функциональность пулов резервов ВМ находится на стадии Preview.

Ресурсы узла можно зарезервировать с помощью пула резервов ВМ. Тогда при перезапуске или пересоздании узла ресурсы сохранятся в пуле, а не перейдут в общий доступ — узел запустится заново именно на них.

  1. Создайте пул резервов ВМ с размером 0 и конфигурацией существующих узлов. Например, с нужными параметрами GPU.

  2. Расширьте пул до нужного количества узлов, включив опцию ожидания ресурсов --allow-pending-slots. Параметр позволяет добавить слоты, даже если в зоне доступности временно недостаточно свободных ресурсов.

    Слоты, на которые в момент расширения не хватило ресурсов, перейдут в статус ожидания pending.

  3. Привяжите узлы существующего кластера Managed Service for Kubernetes к созданному пулу.

Узлы кластера Managed Service for Kubernetes займут свободные слоты в пуле. Далее узлы будут запущены или созданы заново на зарезервированных ресурсах пула.

С заданием на техническое обслуживаниеС заданием на техническое обслуживание

Важно

Этот способ обслуживания без потери ресурсов подходит только для случаев, когда задание на техническое обслуживание поставлено Compute Cloud.

Если вы хотите самостоятельно перезапустить или пересоздать узел без потери ресурсов, используйте пул резервов ВМ.

Compute Cloud периодически выполняет техническое обслуживание оборудования, необходимого для работы виртуальных машин. В некоторых случаях техническое обслуживание требует перезапуска ВМ с GPU.

Для выполнения задания на техническое обслуживание ресурсы ВМ с GPU резервируются автоматически и не возвращаются в общий доступ при перезапуске — для обслуживания достаточно снять нагрузку с узла и выполнить перезапуск через Compute Cloud.

  1. Чтобы определить, какой узел требует обслуживания, посмотрите задания на техническое обслуживание.

  2. Убедитесь, что kubectl подключен к нужному кластеру, и получите список узлов:

    kubectl config current-context
    kubectl get nodes
    

    Имя узла в выводе команды соответствует имени ВМ в Compute Cloud.

  3. Расселите поды с узла командой kubectl drain.

    kubectl drain <имя_узла> \
      --ignore-daemonsets \
      --delete-emptydir-data
    

    Где <имя_узла> — имя узла Kubernetes.

    После выполнения команды узел перейдет в статус SchedulingDisabled — на нем не будут создаваться новые поды, а текущие рабочие поды будут расселены на другие узлы кластера.

    Подробнее о расселении подов — в Расселение подов с узла.

  4. Выполните задание на техническое обслуживание немедленно. ВМ перезапустится, при этом Compute Cloud сохранит GPU-ресурсы за ней.

  5. Разрешите размещение подов на узле в консоли управления или командой:

    kubectl uncordon <имя_узла>
    

    Узел снова станет доступен для планирования новых подов.

Полезные ссылкиПолезные ссылки

  • Расселение подов с узла
  • Техническое обслуживание виртуальных машин с GPU
  • Управлять техническим обслуживанием виртуальных машин с GPU
  • Создание группы с узлами из пула резервов ВМ Yandex Compute Cloud

Была ли статья полезна?

Предыдущая
Изменение группы узлов
Следующая
Управление Kubernetes-метками узлов
Создавайте контент и получайте гранты!Готовы написать своё руководство? Участвуйте в контент-программе и получайте гранты на работу с облачными сервисами!
Подробнее о программе
Проект Яндекса
© 2026 ООО «Яндекс.Облако»