Yandex Cloud
Поиск
Связаться с экспертомПопробовать бесплатно
  • Кейсы
  • Документация
  • Блог
  • Все сервисы
    • Cloud Interconnect
    • Cloud Backup
    • Cloud Registry
    • Yandex AI Studio
    • Compute Cloud
    • Object Storage
    • Managed Service for Kubernetes®
    • Yandex BareMetal
    • Smart Web Security
    • Security Deck
    • Managed Service for PostgreSQL
    • Managed Service for ClickHouse®
    • Monium
    • Cloud CDN
    • Network Load Balancer
    • Virtual Private Cloud
    • Cloud DNS
    • Application Load Balancer
    • Yandex Cloud Video
    • Stackland
    • Yandex Cloud Router
    • Yandex Managed Service for Trino
    • Managed Service for MySQL®
    • Managed Service for Valkey™
    • Managed Service for Apache Spark™
    • Yandex StoreDoc
    • Managed Service for OpenSearch
    • Managed Service for Apache Kafka®
    • Data Transfer
    • Yandex MPP Analytics Engine for PostgreSQL
    • Yandex Managed Service for Apache Airflow®
    • Data Processing
    • Yandex MetaData Hub
    • Managed Service for YDB
    • Managed Service for Sharded PostgreSQL
    • Managed Service for YTsaurus
    • Yandex WebSQL
    • DataLens
    • Yandex Search API
    • SpeechSense
    • SpeechKit
    • DataSphere
    • Vision OCR
    • Translate
    • Yandex Neurosupport
    • Yandex Cloud Detection and Response
    • Yandex Identity Hub
    • Key Management Service
    • Certificate Manager
    • Yandex Lockbox
    • Audit Trails
    • SmartCaptcha
    • Cloud Desktop
    • GOST Gateway
    • Yandex SIEM
    • SourceCraft Code Assistant
    • Container Registry
    • Managed Service for GitLab
    • SourceCraft
    • Managed Service for Prometheus®
    • Cloud Functions
    • API Gateway
    • Yandex Cloud Postbox
    • Message Queue
    • Serverless Integrations
    • IoT Core
    • Data Streams
    • Serverless Containers
    • Cloud Notification Service
    • Yandex Query
    • Identity and Access Management
    • Yandex Cloud Console
    • Resource Manager
    • Yandex Cloud Billing
    • Yandex Cloud Quota Manager
    • Cloud Apps
  • Статус работы сервисов
  • Marketplace
    • Популярные
    • Инфраструктура и сеть
    • Платформа данных
    • Искусственный интеллект
    • Безопасность
    • Инструменты DevOps
    • Бессерверные вычисления
    • Управление ресурсами
  • Все решения
    • По отраслям
    • По типу задач
    • Экономика платформы
    • Yandex Cloud Trust
    • Техническая поддержка
    • Каталог партнёров
    • Обучение и сертификация
    • Облако для стартапов
    • Облако для крупного бизнеса
    • Центр технологий для общества
    • Облако для интеграторов
    • Поддержка IT-бизнеса
    • Облако для фрилансеров
    • Обучение и сертификация
    • Блог
    • Документация
    • Контент-программа
    • Мероприятия и вебинары
    • Контакты, чаты и сообщества
    • Идеи
    • Калькулятор цен
    • Тарифы
    • Акции и free tier
  • Кейсы
  • Документация
  • Блог
Создавайте контент и получайте гранты!Готовы написать своё руководство? Участвуйте в контент-программе и получайте гранты на работу с облачными сервисами!
Подробнее о программе
Проект Яндекса
© 2026 ООО «Яндекс.Облако»
Yandex Managed Service for Apache Spark™
  • Начало работы
    • Взаимосвязь ресурсов сервиса
    • Сеть в Yandex Managed Service for Apache Spark™
    • Квоты и лимиты
    • Классы хостов
    • Техническое обслуживание
    • Автоматическое масштабирование
    • Свойства Apache Spark™
  • Управление доступом
  • Правила тарификации
  • Метрики Yandex Monitoring
  • Аудитные логи Audit Trails
  • Справочник Terraform
  • История изменений

В этой статье:

  • Управление автоматическим масштабированием
  • Рекомендации по выбору параметров автоматического масштабирования
  1. Концепции
  2. Автоматическое масштабирование

Автоматическое масштабирование в Yandex Managed Service for Apache Spark™

Статья создана
Yandex Cloud
Обновлена 26 сентября 2025 г.
Открыть в Markdown
  • Управление автоматическим масштабированием
  • Рекомендации по выбору параметров автоматического масштабирования

Автоматическое масштабирование — это изменение количества хостов в кластере Apache Spark™ в зависимости от текущей нагрузки.

Пул хостов для драйверов и пул хостов для исполнителей масштабируются независимо друг от друга:

  • Если для запуска нового приложения, т. е. нового драйвера, не хватает свободных ядер или памяти, сервис Yandex Managed Service for Apache Spark™ запускает новый хост в пуле хостов для драйверов. Если число запущенных приложений снижается и в пуле хостов для драйверов появляется простаивающий хост, такой хост удаляется.

  • Если для размещения всех исполнителей каждого запущенного приложения не хватает свободных ядер или свободной памяти, сервис Yandex Managed Service for Apache Spark™ запускает новые хосты в пуле хостов для исполнителей. Если число запущенных исполнителей снижается и в пуле хостов для исполнителей появляется простаивающий хост, такой хост удаляется.

Преимущества автоматического масштабирования:

  • Кластер становится более производительным при запуске требовательных задач, при этом в моменты простоя лишние хосты удаляются, что снижает плату за них.
  • Время выполнения отдельной задачи меньше зависит от количества одновременно запущенных задач.
  • Динамическая аллокация становится более эффективной: пул хостов для исполнителей подстраивается под изменяющиеся потребности приложений.

Управление автоматическим масштабированиемУправление автоматическим масштабированием

Включить и выключить автоматическое масштабирование каждого из двух пулов хостов можно при создании и изменении кластера Apache Spark™.

Для каждого пула хостов можно задать диапазон значений, в котором будет изменяться число хостов в нем:

  • Минимальное число — не меньше 0.
  • Максимальное число — не больше 100 и не меньше, чем минимальное число.

На что влияет минимальное число хостов в пуле:

  • Чем больше минимальное число хостов в пуле для драйверов, тем больше однотипных приложений можно запускать параллельно, не дожидаясь запуска дополнительных хостов.
  • Чем больше минимальное число хостов в пуле для исполнителей, тем большую нагрузку можно направлять на кластер, не дожидаясь запуска дополнительных хостов.
  • С ростом минимального числа хостов в пулах растет плата за кластер при простое и низкой нагрузке.

На что влияет максимальное число хостов в пуле:

  • Чем больше максимальное число хостов в пуле для драйверов, тем больше однотипных приложений можно запустить параллельно.
  • Чем больше максимальное число хостов в пуле для исполнителей, тем выше максимальная производительность кластера.
  • С ростом максимального числа хостов в пулах повышается плата за кластер при максимальной нагрузке.

Рекомендации по выбору параметров автоматического масштабированияРекомендации по выбору параметров автоматического масштабирования

Выбор параметров зависит от конкретного сценария использования кластера, значения в таблице ориентировочные.

На число однотипных заданий, которые можно запустить на кластере параллельно, и на скорость обработки заданий влияют:

  • число хостов в каждом пуле и их класс,
  • параметры каждого задания,
  • объем зарезервированных под внутренние нужды ресурсов кластера,
  • затраты времени на планирование процессов,
  • затраты времени на масштабирование пулов,
  • использование Shuffle-операций.
Сценарий Число хостов для драйверов Число хостов для исполнителей Комментарий
Короткоживущие пакетные задания, скорость выполнения не критична Минимальное — 0. Максимальное — 1. Минимальное — 0. Максимальное — согласно бюджету. Такие значения параметров позволят уменьшить плату за кластер при длительных простоях, однако при запуске задания потребуется время на запуск хостов.
Короткоживущие пакетные задания, скорость выполнения критична Фиксированное — 1. Минимальное — 0. Максимальное — согласно бюджету. Такие значения параметров позволят избежать задержек из-за запуска хостов при старте.
Длительные пакетные задания с интенсивным использованием Shuffle-операций Минимальное — 1. Максимальное — согласно целевым метрикам вашего сервиса. Минимальное — от 2 до 5. Максимальное — согласно бюджету и целевым метрикам вашего сервиса. Такие значения параметров позволят избежать чрезмерного «сжатия» пула хостов для исполнителей при снижении нагрузки между стадиями и затрат времени на повторные увеличения пула.
Эксплуатация общего кластера несколькими командами Минимальное — согласно максимальному числу параллельных заданий. Максимальное — согласно бюджету и целевым метрикам вашего сервиса. Минимальное — от 2 до 5. Максимальное — согласно бюджету и целевым метрикам вашего сервиса. Такие значения параметров позволят избежать задержек из-за запуска хостов при старте при совместном использовании всеми командами.

Была ли статья полезна?

Предыдущая
Техническое обслуживание
Следующая
Свойства Apache Spark™
Создавайте контент и получайте гранты!Готовы написать своё руководство? Участвуйте в контент-программе и получайте гранты на работу с облачными сервисами!
Подробнее о программе
Проект Яндекса
© 2026 ООО «Яндекс.Облако»