Yandex Cloud
Поиск
Связаться с экспертомПопробовать бесплатно
  • Кейсы
  • Документация
  • Блог
  • Все сервисы
    • Cloud Interconnect
    • Cloud Backup
    • Cloud Registry
    • Yandex AI Studio
    • Compute Cloud
    • Object Storage
    • Managed Service for Kubernetes®
    • Yandex BareMetal
    • Smart Web Security
    • Security Deck
    • Managed Service for PostgreSQL
    • Managed Service for ClickHouse®
    • Monium
    • Cloud CDN
    • Network Load Balancer
    • Virtual Private Cloud
    • Cloud DNS
    • Application Load Balancer
    • Yandex Cloud Video
    • Stackland
    • Yandex Cloud Router
    • Yandex Managed Service for Trino
    • Managed Service for MySQL®
    • Managed Service for Valkey™
    • Managed Service for Apache Spark™
    • Yandex StoreDoc
    • Managed Service for OpenSearch
    • Managed Service for Apache Kafka®
    • Data Transfer
    • Yandex MPP Analytics Engine for PostgreSQL
    • Yandex Managed Service for Apache Airflow®
    • Data Processing
    • Yandex MetaData Hub
    • Managed Service for YDB
    • Managed Service for Sharded PostgreSQL
    • Managed Service for YTsaurus
    • Yandex WebSQL
    • DataLens
    • Yandex Search API
    • SpeechSense
    • SpeechKit
    • DataSphere
    • Vision OCR
    • Translate
    • Yandex Neurosupport
    • Yandex Cloud Detection and Response
    • Yandex Identity Hub
    • Key Management Service
    • Certificate Manager
    • Yandex Lockbox
    • Audit Trails
    • SmartCaptcha
    • Cloud Desktop
    • GOST Gateway
    • Yandex SIEM
    • SourceCraft Code Assistant
    • Container Registry
    • Managed Service for GitLab
    • SourceCraft
    • Managed Service for Prometheus®
    • Cloud Functions
    • API Gateway
    • Yandex Cloud Postbox
    • Message Queue
    • Serverless Integrations
    • IoT Core
    • Data Streams
    • Serverless Containers
    • Cloud Notification Service
    • Yandex Query
    • Identity and Access Management
    • Yandex Cloud Console
    • Resource Manager
    • Yandex Cloud Billing
    • Yandex Cloud Quota Manager
    • Cloud Apps
  • Статус работы сервисов
  • Marketplace
    • Популярные
    • Инфраструктура и сеть
    • Платформа данных
    • Искусственный интеллект
    • Безопасность
    • Инструменты DevOps
    • Бессерверные вычисления
    • Управление ресурсами
  • Все решения
    • По отраслям
    • По типу задач
    • Экономика платформы
    • Yandex Cloud Trust
    • Техническая поддержка
    • Каталог партнёров
    • Обучение и сертификация
    • Облако для стартапов
    • Облако для крупного бизнеса
    • Центр технологий для общества
    • Облако для интеграторов
    • Поддержка IT-бизнеса
    • Облако для фрилансеров
    • Обучение и сертификация
    • Блог
    • Документация
    • Контент-программа
    • Мероприятия и вебинары
    • Контакты, чаты и сообщества
    • Идеи
    • Калькулятор цен
    • Тарифы
    • Акции и free tier
  • Кейсы
  • Документация
  • Блог
Создавайте контент и получайте гранты!Готовы написать своё руководство? Участвуйте в контент-программе и получайте гранты на работу с облачными сервисами!
Подробнее о программе
Проект Яндекса
© 2026 ООО «Яндекс.Облако»
Yandex DataSphere
  • Начало работы
    • О сервисе DataSphere
    • Взаимосвязь ресурсов в DataSphere
    • Сообщества
    • Управление расходами
    • Проект
    • Конфигурации вычислительных ресурсов
      • Список предустановленного ПО
      • Доступные команды
        • Способы работы с кластерами Apache Spark™
        • Вычисления на кластерах Apache Spark™
        • Особенности работы с временными кластерами Yandex Data Processing
    • Фундаментальные модели
    • Квоты и лимиты
    • Специальные условия для образования
  • Справочник Terraform
  • Аудитные логи Audit Trails
  • Управление доступом
  • Правила тарификации
  • Публичные материалы
  • История изменений

В этой статье:

  • Варианты развертывания кластеров
  • Настройки проекта DataSphere для работы с кластерами Yandex Data Processing
  1. Концепции
  2. DataSphere Notebook
  3. Вычисления на кластерах Apache Spark™
  4. Способы работы с кластерами Apache Spark™

Способы работы с кластерами Apache Spark™ в DataSphere

Статья создана
Yandex Cloud
Обновлена 16 июня 2026 г.
Открыть в Markdown
  • Варианты развертывания кластеров
  • Настройки проекта DataSphere для работы с кластерами Yandex Data Processing

Сервис Yandex Data Processing позволяет разворачивать кластеры Apache Spark™. Вы можете использовать кластеры Yandex Data Processing, чтобы запускать распределенные обучения на кластерах.

Варианты развертывания кластеровВарианты развертывания кластеров

Чтобы работать в DataSphere с кластерами Yandex Data Processing, вы можете использовать:

  • коннектор Spark;
  • Livy-сессию.

Если у вас нет существующих кластеров Yandex Data Processing или кластер нужен на непродолжительное время, вы можете использовать временные кластеры Yandex Data Processing. Их можно создать с помощью:

  • коннектора Spark (предпочтительный способ);
  • шаблона Yandex Data Processing.

Все кластеры Yandex Data Processing вне зависимости от варианта развертывания тарифицируются по правилам сервиса Yandex Data Processing.

Настройки проекта DataSphere для работы с кластерами Yandex Data ProcessingНастройки проекта DataSphere для работы с кластерами Yandex Data Processing

Для работы с кластерами Yandex Data Processing:

  1. Укажите в настройках проекта следующие параметры:

    • Каталог по умолчанию для интеграции с другими сервисами Yandex Cloud. В нем будет развернут кластер Yandex Data Processing в рамках текущих квот облака, а стоимость использования кластера будет списана с платежного аккаунта облака.
    • Сервисный аккаунт с ролью vpc.user, от имени которого DataSphere будет работать с сетью кластера Yandex Data Processing.
    • Подсеть для связи DataSphere с кластером Yandex Data Processing. Указанная подсеть должна находиться в зоне доступности, в которой создано сообщество. Кластеру Yandex Data Processing необходим доступ в интернет, поэтому в подсети должен быть настроен NAT-шлюз. После указания подсети время выделения вычислительных ресурсов может быть увеличено.
  2. Создайте сервисного агента:

    1. Чтобы разрешить сервисному агенту работать в DataSphere, попросите администратора или владельца вашего облака выполнить команду в Yandex Cloud CLI:

      yc iam service-control enable datasphere --cloud-id <идентификатор_облака>
      

      Где --cloud-id — идентификатор облака, с которым вы будете работать в сообществе DataSphere.

    2. Создайте сервисный аккаунт с ролями:

      • dataproc.agent — для использования кластеров Yandex Data Processing.
      • dataproc.admin— для создания кластеров из шаблонов Yandex Data Processing.
      • vpc.user — для работы с сетью кластера Yandex Data Processing.
      • iam.serviceAccounts.user — для создания ресурсов в каталоге от имени сервисного аккаунта.
    3. В настройках сообщества в блоке Кластеры Spark нажмите Добавить сервисный аккаунт и выберите созданный сервисный аккаунт.

Важно

Постоянный кластер Yandex Data Processing должен иметь настройку livy:livy.spark.deploy-mode : client.

Полезные ссылкиПолезные ссылки

  • Шаблоны Yandex Data Processing
  • Интеграция с сервисом Yandex Data Processing
  • Коннектор Spark

Была ли статья полезна?

Предыдущая
Доступные команды
Следующая
Вычисления на кластерах Apache Spark™
Создавайте контент и получайте гранты!Готовы написать своё руководство? Участвуйте в контент-программе и получайте гранты на работу с облачными сервисами!
Подробнее о программе
Проект Яндекса
© 2026 ООО «Яндекс.Облако»