Yandex Cloud
Поиск
Связаться с экспертомПопробовать бесплатно
  • Кейсы
  • Документация
  • Блог
  • Все сервисы
    • Cloud Interconnect
    • Cloud Backup
    • Cloud Registry
    • Yandex AI Studio
    • Compute Cloud
    • Object Storage
    • Managed Service for Kubernetes®
    • Yandex BareMetal
    • Smart Web Security
    • Security Deck
    • Managed Service for PostgreSQL
    • Managed Service for ClickHouse®
    • Monium
    • Cloud CDN
    • Network Load Balancer
    • Virtual Private Cloud
    • Cloud DNS
    • Application Load Balancer
    • Yandex Cloud Video
    • Stackland
    • Yandex Cloud Router
    • Yandex Managed Service for Trino
    • Managed Service for MySQL®
    • Managed Service for Valkey™
    • Managed Service for Apache Spark™
    • Yandex StoreDoc
    • Managed Service for OpenSearch
    • Managed Service for Apache Kafka®
    • Data Transfer
    • Yandex MPP Analytics Engine for PostgreSQL
    • Yandex Managed Service for Apache Airflow®
    • Data Processing
    • Yandex MetaData Hub
    • Managed Service for YDB
    • Managed Service for Sharded PostgreSQL
    • Managed Service for YTsaurus
    • Yandex WebSQL
    • DataLens
    • Yandex Search API
    • SpeechSense
    • SpeechKit
    • DataSphere
    • Vision OCR
    • Translate
    • Yandex Neurosupport
    • VibeCraft
    • Yandex Cloud Detection and Response
    • Yandex Identity Hub
    • Key Management Service
    • Certificate Manager
    • Yandex Lockbox
    • Audit Trails
    • SmartCaptcha
    • Cloud Desktop
    • GOST Gateway
    • Yandex SIEM
    • SourceCraft Code Assistant
    • Container Registry
    • Managed Service for GitLab
    • SourceCraft
    • Managed Service for Prometheus®
    • Cloud Functions
    • API Gateway
    • Yandex Cloud Postbox
    • Message Queue
    • Serverless Integrations
    • IoT Core
    • Data Streams
    • Serverless Containers
    • Cloud Notification Service
    • Yandex Query
    • Identity and Access Management
    • Yandex Cloud Console
    • Resource Manager
    • Yandex Cloud Billing
    • Yandex Cloud Quota Manager
    • Cloud Apps
  • Статус работы сервисов
  • Marketplace
    • Популярные
    • Инфраструктура и сеть
    • Платформа данных
    • Искусственный интеллект
    • Безопасность
    • Инструменты DevOps
    • Бессерверные вычисления
    • Управление ресурсами
  • Все решения
    • По отраслям
    • По типу задач
    • Экономика платформы
    • Yandex Cloud Trust
    • Техническая поддержка
    • Каталог партнёров
    • Обучение и сертификация
    • Облако для стартапов
    • Облако для крупного бизнеса
    • Центр технологий для общества
    • Облако для интеграторов
    • Поддержка IT-бизнеса
    • Облако для фрилансеров
    • Обучение и сертификация
    • Блог
    • Документация
    • Контент-программа
    • Мероприятия и вебинары
    • Контакты, чаты и сообщества
    • Идеи
    • Калькулятор цен
    • Тарифы
    • Акции и free tier
  • Кейсы
  • Документация
  • Блог
Создавайте контент и получайте гранты!Готовы написать своё руководство? Участвуйте в контент-программе и получайте гранты на работу с облачными сервисами!
Подробнее о программе
Проект Яндекса
© 2026 ООО «Яндекс.Облако»
Yandex MPP Analytics for PostgreSQL
  • Начало работы
    • Обзор СУБД Greenplum® и Apache Cloudberry™ в сервисе Yandex MPP Analytics for PostgreSQL
    • Взаимосвязь ресурсов сервиса
    • Классы хостов
    • Высокая доступность кластера
    • Расчет конфигурации кластера
    • Сеть в Yandex MPP Analytics for PostgreSQL
    • Квоты и лимиты
    • Резервные копии
    • Ресурсные группы
    • Распределение данных
    • Пользователи и роли
    • Аутентификация пользователей
    • Командный центр
    • Параметры командного центра
    • Внешние таблицы
    • Управление соединениями
    • Расширение кластера
    • Техническое обслуживание
    • Очистка таблиц и системного каталога
    • Настройки СУБД
  • Управление доступом
  • Инспекции и рекомендации
  • Правила тарификации
  • Справочник Terraform
  • Метрики Monitoring
  • Аудитные логи Audit Trails
  • Публичные материалы
  • История изменений
  • Обучающие курсы

В этой статье:

  • Выбор политики распределения
  • Ключ распределения
  • Выбор ключа распределения
  1. Концепции
  2. Распределение данных

Распределение данных в Yandex MPP Analytics for PostgreSQL

Статья создана
Yandex Cloud
Обновлена 1 сентября 2026 г.
Открыть в Markdown
  • Выбор политики распределения
  • Ключ распределения
    • Выбор ключа распределения

В Yandex MPP Analytics for PostgreSQL все таблицы в базе данных построчно распределены по хостам-сегментам кластера. Политика распределения данных — это правило, по которому строки таблицы распределяются по сегментам.

В Yandex MPP Analytics for PostgreSQL доступны следующие политики распределения:

  • Хеш-распределение — строки распределяются по сегментам на основе хеш-функции, которая применяется к значениям одного или нескольких столбцов, определенных в качестве ключа распределения.
  • Случайное распределение — строки распределяются по всем сегментам циклически (round-robin).
  • Реплицированное распределение — копия таблицы хранится на каждом сегменте кластера.

Вы можете настроить политику распределения для новой таблицы, а также изменить политику и ключ распределения для существующей таблицы. Если при создании таблицы политика распределения не указана, используется хеш-распределение. В качестве ключа распределения используется первичный ключ (PRIMARY KEY). Если он не задан, выбирается первый подходящий столбец таблицы. Подробнее о выборе ключа распределения, если политика распределения не указана, в документации Greenplum® и в документации Apache Cloudberry™.

Выбор политики распределенияВыбор политики распределения

В Yandex MPP Analytics for PostgreSQL производительность запросов зависит от того, как данные распределены между сегментами кластера. Если данные распределены неравномерно, сегменты обрабатывают разный объем данных. Это может привести к неравномерной нагрузке и нехватке памяти на отдельных сегментах. На производительность запросов также влияет то, как выполняются операции объединения (JOIN). Если таблицы распределены по одному и тому же ключу, строки с одинаковыми значениями ключа хранятся на одном сегменте. Это позволяет выполнять операции объединения локально, без передачи данных между сегментами.

Чтобы обеспечить равномерную нагрузку на сегменты, выбирайте политику распределения следующим образом:

  • Хеш-распределение — если для таблицы можно подобрать подходящий ключ распределения.

  • Случайное распределение — если для таблицы не удается подобрать подходящий ключ распределения.

    При случайном распределении отдельные операции INSERT и COPY могут привести к неравномерному распределению данных между сегментами. Кроме того, для таблиц со случайным распределением операции объединения не могут выполняться локально.

  • Реплицированное распределение — для небольших таблиц, например для словарей.

Ключ распределенияКлюч распределения

Ключ распределения — это один или несколько столбцов таблицы, значения которых используются для определения сегмента, на котором хранится строка. От выбора ключа распределения зависит равномерность распределения данных между сегментами.

Выбор ключа распределенияВыбор ключа распределения

В качестве ключа распределения выбирайте столбцы, которые часто используются в операциях объединения. Если в таблице есть первичный ключ, то он должен включать все столбцы ключа распределения. Также если в таблице есть уникальное ограничение, то оно должно включать все столбцы ключа распределения.

При выборе ключа распределения старайтесь избегать столбцов, которые могут привести к неравномерному распределению данных:

  • столбцов с датой и временем;
  • столбцов с большим количеством одинаковых значений;
  • столбцов с большим количеством значений NULL;
  • столбцов, которые используются в WHERE.

Столбцы с геометрическими и пользовательскими типами данных не могут быть выбраны в качестве ключа распределения.

Если для равномерного распределения данных одного столбца недостаточно, используйте составной ключ из двух столбцов. Использование ключа из трех и более столбцов не повышает равномерность распределения данных, а только увеличивает время хеширования.

Подробнее о распределении данных в документации Greenplum® и в документации Apache Cloudberry™.

Greenplum® и Greenplum Database® являются зарегистрированными товарными знаками или товарными знаками Broadcom Inc в США и/или других странах.

Apache® и Apache Cloudberry™ являются зарегистрированными товарными знаками или товарными знаками Apache Software Foundation в США и/или других странах.

Была ли статья полезна?

Предыдущая
Ресурсные группы
Следующая
Пользователи и роли
Создавайте контент и получайте гранты!Готовы написать своё руководство? Участвуйте в контент-программе и получайте гранты на работу с облачными сервисами!
Подробнее о программе
Проект Яндекса
© 2026 ООО «Яндекс.Облако»