Yandex Cloud
Поиск
Связаться с экспертомПопробовать бесплатно
  • Кейсы
  • Документация
  • Блог
  • Все сервисы
    • Cloud Interconnect
    • Cloud Backup
    • Compute Cloud
    • Object Storage
    • Managed Service for Kubernetes®
    • Managed Service for PostgreSQL
    • Managed Service for ClickHouse®
    • Monium
    • Cloud CDN
    • Network Load Balancer
    • Virtual Private Cloud
    • Cloud DNS
    • Application Load Balancer
    • Yandex Cloud Router
    • Managed Service for MySQL®
    • Managed Service for Valkey™
    • Managed Service for Apache Spark™
    • Managed Service for OpenSearch
    • Managed Service for Apache Kafka®
    • Data Transfer
    • Yandex MPP Analytics Engine for PostgreSQL
    • Managed Service for YDB
    • SpeechKit
    • Yandex Identity Hub
    • Key Management Service
    • Certificate Manager
    • Yandex Lockbox
    • Audit Trails
    • Container Registry
    • Managed Service for Prometheus®
    • Message Queue
    • Identity and Access Management
    • Yandex Cloud Console
    • Resource Manager
    • Yandex Cloud Billing
    • Cloud Apps
    • Yandex AI Studio
    • Yandex BareMetal
    • Smart Web Security
    • Security Deck
    • Yandex Cloud Video
    • Stackland
    • Yandex Managed Service for Apache Airflow®
    • Data Processing
    • Yandex MetaData Hub
    • Yandex WebSQL
    • DataLens
    • Yandex Search API
    • SpeechSense
    • DataSphere
    • Vision OCR
    • Translate
    • Cloud Registry
    • SmartCaptcha
    • Cloud Desktop
    • Yandex SIEM
    • SourceCraft Code Assistant
    • Managed Service for GitLab
    • Cloud Functions
    • API Gateway
    • Yandex Cloud Postbox
    • Serverless Integrations
    • IoT Core
    • Serverless Containers
    • Cloud Notification Service
    • Yandex Query
  • Статус работы сервисов
  • Marketplace
    • Доступны в регионе
    • Инфраструктура и сеть
    • Платформа данных
    • Искусственный интеллект
    • Безопасность
    • Инструменты DevOps
    • Бессерверные вычисления
    • Управление ресурсами
  • Все решения
    • По отраслям
    • По типу задач
    • Экономика платформы
    • Безопасность
    • Техническая поддержка
    • Каталог партнёров
    • Обучение и сертификация
    • Облако для стартапов
    • Облако для крупного бизнеса
    • Центр технологий для общества
    • Партнёрская программа
    • Поддержка IT-бизнеса
    • Облако для фрилансеров
    • Обучение и сертификация
    • Блог
    • Документация
    • Мероприятия и вебинары
    • Контакты, чаты и сообщества
    • Идеи
    • Калькулятор цен
    • Тарифы
    • Акции и free tier
  • Кейсы
  • Документация
  • Блог
Создавайте контент и получайте гранты!Готовы написать своё руководство? Участвуйте в контент-программе и получайте гранты на работу с облачными сервисами!
Подробнее о программе
Проект Яндекса
© 2026 ТОО «Облачные Сервисы Казахстан»
Yandex Data Transfer
KZ
  • Доступные трансферы
  • Начало работы
    • Все инструкции
    • Подготовка к трансферу
      • Управление эндпоинтами
      • Миграция эндпоинтов в другую зону доступности
        • Приемник
    • Управление трансфером
    • Работа с базами данных во время трансфера
    • Мониторинг состояния трансфера
  • Решение проблем
  • Управление доступом
  • Правила тарификации
  • Справочник Terraform
  • Метрики Monitoring
  • Аудитные логи Audit Trails
  • Публичные материалы
  • Обучающие курсы

В этой статье:

  • Сценарии передачи данных в Apache Iceberg™
  • Настройка источника данных
  • Настройка эндпоинта-приемника Apache Iceberg™
  • Кластер Apache Hive™ Metastore
  • Файловое хранилище
  • Дополнительные настройки
  • Соответствие типов поддерживаемых данных в СУБД и эндпоинте
  1. Пошаговые инструкции
  2. Настройка эндпоинтов
  3. Apache Iceberg™
  4. Приемник

Передача данных в эндпоинт-приемник Apache Iceberg™

Статья создана
Yandex Cloud
Обновлена 21 сентября 2026 г.
Открыть в Markdown
  • Сценарии передачи данных в Apache Iceberg™
  • Настройка источника данных
  • Настройка эндпоинта-приемника Apache Iceberg™
    • Кластер Apache Hive™ Metastore
    • Файловое хранилище
    • Дополнительные настройки
  • Соответствие типов поддерживаемых данных в СУБД и эндпоинте

С помощью сервиса Yandex Data Transfer вы можете переносить данные в таблицы Apache Iceberg™ в кластере Apache Hive™ Metastore и реализовывать различные сценарии переноса, обработки и трансформации данных. Для реализации трансфера:

  1. Ознакомьтесь с возможными сценариями передачи данных.
  2. Настройте один из поддерживаемых источников данных.
  3. Настройте эндпоинт-приемник в Yandex Data Transfer.
  4. Создайте и запустите трансфер.
  5. Выполняйте необходимые действия по работе с таблицами и контролируйте трансфер.

Сценарии передачи данных в Apache Iceberg™Сценарии передачи данных в Apache Iceberg™

Подробное описание возможных сценариев передачи данных в Yandex Data Transfer читайте в разделе Практические руководства.

Настройка источника данныхНастройка источника данных

Настройте один из поддерживаемых источников данных:

  • ClickHouse®
  • Greenplum®
  • MongoDB
  • MySQL®
  • PostgreSQL
  • Elasticsearch
  • Yandex Object Storage
  • Oracle
  • Managed Service for YDB
  • YTsaurus

Полный список поддерживаемых источников и приемников в Yandex Data Transfer читайте в разделе Доступные трансферы.

Настройка эндпоинта-приемника Apache Iceberg™Настройка эндпоинта-приемника Apache Iceberg™

При создании или изменении эндпоинта вы можете задать:

  • Настройки подключения к кластеру Apache Hive™ Metastore.
  • Настройки конфигурации для бакета Yandex Object Storage или пользовательского S3-совместимого хранилища.
  • Дополнительные параметры.

Кластер Apache Hive™ MetastoreКластер Apache Hive™ Metastore

Важно

Для создания или редактирования эндпоинта управляемой базы данных вам потребуется роль managed-metastore.viewer или примитивная роль viewer, выданная на каталог кластера этой управляемой базы данных.

Примечание

Чтобы настроить эндпоинт-приемник Apache Iceberg™ используйте кластер Apache Hive™ Metastore версии 4.2.0 или выше. Версии ниже 4.2.0 не поддерживают REST-протокол для работы с таблицами Apache Iceberg™. Подробнее о протоколах подключения читайте в разделе Кластеры Apache Hive™ Metastore.

Подключение с указанием кластера в Yandex Cloud.

Консоль управления
  • Кластер Apache Hive™ Metastore — идентификатор кластера, каталог которого используется для таблиц Apache Iceberg™.

  • Группы безопасности — выберите облачную сеть для размещения эндпоинта и группы безопасности для сетевого трафика. Это позволит применить указанные правила групп безопасности к ВМ и кластерам в выбранной сети без изменения их настроек. Подробнее читайте в разделе Сеть в Yandex Data Transfer.

    Убедитесь, что выбранные группы безопасности настроены.

Файловое хранилищеФайловое хранилище

Бакет Yandex Object Storage
Пользовательское S3-совместимое хранилище
  • Бакет — имя бакета, в который будут загружаться данные из источника.
  • Сервисный аккаунт — выберите или создайте сервисный аккаунт с ролью storage.uploader, от имени которого сервис Data Transfer будет подключаться к бакету.
  • (Опционально) Эндпоинт — эндпоинт для службы, совместимой с Amazon S3. Оставьте поле пустым для использования Amazon.
  • Регион — регион для отправки запросов.
  • Бакет — имя бакета.
  • Идентификатор статического ключа и Содержимое статического ключа — идентификатор и содержимое ключа AWS для доступа к частному бакету.
  • (Опционально) Префикс пути — префикс путей для записи объектов в бакет.

Дополнительные настройкиДополнительные настройки

Консоль управления
  • Политика очистки — выберите способ очистки данных в базе-приемнике перед переносом:

    • Не очищать — существующие таблицы с данными будут использоваться для дальнейшей записи данных.

    • DROP — полное удаление таблиц, участвующих в трансфере.

    Используйте эту опцию, чтобы при любой активации трансфера в базу-приемник всегда передавалась самая последняя версия схемы таблиц из источника.

  • Параметры записи — настройки записи данных в таблицы Apache Iceberg™:

    • Максимум строк в файле — максимальное число строк в одном файле данных. При значении 0 число строк не ограничено.
    • Максимум байт в файле — максимальный размер (в байтах) одного файла данных. При значении 0 размер файлов не ограничен.
    • Параметры Parquet — настройки формата данных Parquet:
      • Максимум байт в группе — максимальное число строк в группе. При значении 0 число строк в группе не ограничено.
      • Максимум строк в группе — максимальный размер (в байтах) группы строк. При значении 0 размер группы строк не ограничен.
  • Параметры репликации → Интервал коммитов — интервал (в секундах) между коммитами в таблицу Apache Iceberg™ при репликации.

  • Пространство имён по умолчанию — пространство имен в Apache Iceberg™, в которое будут переноситься таблицы, если у базы-источника отсутствует схема данных.

После настройки источника и приемника данных создайте и запустите трансфер.

Соответствие типов поддерживаемых данных в СУБД и эндпоинтеСоответствие типов поддерживаемых данных в СУБД и эндпоинте

Тип Apache Iceberg™

Тип эндпоинта

long

int64

int

int32

int

int16

int

int8

decimal(20, 0)

uint64

long

uint32

int

uint16

int

uint8

float

float

double

double

string

string

string

utf8

boolean

boolean

date

date

timestamp

datetime

timestamp

timestamp

string

any

Была ли статья полезна?

Предыдущая
Миграция эндпоинтов в другую зону доступности
Следующая
Источник
Создавайте контент и получайте гранты!Готовы написать своё руководство? Участвуйте в контент-программе и получайте гранты на работу с облачными сервисами!
Подробнее о программе
Проект Яндекса
© 2026 ТОО «Облачные Сервисы Казахстан»