Yandex Cloud
Поиск
Связаться с экспертомПопробовать бесплатно
  • Кейсы
  • Документация
  • Блог
  • Все сервисы
    • Cloud Interconnect
    • Cloud Backup
    • Cloud Registry
    • Yandex AI Studio
    • Compute Cloud
    • Object Storage
    • Managed Service for Kubernetes®
    • Yandex BareMetal
    • Smart Web Security
    • Security Deck
    • Managed Service for PostgreSQL
    • Managed Service for ClickHouse®
    • Monium
    • Cloud CDN
    • Network Load Balancer
    • Virtual Private Cloud
    • Cloud DNS
    • Application Load Balancer
    • Yandex Cloud Video
    • Stackland
    • Yandex Cloud Router
    • Yandex Managed Service for Trino
    • Managed Service for MySQL®
    • Managed Service for Valkey™
    • Managed Service for Apache Spark™
    • Yandex StoreDoc
    • Managed Service for OpenSearch
    • Managed Service for Apache Kafka®
    • Data Transfer
    • Yandex MPP Analytics Engine for PostgreSQL
    • Yandex Managed Service for Apache Airflow®
    • Data Processing
    • Yandex MetaData Hub
    • Managed Service for YDB
    • Managed Service for Sharded PostgreSQL
    • Managed Service for YTsaurus
    • Yandex WebSQL
    • DataLens
    • Yandex Search API
    • SpeechSense
    • SpeechKit
    • DataSphere
    • Vision OCR
    • Translate
    • Yandex Neurosupport
    • Yandex Cloud Detection and Response
    • Yandex Identity Hub
    • Key Management Service
    • Certificate Manager
    • Yandex Lockbox
    • Audit Trails
    • SmartCaptcha
    • Cloud Desktop
    • GOST Gateway
    • Yandex SIEM
    • SourceCraft Code Assistant
    • Container Registry
    • Managed Service for GitLab
    • SourceCraft
    • Managed Service for Prometheus®
    • Cloud Functions
    • API Gateway
    • Yandex Cloud Postbox
    • Message Queue
    • Serverless Integrations
    • IoT Core
    • Data Streams
    • Serverless Containers
    • Cloud Notification Service
    • Yandex Query
    • Identity and Access Management
    • Yandex Cloud Console
    • Resource Manager
    • Yandex Cloud Billing
    • Yandex Cloud Quota Manager
    • Cloud Apps
  • Статус работы сервисов
  • Marketplace
    • Популярные
    • Инфраструктура и сеть
    • Платформа данных
    • Искусственный интеллект
    • Безопасность
    • Инструменты DevOps
    • Бессерверные вычисления
    • Управление ресурсами
  • Все решения
    • По отраслям
    • По типу задач
    • Экономика платформы
    • Безопасность
    • Техническая поддержка
    • Каталог партнёров
    • Обучение и сертификация
    • Облако для стартапов
    • Облако для крупного бизнеса
    • Центр технологий для общества
    • Облако для интеграторов
    • Поддержка IT-бизнеса
    • Облако для фрилансеров
    • Обучение и сертификация
    • Блог
    • Документация
    • Контент-программа
    • Мероприятия и вебинары
    • Контакты, чаты и сообщества
    • Идеи
    • Калькулятор цен
    • Тарифы
    • Акции и free tier
  • Кейсы
  • Документация
  • Блог
Создавайте контент и получайте гранты!Готовы написать своё руководство? Участвуйте в контент-программе и получайте гранты на работу с облачными сервисами!
Подробнее о программе
Проект Яндекса
© 2026 ООО «Яндекс.Облако»
Yandex Data Transfer
  • Доступные трансферы
  • Начало работы
    • Все инструкции
    • Подготовка к трансферу
      • Управление эндпоинтами
      • Миграция эндпоинтов в другую зону доступности
        • Приемник
    • Управление трансфером
    • Работа с базами данных во время трансфера
    • Мониторинг состояния трансфера
  • Решение проблем
  • Управление доступом
  • Правила тарификации
  • Справочник Terraform
  • Метрики Monitoring
  • Аудитные логи Audit Trails
  • Публичные материалы
  • Обучающие курсы

В этой статье:

  • Сценарии передачи данных в Apache Iceberg™
  • Настройка источника данных
  • Настройка эндпоинта-приемника Apache Iceberg™
  • Кластер Apache Hive™ Metastore
  • Файловое хранилище
  • Дополнительные настройки
  1. Пошаговые инструкции
  2. Настройка эндпоинтов
  3. Apache Iceberg®
  4. Приемник

Передача данных в эндпоинт-приемник Apache Iceberg™

Статья создана
Yandex Cloud
Обновлена 8 июля 2026 г.
Открыть в Markdown
  • Сценарии передачи данных в Apache Iceberg™
  • Настройка источника данных
  • Настройка эндпоинта-приемника Apache Iceberg™
    • Кластер Apache Hive™ Metastore
    • Файловое хранилище
    • Дополнительные настройки

С помощью сервиса Yandex Data Transfer вы можете переносить данные в таблицы Apache Iceberg™ в кластере Apache Hive™ Metastore и реализовывать различные сценарии переноса, обработки и трансформации данных. Для реализации трансфера:

  1. Ознакомьтесь с возможными сценариями передачи данных.
  2. Настройте один из поддерживаемых источников данных.
  3. Настройте эндпоинт-приемник в Yandex Data Transfer.
  4. Создайте и запустите трансфер.
  5. Выполняйте необходимые действия по работе с таблицами и контролируйте трансфер.

Сценарии передачи данных в Apache Iceberg™Сценарии передачи данных в Apache Iceberg™

Подробное описание возможных сценариев передачи данных в Yandex Data Transfer читайте в разделе Практические руководства.

Настройка источника данныхНастройка источника данных

Настройте один из поддерживаемых источников данных:

  • ClickHouse®
  • Greenplum®
  • MongoDB
  • MySQL®
  • PostgreSQL
  • Elasticsearch
  • Yandex Object Storage
  • Oracle
  • Managed Service for YDB
  • YTsaurus

Полный список поддерживаемых источников и приемников в Yandex Data Transfer читайте в разделе Доступные трансферы.

Настройка эндпоинта-приемника Apache Iceberg™Настройка эндпоинта-приемника Apache Iceberg™

При создании или изменении эндпоинта вы можете задать:

  • Настройки подключения к кластеру Apache Hive™ Metastore.
  • Настройки конфигурации для бакета Yandex Object Storage или пользовательского S3-совместимого хранилища.
  • Дополнительные параметры.

Кластер Apache Hive™ MetastoreКластер Apache Hive™ Metastore

Важно

Для создания или редактирования эндпоинта управляемой базы данных вам потребуется роль managed-metastore.viewer или примитивная роль viewer, выданная на каталог кластера этой управляемой базы данных.

Подключение с указанием кластера в Yandex Cloud.

Консоль управления
  • Кластер Apache Hive™ Metastore — идентификатор кластера, каталог которого используется для таблиц Apache Iceberg™.

  • Группы безопасности — выберите облачную сеть для размещения эндпоинта и группы безопасности для сетевого трафика. Это позволит применить указанные правила групп безопасности к ВМ и кластерам в выбранной сети без изменения их настроек. Подробнее читайте в разделе Сеть в Yandex Data Transfer.

    Убедитесь, что выбранные группы безопасности настроены.

Файловое хранилищеФайловое хранилище

Бакет Yandex Object Storage
Пользовательское S3-совместимое хранилище
  • Бакет — имя бакета, в который будут загружаться данные из источника.
  • Сервисный аккаунт — выберите или создайте сервисный аккаунт с ролью storage.uploader, от имени которого сервис Data Transfer будет подключаться к бакету.
  • (Опционально) Эндпоинт — эндпоинт для службы, совместимой с Amazon S3. Оставьте поле пустым для использования Amazon.
  • Регион — регион для отправки запросов.
  • Бакет — имя бакета.
  • Идентификатор статического ключа и Содержимое статического ключа — идентификатор и содержимое ключа AWS для доступа к частному бакету.
  • (Опционально) Префикс пути — префикс путей для записи объектов в бакет.

Дополнительные настройкиДополнительные настройки

Консоль управления
  • Политика очистки — выберите способ очистки данных в базе-приемнике перед переносом:

    • Не очищать — существующие таблицы с данными будут использоваться для дальнейшей записи данных.

    • DROP — полное удаление таблиц, участвующих в трансфере.

    Используйте эту опцию, чтобы при любой активации трансфера в базу-приемник всегда передавалась самая последняя версия схемы таблиц из источника.

  • Параметры записи — настройки записи данных в таблицы Apache Iceberg™:

    • Максимум строк в файле — максимальное число строк в одном файле данных. При значении 0 число строк не ограничено.
    • Максимум байт в файле — максимальный размер (в байтах) одного файла данных. При значении 0 размер файлов не ограничен.
    • Параметры Parquet — настройки формата данных Parquet:
      • Максимум байт в группе — максимальное число строк в группе. При значении 0 число строк в группе не ограничено.
      • Максимум строк в группе — максимальный размер (в байтах) группы строк. При значении 0 размер группы строк не ограничен.
  • Параметры репликации → Интервал коммитов — интервал (в секундах) между коммитами в таблицу Apache Iceberg™ при репликации.

  • Пространство имён по умолчанию — пространство имен в Apache Iceberg™, в которое будут переноситься таблицы, если у базы-источника отсутствует схема данных.

После настройки источника и приемника данных создайте и запустите трансфер.

Была ли статья полезна?

Предыдущая
Миграция эндпоинтов в другую зону доступности
Следующая
Источник
Создавайте контент и получайте гранты!Готовы написать своё руководство? Участвуйте в контент-программе и получайте гранты на работу с облачными сервисами!
Подробнее о программе
Проект Яндекса
© 2026 ООО «Яндекс.Облако»