Yandex Cloud
Поиск
Связаться с экспертомПопробовать бесплатно
  • Кейсы
  • Документация
  • Блог
  • Все сервисы
    • Cloud Interconnect
    • Cloud Backup
    • Cloud Registry
    • Yandex AI Studio
    • Compute Cloud
    • Object Storage
    • Managed Service for Kubernetes®
    • Yandex BareMetal
    • Smart Web Security
    • Security Deck
    • Managed Service for PostgreSQL
    • Managed Service for ClickHouse®
    • Monium
    • Cloud CDN
    • Network Load Balancer
    • Virtual Private Cloud
    • Cloud DNS
    • Application Load Balancer
    • Yandex Cloud Video
    • Stackland
    • Yandex Cloud Router
    • Yandex Managed Service for Trino
    • Managed Service for MySQL®
    • Managed Service for Valkey™
    • Managed Service for Apache Spark™
    • Yandex StoreDoc
    • Managed Service for OpenSearch
    • Managed Service for Apache Kafka®
    • Data Transfer
    • Yandex MPP Analytics Engine for PostgreSQL
    • Yandex Managed Service for Apache Airflow®
    • Data Processing
    • Yandex MetaData Hub
    • Managed Service for YDB
    • Managed Service for Sharded PostgreSQL
    • Managed Service for YTsaurus
    • Yandex WebSQL
    • DataLens
    • Yandex Search API
    • SpeechSense
    • SpeechKit
    • DataSphere
    • Vision OCR
    • Translate
    • Yandex Neurosupport
    • Yandex Cloud Detection and Response
    • Yandex Identity Hub
    • Key Management Service
    • Certificate Manager
    • Yandex Lockbox
    • Audit Trails
    • SmartCaptcha
    • Cloud Desktop
    • GOST Gateway
    • Yandex SIEM
    • SourceCraft Code Assistant
    • Container Registry
    • Managed Service for GitLab
    • SourceCraft
    • Managed Service for Prometheus®
    • Cloud Functions
    • API Gateway
    • Yandex Cloud Postbox
    • Message Queue
    • Serverless Integrations
    • IoT Core
    • Data Streams
    • Serverless Containers
    • Cloud Notification Service
    • Yandex Query
    • Identity and Access Management
    • Yandex Cloud Console
    • Resource Manager
    • Yandex Cloud Billing
    • Yandex Cloud Quota Manager
    • Cloud Apps
  • Статус работы сервисов
  • Marketplace
    • Популярные
    • Инфраструктура и сеть
    • Платформа данных
    • Искусственный интеллект
    • Безопасность
    • Инструменты DevOps
    • Бессерверные вычисления
    • Управление ресурсами
  • Все решения
    • По отраслям
    • По типу задач
    • Экономика платформы
    • Yandex Cloud Trust
    • Техническая поддержка
    • Каталог партнёров
    • Обучение и сертификация
    • Облако для стартапов
    • Облако для крупного бизнеса
    • Центр технологий для общества
    • Облако для интеграторов
    • Поддержка IT-бизнеса
    • Облако для фрилансеров
    • Обучение и сертификация
    • Блог
    • Документация
    • Контент-программа
    • Мероприятия и вебинары
    • Контакты, чаты и сообщества
    • Идеи
    • Калькулятор цен
    • Тарифы
    • Акции и free tier
  • Кейсы
  • Документация
  • Блог
Создавайте контент и получайте гранты!Готовы написать своё руководство? Участвуйте в контент-программе и получайте гранты на работу с облачными сервисами!
Подробнее о программе
Проект Яндекса
© 2026 ООО «Яндекс.Облако»
Yandex Managed Service for OpenSearch
  • Начало работы
    • Взаимосвязь ресурсов сервиса
    • Роли хостов
    • Индексы
    • Политики индексов
    • Поиск с помощью OpenSearch
    • Классы хостов
    • Сеть в Managed Service for OpenSearch
    • Квоты и лимиты
    • Хранилище
    • Резервные копии
    • Шардирование и репликация
    • Высокая доступность кластера
    • Плагины OpenSearch
    • Политика работы с версиями OpenSearch
    • Техническое обслуживание
  • Управление доступом
  • Правила тарификации
  • Справочник Terraform
  • Метрики Monitoring
  • Аудитные логи Audit Trails
  • Публичные материалы
  • История изменений
  • Вопросы и ответы

В этой статье:

  • Дополнительные предустановленные плагины
  • Дополнительные плагины OpenSearch
  • Зачем использовать плагин yandex-lemmer
  • Примеры использования
  1. Концепции
  2. Плагины OpenSearch

Плагины OpenSearch

Статья создана
Yandex Cloud
Обновлена 15 июня 2026 г.
Открыть в Markdown
  • Дополнительные предустановленные плагины
  • Дополнительные плагины OpenSearch
    • Зачем использовать плагин yandex-lemmer
  • Примеры использования

Managed Service for OpenSearch содержит ряд предустановленных плагинов. Также при создании или изменении кластера в Managed Service for OpenSearch вы можете указать желаемый список дополнительных плагинов, и они будут автоматически установлены в кластер.

Дополнительные предустановленные плагиныДополнительные предустановленные плагины

  • repository-s3

    Добавляет поддержку AWS S3 в качестве репозитория снапшотов.

Дополнительные плагины OpenSearchДополнительные плагины OpenSearch

Полный список поддерживаемых дополнительных плагинов:

  • analysis-icu

    Добавляет модуль Lucene ICU с расширенной поддержкой Unicode и использованием библиотек ICU. Модуль предоставляет улучшенный анализ азиатских языков, нормализацию Unicode, преобразование регистра Unicode, поддержку сопоставления и транслитерацию.

  • analysis-kuromoji

    Добавляет модуль анализа Lucene kuromoji для японского языка.

  • analysis-nori

    Добавляет модуль анализа Lucene nori для корейского языка. Использует словарь mecab-ko-dic.

  • analysis-phonetic

    Предоставляет фильтры лексем, которые преобразуют выражения в их фонетическое представление с помощью Soundex, Metaphone и других алгоритмов.

  • analysis-smartcn

    Добавляет модуль анализа Smart Chinese от Lucene для китайского или смешанного китайско-английского текста.

  • analysis-stempel

    Добавляет модуль анализа Stempel от Lucene для польского языка.

  • analysis-ukrainian

    Добавляет морфологический модуль анализа UkrainianMorfologikAnalyzer от Lucene для украинского языка. Использует проект Morfologik.

  • ingest-attachment

    Извлекает вложения файлов в распространенных форматах (таких как PPT, XLS и PDF) с помощью библиотеки извлечения текста Apache Tika™.

  • mapper-annotated-text

    Индексирует текст, представляющий собой комбинацию обычного текста и специальной разметки. Такая комбинация используется для идентификации объектов, таких как люди или организации.

  • mapper-murmur3

    Вычисляет хеш значений полей по индексному времени и хранит их в индексе.

  • mapper-size

    Предоставляет поле метаданных _size, которое индексирует размер в байтах исходного поля _source.

  • repository-azure

    Добавляет поддержку хранилища Azure Blob в качестве репозитория снапшотов.

  • repository-gcs

    Добавляет поддержку службы Google Cloud Storage в качестве репозитория снапшотов.

  • repository-hdfs

    Добавляет поддержку файловой системы HDFS в качестве репозитория снапшотов.

  • transport-nio

    Серверно-клиентская неблокируемая сетевая библиотека, созданная с помощью Netty. Плагин поддерживает только версии OpenSearch 2.x.

  • yandex-lemmer

    Добавляет фильтр yandex-lemmer, который улучшает поиск текста на русском языке по документам OpenSearch.

Подробнее в документации OpenSearch.

Зачем использовать плагин yandex-lemmerЗачем использовать плагин yandex-lemmer

Фильтр yandex-lemmer детальнее анализирует поисковый запрос на русском языке и делает поиск более результативным. Без этого фильтра поиск может выдать нерелевантные результаты в следующих случаях:

  • Формы одного слова сильно различаются. Например, при поиске по слову пёс не будет найден документ со словом пса (родительный падеж от слова пёс). А при поиске по слову идти не будет найден документ со словом шли (форма прошедшего времени от слова идти).

  • Разные по значению слова совпадают или просто схожи по написанию. В результате могут быть найдены лишние документы, которые не отвечают вашему запросу. Например, при поиске по слову алая будут найдены документы, которые содержат как прилагательные алая, так и существительные в родительном падеже от названия реки Алай (на берегу Алая).

  • В тексте сделаны опечатки, которые на первый взгляд не заметны. Например, в слове Cловарь первая буква введена латиницей. Если в поисковом запросе ввести слово Словарь кириллицей, то документ, в котором указано слово с ошибкой, не будет найден.

Как работает поиск при использовании фильтра yandex-lemmer:

  1. OpenSearch анализирует текст запроса при помощи поисковой библиотеки Apache Lucene. В процессе анализа токенизатор разбивает текст на отдельные токены. Токен обычно состоит из слова и метаданных об этом слове. Например, токенизатор может преобразовать предложение Один в поле не воин в набор токенов, ориентируясь на пробелы между словами: Один, в, поле, не, воин.

  2. Набор токенов проходит через цепочку фильтров. Фильтр получает токен, анализирует его и возвращает один или несколько токенов. Например, фильтр, который приводит текст к нижнему регистру, вернет то же количество токенов, что и на входе: один, в, поле, не, воин. Также на выходе токен может отсутствовать, если применен фильтр по стоп-словам.

  3. Когда токен попадает в фильтр yandex_lemmer, выполняется поиск начальной формы слова. Если найдена одна или несколько начальных форм (например, для омонимов или омографов), то фильтр сначала возвращает исходный токен, а затем возвращает токены с начальными формами слова.

    Пример выходных токенов для фразы идут дожди
    {
      "tokens": [
        {
          "token": "идут",
          "start_offset": 0,
          "end_offset": 4,
          "type": "<ALPHANUM>",
          "position": 0
        },
        {
          "token": "идти",
          "start_offset": 0,
          "end_offset": 4,
          "type": "<ALPHANUM>",
          "position": 0
        },
        {
          "token": "дожди",
          "start_offset": 5,
          "end_offset": 10,
          "type": "<ALPHANUM>",
          "position": 1
        },
        {
          "token": "дождь",
          "start_offset": 5,
          "end_offset": 10,
          "type": "<ALPHANUM>",
          "position": 1
        }
      ]
    }
    

    В приведенном примере при поиске найдутся фразы, которые содержат любую форму слова идти (например, шел, шли, идут) и любую форму слова дождь (например, дожди, дождей).

    Каждому токену на выходе присваивается позиция, которая показывает положение слова в поисковой фразе. Если для входящего токена на выходе получается несколько токенов, то у них всех будет одинаковая позиция. Она нужна, чтобы определять расстояние между искомыми словами, например, для запросов в кавычках. Так, при поиске фразы "идут дожди" будет найден документ, который содержит фразу идет дождь, но не будет найдена фраза идет сильный дождь.

Примеры использованияПримеры использования

  • Использование плагина yandex-lemmer в Managed Service for OpenSearch
  • Миграция данных из Elasticsearch

Была ли статья полезна?

Предыдущая
Высокая доступность кластера
Следующая
Политика работы с версиями OpenSearch
Создавайте контент и получайте гранты!Готовы написать своё руководство? Участвуйте в контент-программе и получайте гранты на работу с облачными сервисами!
Подробнее о программе
Проект Яндекса
© 2026 ООО «Яндекс.Облако»