Yandex Cloud
Поиск
Связаться с экспертомПопробовать бесплатно
  • Кейсы
  • Документация
  • Блог
  • Все сервисы
    • Cloud Interconnect
    • Cloud Backup
    • Compute Cloud
    • Object Storage
    • Managed Service for Kubernetes®
    • Managed Service for PostgreSQL
    • Managed Service for ClickHouse®
    • Monium
    • Cloud CDN
    • Network Load Balancer
    • Virtual Private Cloud
    • Cloud DNS
    • Application Load Balancer
    • Yandex Cloud Router
    • Managed Service for MySQL®
    • Managed Service for Valkey™
    • Managed Service for Apache Spark™
    • Managed Service for OpenSearch
    • Managed Service for Apache Kafka®
    • Data Transfer
    • Yandex MPP Analytics Engine for PostgreSQL
    • Managed Service for YDB
    • SpeechKit
    • Yandex Identity Hub
    • Key Management Service
    • Certificate Manager
    • Yandex Lockbox
    • Audit Trails
    • Container Registry
    • Managed Service for Prometheus®
    • Message Queue
    • Identity and Access Management
    • Yandex Cloud Console
    • Resource Manager
    • Yandex Cloud Billing
    • Cloud Apps
    • Yandex AI Studio
    • Yandex BareMetal
    • Smart Web Security
    • Security Deck
    • Yandex Cloud Video
    • Stackland
    • Yandex StoreDoc
    • Yandex Managed Service for Apache Airflow®
    • Data Processing
    • Yandex MetaData Hub
    • Yandex WebSQL
    • DataLens
    • Yandex Search API
    • SpeechSense
    • DataSphere
    • Vision OCR
    • Translate
    • Cloud Registry
    • SmartCaptcha
    • Cloud Desktop
    • Yandex SIEM
    • SourceCraft Code Assistant
    • Managed Service for GitLab
    • Cloud Functions
    • API Gateway
    • Yandex Cloud Postbox
    • Serverless Integrations
    • IoT Core
    • Serverless Containers
    • Cloud Notification Service
    • Yandex Query
  • Статус работы сервисов
  • Marketplace
    • Доступны в регионе
    • Инфраструктура и сеть
    • Платформа данных
    • Искусственный интеллект
    • Безопасность
    • Инструменты DevOps
    • Бессерверные вычисления
    • Управление ресурсами
  • Все решения
    • По отраслям
    • По типу задач
    • Экономика платформы
    • Безопасность
    • Техническая поддержка
    • Каталог партнёров
    • Обучение и сертификация
    • Облако для стартапов
    • Облако для крупного бизнеса
    • Центр технологий для общества
    • Партнёрская программа
    • Поддержка IT-бизнеса
    • Облако для фрилансеров
    • Обучение и сертификация
    • Блог
    • Документация
    • Мероприятия и вебинары
    • Контакты, чаты и сообщества
    • Идеи
    • Калькулятор цен
    • Тарифы
    • Акции и free tier
  • Кейсы
  • Документация
  • Блог
Создавайте контент и получайте гранты!Готовы написать своё руководство? Участвуйте в контент-программе и получайте гранты на работу с облачными сервисами!
Подробнее о программе
Проект Яндекса
© 2026 ТОО «Облачные Сервисы Казахстан»
  • Обзор технологий SpeechKit
    • Все руководства
    • Telegram-бот для распознавания и синтеза аудио
    • Использование Yandex API Gateway для настройки синтеза речи в SpeechKit
    • Регулярное асинхронное распознавание аудиофайлов из Object Storage
  • Поддерживаемые форматы аудио
  • Интеграция телефонии
  • Квоты и лимиты
  • Управление доступом
  • Правила тарификации
  • Аудитные логи Audit Trails

В этой статье:

  • Перед началом работы
  • Создайте облачную функцию
  • Создайте триггер
  • Проверьте работу функции
  1. Практические руководства
  2. Регулярное асинхронное распознавание аудиофайлов из Object Storage

Регулярное распознавание аудиофайлов из Yandex Object Storage

Статья создана
Yandex Cloud
Обновлена 30 июля 2026 г.
Открыть в Markdown
  • Перед началом работы
  • Создайте облачную функцию
  • Создайте триггер
  • Проверьте работу функции

Важно

Часть ресурсов, необходимых для прохождения практического руководства, доступны только в регионе Россия.

Примечание

В регионе Казахстан доступна только версия API v3.

В API асинхронного распознавания SpeechKit реализована интеграция с сервисом Yandex Object Storage. С ее помощью можно настроить автоматическое распознавание аудиофайлов поддерживаемых форматов, регулярно загружаемых в бакет Object Storage. Облачная функция в сервисе Yandex Cloud Functions периодически проверяет наличие аудиофайлов в бакете и отправляет их в API SpeechKit для распознавания. Результат и статус распознавания сохраняются в тот же бакет Object Storage.

Чтобы настроить автоматическое распознавание аудиофайлов с помощью SpeechKit:

  1. Создайте облачную функцию для чтения файлов из бакета Object Storage, отправки в API и проверки статуса распознавания файлов.
  2. Создайте триггер для периодического запуска облачной функции.
  3. Проверьте работу функции.

Перед началом работыПеред началом работы

  1. Создайте сервисный аккаунт с именем asr-batch-sa.

  2. Назначьте сервисному аккаунту роли storage.editor, functions.functionInvoker и ai.speechkit-stt.user на каталог, в котором аккаунт был создан.

  3. Создайте статический ключ доступа для сервисного аккаунта.

  4. Создайте API-ключ доступа для сервисного аккаунта.

  5. Создайте бакет Object Storage с именем asr-batch-bucket в каталоге сервисного аккаунта.

  6. Откройте бакет asr-batch-bucket, нажмите кнопку Создать папку и укажите в поле Имя папки значение input.

  7. Загрузите в папку input бакета файл config.json с заданным языком распознавания(https://aistudio.yandex.ru/docs/ru/speechkit/stt/models#languages). Файл содержит только один параметр:

    {
      "lang": "<код_языка>"
    }
    

    Примечание

    Если файл config.json отсутствует в бакете, для распознавания используется русский язык.

Создайте облачную функциюСоздайте облачную функцию

  1. В консоли управления выберите каталог, в котором был создан сервисный аккаунт.

  2. Перейдите в сервис Cloud Functions.

  3. Нажмите кнопку Создать функцию и укажите имя функции asr-batch-function.

  4. Нажмите кнопку Создать.

  5. В блоке Редактор выберите среду выполнения Python версии 3.8 и нажмите Продолжить.

  6. Скачайте из репозитория Yandex Cloud файл со скриптом.

  7. В блоке Код функции удалите содержимое файла index.py и вставьте скачанный скрипт.

  8. В блоке Код функции создайте файл requirements.txt и добавьте в него код:

    boto3
    botocore
    requests
    
  9. Укажите параметры запуска функции:

    • Точка входа — index.handler.
    • Таймаут — 60.
    • Сервисный аккаунт – asr-batch-sa.
  10. Добавьте переменные окружения:

    • S3_BUCKET – asr-batch-bucket.
    • S3_PREFIX – input.
    • S3_PREFIX_LOG – log.
    • S3_PREFIX_OUT – out.
    • S3_KEY – ID статического ключа доступа.
    • S3_SECRET – секрет статического ключа доступа.
    • API_KEY – ID API-ключа.
    • API_SECRET – секрет API-ключа.
  11. Нажмите кнопку Сохранить изменения.

Создайте триггерСоздайте триггер

  1. В консоли управления выберите каталог, в котором была создана функция.
  2. Перейдите в сервис Cloud Functions.
  3. Выберите Триггеры.
  4. Нажмите Создать триггер.
  5. Укажите параметры триггера:
    • Имя – asr-batch-cron.
    • Тип – Таймер.
    • Запускаемый ресурс – Функция.
    • Cron-выражение – Каждую минуту.
    • Функция – asr-batch-function.
    • Тег версии функции – $latest.
    • Сервисный аккаунт – asr-batch-sa.
  6. Нажмите Создать триггер.

Созданный триггер будет срабатывать ежеминутно и запускать облачную функцию.

Проверьте работу функцииПроверьте работу функции

  1. В консоли управления выберите каталог, в котором была создана функция.
  2. Перейдите в сервис Object Storage и откройте бакет asr-batch-bucket.
  3. Загрузите в папку input аудиофайлы любого поддерживаемого формата.
  4. Подождите несколько минут и убедитесь, что в бакете появились папки log и out.
  5. Проверьте статус распознавания в папке log. Для каждого из отправленных на распознавание аудиофайлов статус сохраняется во вспомогательном файле <имя_аудиофайла>.json (например, audio.mp3.json). Если в файле содержится параметр "done": "false", то процесс распознавания не завершен.
  6. Проверьте результат распознавания в папке out. Результат сохраняется в формате JSON в файле с именем <имя_аудиофайла>.json (например, audio.mp3.json). Подробнее о формате результата распознавания смотрите в разделе API асинхронного распознавания.

Примечание

Для мониторинга выполнения скрипта можно посмотреть логи функции asr-batch-function.

Полезные ссылкиПолезные ссылки

  • API v2 асинхронного распознавания
  • Асинхронное распознавание аудиофайлов в формате LPCM в API v2
  • Асинхронное распознавание аудиофайлов в формате OggOpus в API v2

Была ли статья полезна?

Предыдущая
Использование Yandex API Gateway для настройки синтеза речи в SpeechKit
Следующая
Поддерживаемые форматы аудио
Создавайте контент и получайте гранты!Готовы написать своё руководство? Участвуйте в контент-программе и получайте гранты на работу с облачными сервисами!
Подробнее о программе
Проект Яндекса
© 2026 ТОО «Облачные Сервисы Казахстан»