ГОСТ Р 58668.11-2019
Информационные технологии. Биометрия. Форматы обмена биометрическими данными. Часть 11. Данные голоса
Устанавливает требования к формату обмена биометрическими данными для хранения, записи и передачи оцифрованных акустических данных человеческого голоса (речи), полученных в течение одной сессии от одного диктора. Настоящий формат применим:
- для различных приложений идентификации и верификации диктора;
- текстонезависимого и текстозависимого распознаваний диктора.
Инкапсулированные данные в данном формате также могут быть использованы для автоматического распознавания речи, но данные вопросы не рассматриваются в стандарте.
Стандарт не устанавливает требования:
- к обработке данных, которые были обработаны на уровне голосовых моделей или признаков;
- потоковой передаче данных;
- конкретным приложениям и оборудованию.
Стандарт поддерживает хранение дополнительных нестандартизированных данных. Стандарт позволяет обмениваться как исходными данными, так и данными, которые прошли постобработку. Описание любой обработки исходного сигнала должно быть включено в метаданные голосового представления.
Вопросы, связанные с использованием временных меток и технологий криптографической защиты информации, которые используются для обеспечения подлинности, целостности и конфиденциальности хранимых и передаваемых биометрических данных, выходят за рамки стандарта.
Информация, которая представлена в данном формате, может быть записана на машиночитаемые носители информации или передана по каналам передачи данных между системами.
Определение формата обмена данными голоса в общем виде сопровождается определением схемы XML.
Стандарт включает в себя словарь терминов и определений, широко используемых профессиональным сообществом в области распознавания диктора/речи, а также терминологию из других стандартов.