1С:Распознавание речи

1С: Распознавание речи

Описание

«1С:Распознавание речи»

облачный продукт по автоматическому преобразованию речи в текст. Механизмы распознавания речи доступны из встроенного языка «1С:Предприятие». Партнеры фирмы «1С», разработчики и программисты, сопровождающие информационные системы пользователей, могут интегрировать «1С:Распознавание речи» в прикладные решения и усовершенствовать различные бизнес-процессы.

Длинный текст проще надиктовать, чем вводить на клавиатуре, в этом поможет «Распознавание речи». Электронные письма, содержание задач и комментариев, текстовые блоки в документах удобнее вводить голосом, особенно если у пользователя заняты руки, а также при работе на мобильных устройствах.
Можно распознавать записи телефонных звонков или совещаний при хорошем качестве аудиозаписи. Для лучшего результата рекомендуется записывать отдельные звуковые каналы для каждого собеседника.
Можно использовать голосовое управление в приложениях так, чтобы по команде пользователя открывались нужные формы, строились отчеты, выполнялся поиск, заполнялись реквизиты.
«1С:Распознавание речи» может применяться в задачах по роботизации звонков для проведения опросов и сбора информации, в голосовых системах самообслуживания, для речевой аналитики работы с клиентами, а также при создании интерфейсов для людей с ограниченными возможностями.
При потоковом распознавании речи поддерживается работа с дополнительной грамматикой: в начале работы вы можете передать какие-то специфичные термины (фамилии сотрудников, названия номенклатуры или компаний-контрагентов) для их уверенного распознавания.
Распознавание речи осуществляется с помощью облачного сервиса или локально с использованием скачанной модели распознавания. При локальном варианте аудиоданные никуда не будут отправляться, что может быть важно при особых требованиях к конфиденциальности. Использование облачного «1С:Распознавания речи» происходит без нагрузки на оборудование пользователя и упрощает реализацию распознавания речи, особенно при большом объеме аудиоданных.

Мы постоянно работаем над улучшением качества распознавания речи и добавляем новые возможности. Все улучшения сначала появляются в облачном режиме и только потом становятся доступными в локальном варианте, поэтому качество распознавания речи в облачном и локальном вариантах может отличаться.

Возможности

Потоковое распознавание – пользователь отправляет аудиоданные в режиме реального времени, в ответ периодически получает распознанный текст. Удобно при диктовке текста или при управлении интерфейсом программы.

Длительность одного сеанса при потоковом распознавании речи с помощью облачного сервиса имеет ограничение в 2 часа. При локальном распознавании речи ограничений длительности сеанса нет.

Файловое распознавание – пользователь отправляет на распознавание файл с аудиозаписью и в ответ получает идентификатор задачи, по которому в дальнейшем сможет получить результат распознавания. В данном случае пользователь может отправить готовый аудиофайл, например, запись совещания. Распознанный текст будет предоставлен пользователю с задержкой, которая зависит от длительности аудиофайла и текущей загрузки облачного сервиса.

Файловое распознавание может обрабатывать многоканальные аудиозаписи, в этом случае каждый канал будет распознаваться и тарифицироваться независимо. Для распознавания принимаются форматы аудио WAV signed 16 bit little-endian и Opus в контейнере ogg. Частота дискретизации аудио – от 8 кГц до 48кГц. Максимальный размер аудиофайла – 1Гб длительностью до 4 часов. Результаты распознавания доступны для скачивания в течение 7 суток после выполнения задания.

Функция разделения по спикерам - позволяет получить расшифровку аудиофайла с делением её на собеседников. В результате распознавания пользователь получит текст, в котором будут отображены результаты отдельно по каждому из спикеров.

Функцию можно использовать, например, для получения транскрибации разговоров при проведение собеседований, опросов пользователей, совещаний, оценке качества звонков и так далее.

В настоящее время поддерживается распознавание речи на русском и английском языках. В дальнейшем состав доступных языков планируется расширять.

CRM-форма появится здесь

Новосибирск

+7 (383) 235-92-32

Кемерово

+7 (3842) 900-678

Томск

+7 (3822) 489-432