SRT-3 это уникальный готовый комплект речевой аналитики с
диаризацией речи (разделением голосов собеседников по каналам).
Комплект приобретается один раз и в последствии за него не нужно
платить абонентскую плату.
Самое главное преимущество комплекта - это его цена.
За цену обычного комплекта речевой аналитики Вы получаете 2
независимых канала распознавания речи.
Отличие комплекта SRT-3 от других комплектов - это двунаправленный
2-канальный USB микрофон STELBERRY M-1477HD, оптимизированный
для системы речевой аналитики, который разделяет речь двух
собеседников на 2 независимых аудиоканала, обеспечивая максимальное качество диаризации голосов.
Комплект применяется для записи и транскрибации разговоров в банках,
поликлиниках, медучреждениях, МФЦ, автосалонах, стоматологических
клиниках, салонах связи, на кассах супермаркетов, АЗС и других
объектах.
Сферы применения комплекта речевой аналитики SRT-3
Банки. Комплект позволяет разделить голоса сотрудника и клиента на 2 канала, что позволяет более эффективно применять дополнительный модуль онлайн суфлёра
МФЦ. Разделяя голоса собеседников сервис речевой аналитики позволяет произвести более точную оценку работы сотрудников и однозначно определить, кто начал скандал (если такой случай имел место быть)
Объекты торговли, супермаркеты. Речевая аналитика SPEECH DRIVE, входящая в комплект SRT-3 позволяет контролировать факт предложения акционных товаров кассирами, а также понять, кто начал конфликт в случае его возникновения
Салоны связи. Теперь можно контролировать предлагает ли сотрудник салона связи дополнительные услуги клиентам
Автозаправочные комплексы. Решается очень важный вопрос - кто ошибся в выборе топлива: сотрудник АЗС или клиент.
В комплект речевой аналитики SRT-3 входит двунаправленный
2-канальный микрофон STELBERRY M-1477HD, стриминговое ПО AURAVOX и базовый модуль речевой аналитики SPEECH DRIVE ANALYZE.
Микрофон STELBERRY M-1477HD изначально был разработан именно
для сервиса речевой аналитики SPEECH DRIVE, когда возникла
необходимость разделения голосов собеседников по разным каналам.
Также в комплект входит прикладное ПО AURAVOX, которое забирает 2 канала звука с микрофона STELBERRY M-1477HD и обеспечивает живой
стриминг аудиопотоков в необходимом формате на сервер системы речевой аналитики.
Третий и главный компонент SRT-3 - это базовый модуль речевой
аналитики SPEECH DRIVE ANALYZE с широким набором функций и
высоким процентом транскрибации разговоров.
Все модули комплекта размещаются в корпоративной инфраструктуре заказчика и работают во внутрикорпоративной сети.
Двунаправленный 2-канальный USB микрофон STELBERRY M-1477HD закрепляется на мониторе или рабочем месте сотрудника, а на компьютер сотрудника устанавливается прикладное стриминговое ПО AURAVOX,
которое в фоновом режиме передаёт два аудиопотока на сервер речевой аналитики SPEECH DRIVE ANALYZE для последующей транскрибации разговоров с диаризацией (разделением голосов) собеседников.
Особое внимание уделено надёжности передачи аудиопотоков.
Стриминговое ПО AURAVOX параллельно с передачей аудиопотоков
делает их запись и в случае потери связи с сервером информация не
потеряется, так как при восстановлении связи аудиопотоки будут
переданы из ранее записанного материала.
Специализированный USB микрофон STELBERRY M-1477HD
воспринимает речь собеседников с двух сторон и разделяет их на два
аудиоканала, фактически решая задачу диаризации разговоров.
Именно поэтому микрофон применяется для раздельной записи
разговоров и транскрибации речи в банках, салонах связи, на АЗС, в
МФЦ, супермаркетах.
Речевой фильтр микрофона ослабляет частоты, находящиеся за
пределами частотного диапазона человеческой речи.
Также, микрофон STELBERRY M-1477HD ослабляет низкие частоты (от 70
Герц и ниже), так как этот диапазон частот не учитывается при
транскрибации разговоров, но именно он присутствует в помещениях в
виде гула и искажает сигнал, существенно снижая процент транскрибации
аудио в текст.
В сервисах речевой аналитики стоит учитывать, что частотный диапазон
гласных звуков составляет от 80-100 до 400-500 Герц у мужчин и от
100-200 до 1000-1500 Герц у женщин.
В согласных звуках человеческой речи содержится незначительная часть
звуковой энергии, но их наличие необходимо для распознавания системах
транскрибации речи.
Диапазон согласных звуков находится в диапазоне от 1000 до 5000 Герц.
Половина энергии голоса находится в диапазоне от 100 до 500 Герц, но
составляет считанные проценты.
В диапазоне от 500 до 1000 Герц разборчивость будет составлять уже
около трети звуков.
В диапазоне от 1000 до 8000 Герц (шипящие и свистящие звуки)
наблюдается, по меньшей мере, половина разборчивости речи и лишь
считанные проценты энергии.
Все эти моменты были учтены при разработке USB микрофона
STELBERRY M-1477HD и поэтому процент распознавания речи в системе
речевой аналитики SPEECH DRIVE с этим микрофоном стал существенно
выше, чем при применении обычных USB микрофонов.
На выделенном сервере внутри контура организации устанавливается сервис речевой
аналитики SPEECH DRIVE ANALYZE для Вашей
организации.
В зависимости от количества рабочих мест определяется лицензия ПО
речевой аналитики.
Всё очень просто: сколько рабочих мест, столько наборов SRT-3
применяется, а ПО SPEECH DRIVE ANALYZE лицензируется на сервер в соответствии с общим количеством анализируемых микрофонов.
В систему речевой аналитики всегда можно добавить
дополнительные функции.
При необходимости расширения функциональных возможностей системы,
например, если Вам нужен онлайн суфлёр или управленческие
дашборды, необходимо просто докупить соответствующие модули.
Также в любой момент можно добавить дополнительные рабочие места,
докупив необходимое количество комплектов SRT-3.
Для работы со SPEECH DRIVE ANALYZE необходимо подключиться к серверу речевой аналитики по внутрикорпоративной сети.
Вам будут доступны функции, в соответствии с гибкой политикой
администрирования речевой платформы.
Например, руководителю организации можно предоставить доступ ко
всем возможностям системы, а младшему управляющему персоналу
только к тем функциям, которые им необходимы.
Фактически, для пользователей речевая платформа SPEECH DRIVE
представляет собой удобный WEB-интерфейс.
Подключаться и работать с сервисом речевой аналитики можно со
стационарного компьютера, с ноутбука или планшета, что, несомненно, очень удобно,
причём абсолютно не важно, какая операционная система стоит на этих
устройствах Windows, MacOS или Linux.
В сервисе речевой аналитике SPEECH DRIVE присутствует кликабельная
стенограмма.
При клике на строку таблицы справа отображается блок стенограммы
взаимодействия.
В стенограмме желтым цветом подсвечиваются слова, которые были
выбраны в поисковом запросе.
Стенограмма кликабельная - при клике на слово начинается
воспроизведение аудио с выбранного слова, для перемещения по
стенограмме используется скролл.
При необходимости аудио и текст можно скачать на локальный
компьютер.
Речь клиента и речь менеджера показывается в отдельных блоках за счет
применения технологии диаризации - автоматического разделения
беседы на участников.
Диаризация осуществляется как благодаря уникальному
2-канальному микрофону от STELBERRY, так и алгоритмам обработки
аудиопотока и текста от SPEECH DRIVE.
Для каждого блока указывается время его произнесения с точностью до 1
секунды.
Раздел позволяет получить информацию о распределении
взаимодействий по различным категориям и подкатегориям.
Для получения статистики необходимо выбрать необходимые фильтры
(период сеанса обслуживания, операторов и др.), после чего система покажет
статистическую информацию по категориям в соответствии с ранее
настроенным деревом категорий.
Определение категории происходит путем выявления слов или словарей,
которые должны встретиться в сеансе обслуживания, а также путем создания комплексного логического запроса, позволяющего определить набор параметров для определения сеанса обслуживания принадлежащего к той или иной категории.
Также для определения категории может быть использован
Искусственный интеллект.
В блоке “Статистика подкатегорий” слева отображаются подкатегории в
виде кругов Эйлера.
Размер кругов зависит от количества разговоров по данной категории, а
их пересечение отражает то, сколько бесед относится одновременно к
нескольким выбранным темам.
Справа отражена динамика категорий по дням.
Система поддерживает возможность создания сложных логических
запросов для поиска в записях сеансов обслуживания по сложным логическим
критериям.
Поддерживаются логические операторы <И>, <ИЛИ>, <НЕ>, а также
логически правила <ОКОЛО>, <ПРИСУТСТВУЕТ>, <ОТСУТСТВУЕТ>,
<НАЧАЛО>, <ЗАВЕРШЕНИЕ>.
Логический запрос - это более комплексный поисковый “ключ”, в котором
важна не только встречаемость или частотность слов, но и их
взаимосвязи и позиция в аудиофайле.
Для правил <ПРИСУТСТВУЕТ> и <ОТСУТСТВУЕТ> необходимо выбрать
слово или событие и канал записи (оператор или клиент), для правил
<НАЧАЛО> и <ЗАВЕРШЕНИЕ> необходимо также выбрать время от
начала или конца беседы.
Для правила <ОКОЛО> необходимо указать два связанных события и
расстояние между ними (в секундах).
Для просмотра результата поиска по логическому запросу необходимо
перейти в раздел ”Запросы”, выбрать нужный запрос и иные параметры
выборки и нажать кнопку ”Применить”.
Система поддерживает возможность автоматического анализа разговоров
на соответствие чек-листам.
Чек-лист - это линейная комбинация логических запросов или запросов к
Искусственному интеллекту (промптов), в которой каждый запрос вносит
свой вклад в общую оценку беседы.
Для просмотра оценки по чек-листу необходимо перейти в раздел
”Чек-листы”, выбрать нужный чек-лист путем клика на название чек-листа,
далее выбрать иные параметры выборки и нажать кнопку ”Применить”.
Чек-листы могут быть индивидуальными для каждого отдела или
супервизора.
Система строит отчеты, включая интегральный отчет, отчеты по каждому
менеджеру и вехе чек-листа.
В таблице с информацией по каждой вехе чек-листа (блок ”Менеджеры”)
есть возможность “провалиться” в конкретную веху и посмотреть
количество записей, в которых выполнен, либо не выполнен выбранный
пункт у конкретного менеджера, либо по вехе в целом.
Данный компонент системы речевой аналитики является дополнительным
модулем и приобретается отдельно.
Онлайн суфлёр позволяет обрабатывать коммуникации в реальном
времени (во время общения менеджера с клиентом), а также, в сочетании
с Компонентом больших языковых моделей, сформировать краткое
содержание беседы сразу после ее завершения и реализовывать
функцию онлайн ассистента оператора, когда система дает менеджеру
подсказки по ходу разговора.
Благодаря данной функции оператор может более качественно
обслуживать клиента, предоставляя ему наиболее релевантную
информацию в нужный момент.
Также при наличии подсказок оператор будет чувствовать себя увереннее,
что в конечном счете помогает бизнесу больше зарабатывать.
Для получения подсказок необходимо перейти в соответствующий раздел
в системе.
Также в данном разделе можно выбрать, в каких каналах связи
необходимо анализировать речевой поток для отображения подсказок.
Данный компонент также является дополнительным модулем и
приобретается отдельно и позволяет настраивать произвольные
дашборды путем создания и редактирования различных виджетов и
выбора источников данных для отображения.
В этом разделе можно выбрать тип данных, который пользователю нужно
визуализировать (сеансы обслуживания, категории, чек-листы и др.), вид
представляемой информации (число, диаграмма, таблица и т.п.),
настроить характеристики этих данных и указать дополнительные
параметры.
Также пользователь может настроить параметры текста на виджете, а
именно, заголовка и подзаголовка.
Дашборд может быть создан как общекорпоративный, так и для
конкретной роли (директор, руководитель отдела, руководитель группы).
Полный список возможностей речевой платформы SPEECH DRIVE и её компонентов
Базовый компонент речевой платформы SPEECH DRIVE:
Аналитика разговоров c онлайн отчетами с различными группировками метаданных и ключевых слов
Динамика по каждому менеджеру по каждому параметру за год в разрезе по дням
Поддержка логических запросов, как отдельно, так и в составе комплексных чек-листов для оценки эффективности бизнес-процессов обслуживания
Добавление часто используемых фильтров/словарей в Избранное
Контроль чек-листов (отслеживание успешного прохождения “вех” в разговоре) с автоматическим скорингом разговора и оператора
Контроль негативных высказываний, стоп-слов
Встроенные словари
Настройка собственных словарей
Поддержка системы ролей пользователей с гибкой настройкой доступов с возможностью разделения доступов супервизорам по филиалам,
операторам, регионам и с возможностью дать оператору доступ на просмотр и анализ своих записей
Раздельный анализ речи менеджера и клиента (диаризация)
Уведомления о критических событиях и их история с возможностью для пользователя “подписаться” на событие, включая уведомление на email
Категоризация сеансов обслуживания по дереву категорий с поддержкой нескольких уровней
Возможность перекатегоризации исторических данных при изменении категорий
Визуализация пересечения категорий на диаграмме Венна
Текстовая расшифровка разговора в режиме диалога менеджера и клиента
Поддержка аудио-форматов: wav (кодек a-law), 8000 Гц, 14 кбит/с, моно и стерео
Распознавание эмоциональной речи
Облако тегов (по словарям)
Выгрузка отчетов в XLS
Распознавание русского языка
Компонент машинного обучения TRAIN:
Возможность обучения специфичных моделей и классификаторов с использованием данных клиента
Возможность автоматической классификации и оценки аудио и текстовых данных с использованием ML-моделей
Компонент оценки операторов QUALITY:
Создание анкет для ручной и полуавтоматической оценки работы менеджеров
Создание оценочных сессий с возможностью комментирования и отслеживания динамики по каждому менеджеру по каждому элементу чек-листа
Личный кабинет менеджера с доступом к его оценкам и записям и возможностью общения с супервизором
Возможность подачи апелляций, бизнес-процесс оценки качества
Компонент ИИ (больших языковых моделей) REASON:
Автоматическое формирование краткого содержания текстов сеансов обслуживания с анализом речи менеджера и заявителя
Возможность семантического поиска в архиве при помощи запросов на естественном языке
Возможность оценки чек-листов с использованием запросов на естественном языке (промпты)
Автоматические рекомендации менеджерам
Компонент онлайн суфлер ASSISTANT:
Функция отправки онлайн уведомлений о критических событиях в интерфейс системы речевой аналитики и на электронную почту
супервизора/администратора в ходе разговора в режиме реального времени
Онлайн суфлёр - онлайн уведомления по заранее заготовленным шаблонам и/или из базы знаний в интерфейсе рабочего места менеджера
при произнесении клиентом или менеджером определенных слов
Аудиомониторинг - возможность в режиме реального времени отслеживать события во всех сеансах обслуживания и знакомиться с
содержимым разговора в виде текстового чата
Компонент управленческих дашбордов DASHBOARDS:
Возможность создания неограниченного числа аналитических дашбордов
Возможность настройки собственных виджетов с указанием произвольного размера, наименования и источника данных из системы
речевой аналитики или внешней бизнес-системы
Поддержка визуальных представлений данных: таблицы, графики, столбчатые диаграммы, числа и проценты
Внешнее restful API речевой аналитики для выгрузки и загрузки данных