| + | Афроамериканский диалект | 8 кГц | Колл-центр | 211 |
| Описание | Данные колл-центра для афроамериканцев | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщин: 612, Мужчин: 1242, Неизвестно: 12 |
|
| + | | 16 кГц | Подкасты | 154 |
| Описание | Данные афроамериканских народных СМИ | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | Моно | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщин: 151, Мужчин: 150, Неизвестно: 10 |
|
| + | Африкаанс | 8 кГц | Общий разговор | 368 |
| Описание | Данные общего разговора на африкаанс | | Описание набора данных | Незаписанный телефонный разговор между двумя людьми. прибл. Продолжительность аудио (диапазон) — 15–60 минут, африкаанс, на котором говорят в Африке. | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщин: 502, Мужчин: 390, Неизвестно: 2 |
|
| + | | 16 кГц | Подкасты | 658 |
| Описание | Медиафайлы на африкаанс | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | Моно | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщин: 750, Мужчин: 1278, Неизвестно: 52 |
|
| + | арабском | 8 кГц | Общий разговор | 292 |
| Описание | Данные для общего разговора на арабском языке | | Описание набора данных | Незаписанный телефонный разговор между двумя людьми. прибл. Продолжительность аудио (диапазон) - 15-60 минут, арабский язык из стран Персидского залива | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщин: 171, Мужчин: 534, Неизвестно: 1 |
|
| + | | 48 кГц | Монолог по сценарию | 1,947 |
| Описание | Монолог на арабском языке | | Описание набора данных | Записи одного высказывания, которые, как правило, попадают в диапазон от 5 до 30 секунд. | | Аудиоканала | Моно | | Платформа записи | Мобильное приложение | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 838 Мужчина 1209 Неизвестно 78 |
|
| + | Ассамский (в разработке) | | Call-центр | 60 |
| Описание | Ассамский (в разработке) Данные колл-центра | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | | | Общий разговор | 100 |
| Описание | Ассамский (в разработке) Общие данные разговора | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | | | Подкасты | 40 |
| Описание | Аудиоданные мультимедиа на ассамском языке (в разработке) | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | Бенгальский (в разработке) | | Call-центр | 60 |
| Описание | Бенгальский (в разработке) данные колл-центра | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | | | Общий разговор | 100 |
| Описание | Бенгальский (In Pipeline) Общие данные разговора | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | | | Подкасты | 40 |
| Описание | Бенгальский (In Pipeline) Медиа-аудиоданные | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | Бостонский английский | 8 кГц | Call-центр | 177 |
| Описание | Данные колл-центра Бостона | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщин: 605, Мужчин: 711, Неизвестно: 0 |
|
| + | | 8 кГц | Общий разговор | 32 |
| Описание | Данные общего разговора в Бостоне | | Описание набора данных | Незаписанный телефонный разговор между двумя людьми. прибл. Продолжительность аудио (диапазон) - 15-60 минут, | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщин: 53, Мужчин: 83, Неизвестно: 0 |
|
| + | | 16 кГц | Подкасты | 93 |
| Описание | Аудиоданные Boston Media | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | Моно | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщин: 43, Мужчин: 181, Неизвестно: 2 |
|
| + | Канадский французский | 48 кГц | Монолог по сценарию | 1,222 |
| Описание | Канадский французский | | Описание набора данных | Записи одного высказывания, которые, как правило, попадают в диапазон от 5 до 30 секунд. | | Аудиоканала | Моно | | Платформа записи | Мобильное приложение | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 974 Мужчина 631 Неизвестно 1 |
|
| + | Китайский английский | 8 кГц | Call-центр | 169 |
| Описание | Данные китайского колл-центра | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщин: 1790, Мужчин: 523 и Неизвестно: 13 |
|
| + | | 16 кГц | Подкасты | 249 |
| Описание | Аудиоданные китайских СМИ | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | Моно | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщин: 126, Мужчин: 346 и Неизвестно: 6 |
|
| + | Китайский упрощенный | 48 кГц | Монолог по сценарию | 2,762 |
| Описание | Китайский упрощенный | | Описание набора данных | Записи одного высказывания, которые, как правило, попадают в диапазон от 5 до 30 секунд. | | Аудиоканала | Моно | | Платформа записи | Мобильное приложение | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 1920 Мужчина 1535 Неизвестно 270 |
|
| + | Традиционный китайский | 48 кГц | Монолог по сценарию | 1,028 |
| Описание | Традиционный китайский | | Описание набора данных | Записи одного высказывания, которые, как правило, попадают в диапазон от 5 до 30 секунд. | | Аудиоканала | Моно | | Платформа записи | Мобильное приложение | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 1069 Мужчина 262 Неизвестно 3 |
|
| + | Датский | 8 кГц | Общий разговор | 372 |
| Описание | Датские общие разговорные данные | | Описание набора данных | Незаписанный телефонный разговор между двумя людьми. прибл. Продолжительность аудио (диапазон) - 15-60 минут, | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщин: 311, Мужчин: 417, Неизвестно: 0 |
|
| + | | 16 кГц | Подкасты | 664 |
| Описание | Аудиоданные датских СМИ | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | Моно | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщин: 369, Мужчин: 864, Неизвестно: 27 |
|
| + | | 48 кГц | Монолог по сценарию | 2,579 |
| Описание | Монолог на датском языке | | Описание набора данных | Записи с одним высказыванием, длительностью от 5 до 30 секунд, датский из Дании. | | Аудиоканала | Моно | | Платформа записи | Мобильное приложение | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 1551 Мужчина 1233 Неизвестно 42 |
|
| + | Английский Deep South | 8 кГц | Call-центр | 151 |
| Описание | English Данные колл-центра Deep South | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 221, Мужчина 1004, Неизвестно 7 |
|
| + | | 8 кГц | Общий разговор | 56 |
| Описание | Данные английского Deep South General Conversation | | Описание набора данных | Незаписанный телефонный разговор между двумя людьми. прибл. Продолжительность аудио (диапазон) - 15-60 минут, | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 99, Мужчина 31, Неизвестно 0 |
|
| + | | 16 кГц | Подкасты | 266 |
| Описание | Аудиоданные Deep South Media на английском языке | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | Моно | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 204, Мужчина 356, Неизвестно 21 |
|
| + | Немецкий | 8 кГц | Call-центр | 64 |
| Описание | Данные немецкого колл-центра | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | Моно | | Платформа записи | Рабочий стол | | Вер (%) | | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 478 Мужчина 1440 Неизвестно 0 |
|
| + | | 8 кГц | IVR | 200 |
| Описание | IVR-данные Германии | | Описание набора данных | Человек к машине. Тип потока IVR, в котором есть подсказка TTS (например, «Чем я могу вам помочь»), за которой следует спонтанный ответ человека. | | Аудиоканала | Моно | | Платформа записи | Рабочий стол | | Вер (%) | | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 10115 Мужчина 8750 Неизвестно 0 |
|
| + | Гуджарати (в разработке) | | Call-центр | 60 |
| Описание | Гуджарати (в разработке) Данные колл-центра | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | | | Общий разговор | 100 |
| Описание | Гуджарати (в конвейере) Общие данные разговора | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | | | Подкасты | 40 |
| Описание | Аудиоданные мультимедиа гуджарати (в конвейере) | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | древнееврейский | 8 кГц | Общий разговор | 399 |
| Описание | Данные общего разговора на иврите | | Описание набора данных | Незаписанный телефонный разговор между двумя людьми. прибл. Продолжительность аудио (диапазон) - 15-60 минут, иврит в Израиле | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 414 , Мужчина 399 , Неизвестно 1 |
|
| + | | 16 кГц | Подкасты | 427 |
| Описание | Аудиоданные на иврите Media | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | Моно | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 361, Мужчина 513, Неизвестно 13 |
|
| + | Хинди | 16 кГц | Подкасты | 219 |
| Описание | Аудиоданные хинди-медиа | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | Моно | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 83, Мужчина 309, Неизвестно 0 |
|
| + | | 48 кГц | Монолог по сценарию | 2,867 |
| Описание | Монолог по сценарию на хинди | | Описание набора данных | Записи одного высказывания, которые, как правило, попадают в диапазон от 5 до 30 секунд. | | Аудиоканала | Моно | | Платформа записи | Мобильное приложение | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 1977 Мужчина 1864 Неизвестно 147 |
|
| + | хинглиш | 8 кГц | Call-центр | 208 |
| Описание | HINGLISH Данные колл-центра | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 822, Мужчина 1262, Неизвестно 0 |
|
| + | | 16 кГц | Подкасты | 216 |
| Описание | HINGLISH Мультимедийные аудиоданные | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | Моно | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 75, Мужчина 380, Неизвестно 0 |
|
| + | Латиноамериканский английский | 8 кГц | Call-центр | 212 |
| Описание | Данные колл-центра для латиноамериканцев | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 822, Мужчина 1262, Неизвестно 0 |
|
| + | | 16 кГц | Подкасты | 155 |
| Описание | Аудио для латиноамериканского звонка | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | Моно | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 140, Мужчина 219, Неизвестно 5 |
|
| + | Индонезийский | 8 кГц | Общий разговор | 496 |
| Описание | Данные индонезийского общего разговора | | Описание набора данных | Незаписанный телефонный разговор между двумя людьми. прибл. Продолжительность аудио (диапазон) — 15–60 минут, индонезийский индонезийский | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 524, Мужчина 454, Неизвестно 2 |
|
| + | | 16 кГц | Подкасты | 643 |
| Описание | Аудиоданные индонезийских СМИ | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | Моно | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 746, Мужчина 1507, Неизвестно 129 |
|
| + | ирландский | 8 кГц | Общий разговор | 192 |
| Описание | Данные ирландского общего разговора | | Описание набора данных | Незаписанный телефонный разговор между двумя людьми. прибл. Продолжительность аудио (диапазон) - 15-60 минут, | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 213 , Мужчина 153 , Неизвестно 0 |
|
| + | Японский | 48 кГц | Монолог по сценарию | 2,335 |
| Описание | Монолог по японскому сценарию | | Описание набора данных | Записи одного высказывания, которые, как правило, попадают в диапазон от 5 до 30 секунд. | | Аудиоканала | Моно | | Платформа записи | Мобильное приложение | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 1460 Мужчина 1221 Неизвестно 194 |
|
| + | Каннада (в разработке) | | Call-центр | 60 |
| Описание | Каннада (в разработке) Данные колл-центра | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | | | Общий разговор | 100 |
| Описание | Каннада (в конвейере) Общие данные разговора | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | | | Подкасты | 40 |
| Описание | Каннада (в конвейере) Медиа-аудиоданные | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | Корейский | 8 кГц | Call-центр | 107 |
| Описание | Данные корейского колл-центра | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 1086, Мужчина 210, Неизвестно 4 |
|
| + | | 16 кГц | Подкасты | 204 |
| Описание | Звуковые данные корейских СМИ | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | Моно | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 70 Мужчина 303, Неизвестно 25 |
|
| + | | 48 кГц | Монолог по сценарию | 1,955 |
| Описание | Монолог по корейскому сценарию | | Описание набора данных | Записи одного высказывания, которые, как правило, попадают в диапазон от 5 до 30 секунд. | | Аудиоканала | Моно | | Платформа записи | Мобильное приложение | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 1195 Мужчина 1134 Неизвестно 122 |
|
| + | Malay | 8 кГц | Общий разговор | 266 |
| Описание | Данные малайского общего разговора | | Описание набора данных | Незаписанный телефонный разговор между двумя людьми. прибл. Продолжительность аудио (диапазон) — 15–60 минут, малайский в Малайзии. | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 316, Мужчина 176, Неизвестно 0 |
|
| + | | 16 кГц | Подкасты | 344 |
| Описание | Аудиоданные малайских СМИ | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | Моно | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 236, Мужчина 626, Неизвестно 47 |
|
| + | Малаялам (в разработке) | | Call-центр | 60 |
| Описание | Малаялам (в разработке) Данные колл-центра | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | | | Общий разговор | 100 |
| Описание | Малаялам (в конвейере) Общие данные разговора | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | | | Подкасты | 40 |
| Описание | Малаялам (In Pipeline) Медиа-аудиоданные | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | Маратхи (в разработке) | | Call-центр | 60 |
| Описание | Данные колл-центра на языке маратхи (в разработке) | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | | | Общий разговор | 100 |
| Описание | Маратхи (в конвейере) Общие данные разговора | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | | | Подкасты | 40 |
| Описание | Аудиоданные мультимедиа маратхи (в конвейере) | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | Испанский (Мексика) | 48 кГц | Монолог по сценарию | 1,492 |
| Описание | Мексиканский монолог по испанскому сценарию | | Описание набора данных | Записи одного высказывания, которые, как правило, попадают в диапазон от 5 до 30 секунд. | | Аудиоканала | Моно | | Платформа записи | Мобильное приложение | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 1016 Мужчина 1069 Неизвестно 95 |
|
| + | Голландский | 48 кГц | Монолог по сценарию | 1,205 |
| Описание | Монолог по голландскому сценарию | | Описание набора данных | Записи одного высказывания, которые, как правило, попадают в диапазон от 5 до 30 секунд. | | Аудиоканала | Моно | | Платформа записи | Мобильное приложение | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 1285 Мужчина 531 Неизвестно 3 |
|
| + | Нью-йоркский английский | 8 кГц | Call-центр | 103 |
| Описание | Данные колл-центра New York English | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 610, Мужчина 532, Неизвестно 0 |
|
| + | | 8 кГц | Общий разговор | 107 |
| Описание | Данные общего разговорного английского в Нью-Йорке | | Описание набора данных | Незаписанный телефонный разговор между двумя людьми. прибл. Продолжительность аудио (диапазон) - 15-60 минут, | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 118, Мужчина 114, Неизвестно 0 |
|
| + | | 16 кГц | Подкасты | 140 |
| Описание | Аудиоданные New York English Media | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | Моно | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 66, Мужчина 230, Неизвестно 11 |
|
| + | Новозеландский английский | 8 кГц | Общий разговор | 148 |
| Описание | Данные новозеландского английского для общего разговора | | Описание набора данных | Незаписанный телефонный разговор между двумя людьми. прибл. Продолжительность аудио (диапазон) - 15-60 минут, | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 167, мужчина 121, Неизвестно 4 |
|
| + | | 16 кГц | Подкасты | 400 |
| Описание | Новозеландский английский СМИ аудио | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | Моно | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 367, мужчина 678, Неизвестно 26 |
|
| + | Ория (в разработке) | | Call-центр | 60 |
| Описание | Oriya (In Pipeline) Данные колл-центра | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | | | Общий разговор | 100 |
| Описание | Oriya (In Pipeline) Общие данные разговора | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | | | Подкасты | 40 |
| Описание | Аудиоданные мультимедиа Oriya (In Pipeline) | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | Польский | 16 кГц | Подкасты | 269 |
| Описание | Польские СМИ аудио | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | Моно | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 173 Мужчина 354 Неизвестно 6 |
|
| + | Польский (польша) | 48 кГц | Монолог по сценарию | 1,482 |
| Описание | Польская Польша - Монолог по сценарию | | Описание набора данных | Записи одного высказывания, которые, как правило, попадают в диапазон от 5 до 30 секунд. | | Аудиоканала | Моно | | Платформа записи | Мобильное приложение | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 1324 Мужчина 701 Неизвестно 24 |
|
| + | Пенджаби (в разработке) | | Call-центр | 60 |
| Описание | Панджаби (в разработке) Данные колл-центра | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | | | Общий разговор | 100 |
| Описание | Панджаби (в разработке) Общие данные разговора | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | | | Подкасты | 40 |
| Описание | Пенджаби (в конвейере) Медиа-аудиоданные | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | Русский | 48 кГц | Монолог по сценарию | 2,398 |
| Описание | Монолог по русскому сценарию | | Описание набора данных | Записи одного высказывания, которые, как правило, попадают в диапазон от 5 до 30 секунд. | | Аудиоканала | Моно | | Платформа записи | Мобильное приложение | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 1689 Мужчина 1937 Неизвестно 214 |
|
| + | Шотландский (английский акцент) | 8 кГц | Общий разговор | 292 |
| Описание | Данные шотландского общего разговора | | Описание набора данных | Незаписанный телефонный разговор между двумя людьми. прибл. Продолжительность аудио (диапазон) - 15-60 минут, | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 285, Мужчина 260, Неизвестно 3 |
|
| + | Сингапурский английский | 8 кГц | Call-центр | 218 |
| Описание | Данные колл-центра Сингапура | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 2139, Мужчина 884, Неизвестно 21 |
|
| + | | 16 кГц | Подкасты | 247 |
| Описание | Аудиоданные Сингапурских СМИ | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | Моно | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 160, Мужчина 455, Неизвестно 37 |
|
| + | Южноафриканский английский | 8 кГц | Call-центр | 261 |
| Описание | Данные южноафриканского английского колл-центра | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 1274 , Мужчина 935 , Неизвестно 1 |
|
| + | | 16 кГц | Подкасты | 251 |
| Описание | Звуковые данные южноафриканских английских СМИ | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | Моно | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 235, Мужчина 432, Неизвестно 36 |
|
| + | суахили | 8 кГц | Call-центр | 230 |
| Описание | Данные колл-центра на суахили | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 611, Мужчина 833, Неизвестно 0 |
|
| + | | 16 кГц | Подкасты | 265 |
| Описание | Аудиоданные СМИ суахили | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | Моно | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 118, Мужчина 493, Неизвестно 25 |
|
| + | Шведский | 8 кГц | Call-центр | 250 |
| Описание | Данные шведского колл-центра | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 1581, мужчина 727, Неизвестно 2 |
|
| + | | 16 кГц | Подкасты | 278 |
| Описание | Аудиоданные шведских СМИ | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | Моно | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 195, мужчина 500, Неизвестно 21 |
|
| + | Тамильский (в разработке) | | Call-центр | 60 |
| Описание | Тамильский (в разработке) Данные колл-центра | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | | | Общий разговор | 100 |
| Описание | Тамильский (в разработке) Общие данные разговора | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | | | Подкасты | 40 |
| Описание | Аудиоданные мультимедиа на тамильском языке (в разработке) | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | Телугу | 8 кГц | Общий разговор | 553 |
| Описание | Общие разговорные данные на телугу | | Описание набора данных | Незаписанный телефонный разговор между двумя людьми. прибл. Продолжительность аудио (диапазон) - 15-60 минут, | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 574, Мужчина 564, Неизвестно 0 |
|
| + | | 16 кГц | Подкасты | 648 |
| Описание | Аудиоданные телугу Media | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | Моно | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 207, Мужчина 963, Неизвестно 2 |
|
| + | Телугу (в разработке) | | Call-центр | 30 |
| Описание | Телугу (в разработке) Данные колл-центра | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | | | Общий разговор | 50 |
| Описание | Телугу (в конвейере) Общие данные беседы | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | | | Подкасты | 20 |
| Описание | Телугу (в конвейере) Медиа-аудиоданные | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | |
|
| + | Тайский | 8 кГц | Общий разговор | 183 |
| Описание | Тайский общий разговор | | Описание набора данных | Незаписанный телефонный разговор между двумя людьми. прибл. Продолжительность аудио (диапазон) — 15–60 минут, неформальная регистрация, используемая между друзьями. | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 338, Мужчина 96, Неизвестно 8 |
|
| + | | 16 кГц | Подкасты | 173 |
| Описание | Тайские СМИ аудио | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | Моно | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 143, Мужчина 502, Неизвестно 26 |
|
| + | Турецкая Турция | 48 кГц | Монолог по сценарию | 2,027 |
| Описание | Турецкая Турция | | Описание набора данных | Записи одного высказывания, которые, как правило, попадают в диапазон от 5 до 30 секунд. | | Аудиоканала | Моно | | Платформа записи | Мобильное приложение | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 1561 Мужчина 1241 Неизвестно 31 |
|
| + | Вьетнамский | 8 кГц | Общий разговор | 295 |
| Описание | Данные вьетнамского общего разговора | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, северный (например, Ханой), центральный и южный (например, Хошимин). | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщины 400, мужчины 380, Неизвестные 2 |
|
| + | | 16 кГц | Подкасты | 257 |
| Описание | Аудиоданные вьетнамских СМИ | | Описание набора данных | Лицензируемые общедоступные аудио/видеофайлы, такие как интервью, подкасты и т. д. — от 1 до 5 человек. прибл. Продолжительность аудио (диапазон) 15-60 минут | | Аудиоканала | Моно | | Платформа записи | Веб-поиск | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщины 249, мужчины 200, Неизвестные 45 |
|
| + | Валлийский (английский акцент) | 8 кГц | Общий разговор | 278 |
| Описание | Данные валлийского общего разговора | | Описание набора данных | Синтетический телефонный разговор без сценария между «агентом» и «клиентом», прибл. Продолжительность звука (диапазон) 5-15 минут, | | Аудиоканала | Двойной | | Платформа записи | Рабочий стол | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Женщина 270, Мужчина 324, Неизвестно 0 |
|
| + | Великобритания Английский | 16 кГц | Wake Word | 200 Выступающие |
| Описание | Wake Word (Великобритания) английский | | Описание набора данных | сбор данных по ключевым фразам
- 200 колонки
- 4 уникальные ключевые фразы на каждого говорящего
- 25-30 повторяющихся записей ключевых фраз на одну уникальную ключевую фразу
- 25-30 аудиофайлов на уникальную ключевую фразу
- Всего 120 записанных высказываний на говорящего
| | Аудиоканала | 1 канал | | Платформа записи | Мобильное приложение | | Вер (%) | 5.0 | | Аудио форматы | . Wav | | Формат транскрипции | .json | | Кейсы | ASR, виртуальный помощник, чат-бот, разговорный ИИ, речевая аналитика, TTS, языковое моделирование | | Количество динамиков | Пол: 50% мужчин, 50% женщин, +/- 10%. |
|