| + | Народна мова афроамериканців | 8 кГц | Коллцентр | 211 |
| Короткий опис | Дані кол-центру афроамериканської розмови | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка: 612, Чоловік: 1242 та Невідомо: 12 |
|
| + | | 16 кГц | Подкаст | 154 |
| Короткий опис | Дані афроамериканських медіа | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | Mono | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка: 151, Чоловік: 150 та Невідомо: 10 |
|
| + | Африкаанс | 8 кГц | Загальна розмова | 368 |
| Короткий опис | Дані про загальну розмову африкаанс | | Опис набору даних | Незаписана телефонна розмова між двома людьми. Приблизна тривалість аудіо (діапазон) – 15-60 хвилин, мова африкаанс, якою розмовляють в Африці. | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка: 502, Чоловік: 390 та Невідомо: 2 |
|
| + | | 16 кГц | Подкаст | 658 |
| Короткий опис | Медіафайли мовою африкаанс | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | Mono | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка: 750, Чоловік: 1278 та Невідомо: 52 |
|
| + | Арабська | 8 кГц | Загальна розмова | 292 |
| Короткий опис | Дані про загальну розмову арабської мови | | Опис набору даних | Незаписана телефонна розмова між двома людьми. Приблизна тривалість аудіо (діапазон) – 15-60 хвилин, арабська з країн Перської затоки. | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка: 171, Чоловік: 534 та Невідомо: 1 |
|
| + | | 48 кГц | Сценарний монолог | 1,947 |
| Короткий опис | Арабський сценарний монолог | | Опис набору даних | Записи окремих висловлювань, які зазвичай тривають від 5 до 30 секунд | | Аудіоканал | Mono | | Платформа для запису | Додаток для мобільних телефонів | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 838 Чоловік 1209 Невідомо 78 |
|
| + | Ассамська (у розробці) | | Коллцентр | 60 |
| Короткий опис | Дані кол-центру для ассамської мови (в процесі розробки) | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | | | Загальна розмова | 100 |
| Короткий опис | Дані загальної розмови для ассамської мови (в процесі розробки) | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | | | Подкаст | 40 |
| Короткий опис | Ассамська (в процесі розробки) аудіодані медіа | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | Бенгальська (у розробці) | | Коллцентр | 60 |
| Короткий опис | Дані кол-центру бенгальською мовою (в процесі розробки) | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | | | Загальна розмова | 100 |
| Короткий опис | Дані загальної розмови бенгальською (у розробці) | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | | | Подкаст | 40 |
| Короткий опис | Бенгальські (в процесі розробки) аудіодані медіа | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | Бостонська англійська | 8 кГц | Коллцентр | 177 |
| Короткий опис | Дані кол-центру Бостона | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка: 605, Чоловік: 711 та Невідомо: 0 |
|
| + | | 8 кГц | Загальна розмова | 32 |
| Короткий опис | Дані загальної розмови в Бостоні | | Опис набору даних | Незаписана телефонна розмова між двома людьми. Приблизна тривалість аудіо (діапазон) - 15-60 хвилин, | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка: 53, Чоловік: 83 та Невідомо: 0 |
|
| + | | 16 кГц | Подкаст | 93 |
| Короткий опис | Аудіодані Boston Media | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | Mono | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка: 43, Чоловік: 181 та Невідомо: 2 |
|
| + | Канадська французька | 48 кГц | Сценарний монолог | 1,222 |
| Короткий опис | Канадська французька | | Опис набору даних | Записи окремих висловлювань, які зазвичай тривають від 5 до 30 секунд | | Аудіоканал | Mono | | Платформа для запису | Додаток для мобільних телефонів | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 974 Чоловік 631 Невідомо 1 |
|
| + | Китайська англійська | 8 кГц | Коллцентр | 169 |
| Короткий опис | Дані китайських кол-центрів | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінки: 1790, Чоловіки: 523 та Невідомо: 13 |
|
| + | | 16 кГц | Подкаст | 249 |
| Короткий опис | Аудіодані китайських медіа | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | Mono | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінки: 126, Чоловіки: 346 та Невідомо: 6 |
|
| + | Китайська спрощена | 48 кГц | Сценарний монолог | 2,762 |
| Короткий опис | Китайська спрощена | | Опис набору даних | Записи окремих висловлювань, які зазвичай тривають від 5 до 30 секунд | | Аудіоканал | Mono | | Платформа для запису | Додаток для мобільних телефонів | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 1920 Чоловік 1535 Невідомо 270 |
|
| + | Китайський традиційний | 48 кГц | Сценарний монолог | 1,028 |
| Короткий опис | Китайський традиційний | | Опис набору даних | Записи окремих висловлювань, які зазвичай тривають від 5 до 30 секунд | | Аудіоканал | Mono | | Платформа для запису | Додаток для мобільних телефонів | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 1069 Чоловік 262 Невідомо 3 |
|
| + | Данська | 8 кГц | Загальна розмова | 372 |
| Короткий опис | Дані про загальну розмову на датській мові | | Опис набору даних | Незаписана телефонна розмова між двома людьми. Приблизна тривалість аудіо (діапазон) - 15-60 хвилин, | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінки: 311, Чоловіки: 417, Невідомо: 0 |
|
| + | | 16 кГц | Подкаст | 664 |
| Короткий опис | Аудіодані Danish Media | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | Mono | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінки: 369, Чоловіки: 864, Невідомо: 27 |
|
| + | | 48 кГц | Сценарний монолог | 2,579 |
| Короткий опис | Датський сценарний монолог | | Опис набору даних | Записи окремих висловлювань, тривалістю від 5 до 30 секунд, данська мова з Данії | | Аудіоканал | Mono | | Платформа для запису | Додаток для мобільних телефонів | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 1551 Чоловік 1233 Невідомо 42 |
|
| + | Англійський глибокий південь | 8 кГц | Коллцентр | 151 |
| Короткий опис | Дані кол-центру English Deep South | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 221, Чоловік 1004, Невідомо 7 |
|
| + | | 8 кГц | Загальна розмова | 56 |
| Короткий опис | Дані загальної розмови англійською мовою з Глибокого Півдня | | Опис набору даних | Незаписана телефонна розмова між двома людьми. Приблизна тривалість аудіо (діапазон) - 15-60 хвилин, | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 99, Чоловік 31, Невідомо 0 |
|
| + | | 16 кГц | Подкаст | 266 |
| Короткий опис | Аудіодані англійською мовою Deep South Media | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | Mono | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 204, Чоловік 356, Невідомо 21 |
|
| + | Німецька | 8 кГц | Коллцентр | 64 |
| Короткий опис | Дані німецьких кол-центрів | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | Mono | | Платформа для запису | робочий стіл | | WER (%) | | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 478 Чоловік 1440 Невідомо 0 |
|
| + | | 8 кГц | IVR | 200 |
| Короткий опис | Дані німецького IVR | | Опис набору даних | Людина-машина. Тип IVR-процесу, де є запит TTS (наприклад, «Чим я можу вам допомогти»), а потім спонтанна відповідь людини. | | Аудіоканал | Mono | | Платформа для запису | робочий стіл | | WER (%) | | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 10115 Чоловік 8750 Невідомо 0 |
|
| + | Гуджараті (у розробці) | | Коллцентр | 60 |
| Короткий опис | Дані кол-центру гуджаратською мовою (у розробці) | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | | | Загальна розмова | 100 |
| Короткий опис | Дані загальної розмови гуджараті (у розробці) | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | | | Подкаст | 40 |
| Короткий опис | Гуджараті (в процесі розробки) аудіодані медіа | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | Іврит | 8 кГц | Загальна розмова | 399 |
| Короткий опис | Дані про загальну розмову на івриті | | Опис набору даних | Незаписана телефонна розмова між двома людьми. Орієнтовна тривалість аудіо (діапазон) – 15-60 хвилин, іврит (Ізраїль) | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 414, Чоловік 399, Невідомо 1 |
|
| + | | 16 кГц | Подкаст | 427 |
| Короткий опис | Аудіодані івритських медіа | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | Mono | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 361, Чоловік 513, Невідомо 13 |
|
| + | Хінді | 16 кГц | Подкаст | 219 |
| Короткий опис | Аудіодані хінді медіа | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | Mono | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 83, Чоловік 309, Невідомо 0 |
|
| + | | 48 кГц | Сценарний монолог | 2,867 |
| Короткий опис | Монолог на хінді | | Опис набору даних | Записи окремих висловлювань, які зазвичай тривають від 5 до 30 секунд | | Аудіоканал | Mono | | Платформа для запису | Додаток для мобільних телефонів | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 1977 Чоловік 1864 Невідомо 147 |
|
| + | Гінгліш | 8 кГц | Коллцентр | 208 |
| Короткий опис | Дані кол-центру (ХІНГЛІШ) | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 822, Чоловік 1262, Невідомо 0 |
|
| + | | 16 кГц | Подкаст | 216 |
| Короткий опис | Аудіодані медіа ХІНГЛІШ | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | Mono | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 75, Чоловік 380, Невідомо 0 |
|
| + | Іспанська англійська | 8 кГц | Коллцентр | 212 |
| Короткий опис | Дані латиноамериканських кол-центрів | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 822, Чоловік 1262, Невідомий 0 |
|
| + | | 16 кГц | Подкаст | 155 |
| Короткий опис | Аудіо для латиноамериканських дзвінків | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | Mono | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 140, Чоловік 219, Невідомий 5 |
|
| + | Індонезійська | 8 кГц | Загальна розмова | 496 |
| Короткий опис | Дані про загальну розмову на індонезійській мові | | Опис набору даних | Незаписана телефонна розмова між двома людьми. Приблизна тривалість аудіо (діапазон) – 15-60 хвилин, індонезійська мова | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 524, Чоловік 454, Невідомий 2 |
|
| + | | 16 кГц | Подкаст | 643 |
| Короткий опис | Аудіодані індонезійських медіа | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | Mono | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 746, Чоловік 1507, Невідомий 129 |
|
| + | Ірландська | 8 кГц | Загальна розмова | 192 |
| Короткий опис | Дані про загальну розмову ірландської мови | | Опис набору даних | Незаписана телефонна розмова між двома людьми. Приблизна тривалість аудіо (діапазон) - 15-60 хвилин, | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 213, Чоловік 153, Невідомо 0 |
|
| + | Японська | 48 кГц | Сценарний монолог | 2,335 |
| Короткий опис | Японський сценарний монолог | | Опис набору даних | Записи окремих висловлювань, які зазвичай тривають від 5 до 30 секунд | | Аудіоканал | Mono | | Платформа для запису | Додаток для мобільних телефонів | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 1460 Чоловік 1221 Невідомо 194 |
|
| + | Каннада (у розробці) | | Коллцентр | 60 |
| Короткий опис | Дані кол-центру для каннади (в процесі розробки) | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | | | Загальна розмова | 100 |
| Короткий опис | Дані загальної розмови про каннаду (в процесі розробки) | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | | | Подкаст | 40 |
| Короткий опис | Аудіодані медіа для каннади (в процесі розробки) | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | Корейська | 8 кГц | Коллцентр | 107 |
| Короткий опис | Дані корейських кол-центрів | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 1086, Чоловік 210, Невідомо 4 |
|
| + | | 16 кГц | Подкаст | 204 |
| Короткий опис | Аудіодані корейських медіа | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | Mono | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 70, Чоловік 303, Невідомо 25 |
|
| + | | 48 кГц | Сценарний монолог | 1,955 |
| Короткий опис | Корейський сценарний монолог | | Опис набору даних | Записи окремих висловлювань, які зазвичай тривають від 5 до 30 секунд | | Аудіоканал | Mono | | Платформа для запису | Додаток для мобільних телефонів | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 1195 Чоловік 1134 Невідомо 122 |
|
| + | малайський | 8 кГц | Загальна розмова | 266 |
| Короткий опис | Дані про загальну розмову з малайської мови | | Опис набору даних | Незаписана телефонна розмова між двома людьми. Приблизна тривалість аудіо (діапазон) – 15-60 хвилин, малайська мова в Малайзії | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 316, Чоловік 176, Невідомо 0 |
|
| + | | 16 кГц | Подкаст | 344 |
| Короткий опис | Аудіодані Malay Media | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | Mono | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 236, Чоловік 626, Невідомо 47 |
|
| + | Малаялам (у розробці) | | Коллцентр | 60 |
| Короткий опис | Дані кол-центру для малаяламської мови (в процесі розробки) | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | | | Загальна розмова | 100 |
| Короткий опис | Дані загальної розмови на малаяламській мові (в процесі розробки) | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | | | Подкаст | 40 |
| Короткий опис | Аудіодані медіа з малаяламською мовою (в процесі розробки) | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | Маратхі (у розробці) | | Коллцентр | 60 |
| Короткий опис | Дані кол-центру для маратхі (в процесі розробки) | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | | | Загальна розмова | 100 |
| Короткий опис | Дані загальної розмови на маратхі (у розробці) | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | | | Подкаст | 40 |
| Короткий опис | Аудіодані медіа на маратхі (в процесі розробки) | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | Іспанська (Мексика) | 48 кГц | Сценарний монолог | 1,492 |
| Короткий опис | Мексиканський іспанський сценарний монолог | | Опис набору даних | Записи окремих висловлювань, які зазвичай тривають від 5 до 30 секунд | | Аудіоканал | Mono | | Платформа для запису | Додаток для мобільних телефонів | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 1016 Чоловік 1069 Невідомо 95 |
|
| + | Нідерландська | 48 кГц | Сценарний монолог | 1,205 |
| Короткий опис | Голландський сценарний монолог | | Опис набору даних | Записи окремих висловлювань, які зазвичай тривають від 5 до 30 секунд | | Аудіоканал | Mono | | Платформа для запису | Додаток для мобільних телефонів | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 1285 Чоловік 531 Невідомо 3 |
|
| + | Нью-Йоркська англійська | 8 кГц | Коллцентр | 103 |
| Короткий опис | Дані кол-центру англійською мовою в Нью-Йорку | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 610, Чоловік 532, Невідомо 0 |
|
| + | | 8 кГц | Загальна розмова | 107 |
| Короткий опис | Дані про загальну розмовну мову з англійської мови в Нью-Йорку | | Опис набору даних | Незаписана телефонна розмова між двома людьми. Приблизна тривалість аудіо (діапазон) - 15-60 хвилин, | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 118, Чоловік 114, Невідомий 0 |
|
| + | | 16 кГц | Подкаст | 140 |
| Короткий опис | Аудіодані New York English Media | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | Mono | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 66, Чоловік 230, Невідомий 11 |
|
| + | Новозеландська англійська | 8 кГц | Загальна розмова | 148 |
| Короткий опис | Дані про загальну розмовну мову з англійської мови Нової Зеландії | | Опис набору даних | Незаписана телефонна розмова між двома людьми. Приблизна тривалість аудіо (діапазон) - 15-60 хвилин, | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 167, чоловік 121, невідомо 4 |
|
| + | | 16 кГц | Подкаст | 400 |
| Короткий опис | Аудіо з англійських медіа Нової Зеландії | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | Mono | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 367, чоловік 678, невідомо 26 |
|
| + | Орія (у розробці) | | Коллцентр | 60 |
| Короткий опис | Дані кол-центру Oriya (в процесі розробки) | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | | | Загальна розмова | 100 |
| Короткий опис | Дані загальної розмови в Орії (в процесі розробки) | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | | | Подкаст | 40 |
| Короткий опис | Аудіодані медіа Орія (у процесі розробки) | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | Польська | 16 кГц | Подкаст | 269 |
| Короткий опис | Аудіо польських медіа | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | Mono | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 173 Чоловік 354 Невідомо 6 |
|
| + | Польська (Польща) | 48 кГц | Сценарний монолог | 1,482 |
| Короткий опис | Польська Польща - Сценарійний монолог | | Опис набору даних | Записи окремих висловлювань, які зазвичай тривають від 5 до 30 секунд | | Аудіоканал | Mono | | Платформа для запису | Додаток для мобільних телефонів | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 1324 Чоловік 701 Невідомо 24 |
|
| + | Панджабі (у розробці) | | Коллцентр | 60 |
| Короткий опис | Дані кол-центру для панджабі (в процесі розробки) | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | | | Загальна розмова | 100 |
| Короткий опис | Дані загальної розмови для панджабі (у розробці) | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | | | Подкаст | 40 |
| Короткий опис | Аудіодані медіа для панджабі (в процесі розробки) | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | Російська | 48 кГц | Сценарний монолог | 2,398 |
| Короткий опис | Монолог за російським сценарієм | | Опис набору даних | Записи окремих висловлювань, які зазвичай тривають від 5 до 30 секунд | | Аудіоканал | Mono | | Платформа для запису | Додаток для мобільних телефонів | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 1689 Чоловік 1937 Невідомо 214 |
|
| + | Шотландський (англійський акцент) | 8 кГц | Загальна розмова | 292 |
| Короткий опис | Дані про загальну шотландську розмову | | Опис набору даних | Незаписана телефонна розмова між двома людьми. Приблизна тривалість аудіо (діапазон) - 15-60 хвилин, | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 285, Чоловік 260, Невідомо 3 |
|
| + | Сінгапурська англійська | 8 кГц | Коллцентр | 218 |
| Короткий опис | Дані кол-центру Сінгапуру | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 2139, Чоловік 884, Невідомо 21 |
|
| + | | 16 кГц | Подкаст | 247 |
| Короткий опис | Аудіодані Singapore Media | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | Mono | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 160, Чоловік 455, Невідомий 37 |
|
| + | південноафриканська англійська | 8 кГц | Коллцентр | 261 |
| Короткий опис | Дані південноафриканського кол-центру англійською мовою | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 1274, Чоловік 935, Невідомо 1 |
|
| + | | 16 кГц | Подкаст | 251 |
| Короткий опис | Аудіодані англійських медіа з Південної Африки | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | Mono | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 235, Чоловік 432, Невідомий 36 |
|
| + | Суахілі | 8 кГц | Коллцентр | 230 |
| Короткий опис | Дані кол-центру мовою суахілі | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 611, Чоловік 833, Невідомий 0 |
|
| + | | 16 кГц | Подкаст | 265 |
| Короткий опис | Аудіодані суахілі медіа | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | Mono | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 118, Чоловік 493, Невідомий 25 |
|
| + | Шведська | 8 кГц | Коллцентр | 250 |
| Короткий опис | Дані шведського кол-центру | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 1581, чоловік 727, невідомо 2 |
|
| + | | 16 кГц | Подкаст | 278 |
| Короткий опис | Аудіодані шведських медіа | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | Mono | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 195, чоловік 500, невідомо 21 |
|
| + | Тамільська (у розробці) | | Коллцентр | 60 |
| Короткий опис | Дані кол-центру тамільською мовою (у розробці) | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | | | Загальна розмова | 100 |
| Короткий опис | Дані загальної розмови тамільською мовою (у розробці) | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | | | Подкаст | 40 |
| Короткий опис | Аудіодані медіа тамільською мовою (у процесі розробки) | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | Телугу | 8 кГц | Загальна розмова | 553 |
| Короткий опис | Дані загальної розмови на телугу | | Опис набору даних | Незаписана телефонна розмова між двома людьми. Приблизна тривалість аудіо (діапазон) - 15-60 хвилин, | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 574, Чоловік 564, Невідомо 0 |
|
| + | | 16 кГц | Подкаст | 648 |
| Короткий опис | Аудіодані Telugu Media | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | Mono | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 207, Чоловік 963, Невідомий 2 |
|
| + | Телугу (у розробці) | | Коллцентр | 30 |
| Короткий опис | Дані кол-центру для телугу (в процесі розробки) | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | | | Загальна розмова | 50 |
| Короткий опис | Дані загальної розмови телугу (у процесі розробки) | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | | | Подкаст | 20 |
| Короткий опис | Телугу (в процесі розробки) аудіодані медіа | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | |
|
| + | Тайська | 8 кГц | Загальна розмова | 183 |
| Короткий опис | Загальна розмова тайської мови | | Опис набору даних | Незаписана телефонна розмова між двома людьми. Приблизна тривалість аудіо (діапазон) – 15-60 хвилин. Неформальний жартівливий прийом, що використовується між друзями. | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 338, Чоловік 96, Невідомий 8 |
|
| + | | 16 кГц | Подкаст | 173 |
| Короткий опис | Аудіо тайських медіа | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | Mono | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 143, Чоловік 502, Невідомий 26 |
|
| + | Турецька індичка | 48 кГц | Сценарний монолог | 2,027 |
| Короткий опис | Турецька індичка | | Опис набору даних | Записи окремих висловлювань, які зазвичай тривають від 5 до 30 секунд | | Аудіоканал | Mono | | Платформа для запису | Додаток для мобільних телефонів | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 1561 Чоловік 1241 Невідомо 31 |
|
| + | В'єтнамська | 8 кГц | Загальна розмова | 295 |
| Короткий опис | Дані про загальну розмову з в'єтнамської мови | | Опис набору даних | Непідготовлена, штучна телефонна розмова між «агентом» та «клієнтом». Приблизна тривалість аудіо (діапазон) 5-15 хвилин, Північний (наприклад, Ханой), Центральний та Південний (наприклад, Хошимін) регіони. | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 400, чоловік 380, невідомі 2 |
|
| + | | 16 кГц | Подкаст | 257 |
| Короткий опис | Аудіодані в'єтнамських медіа | | Опис набору даних | Ліцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин | | Аудіоканал | Mono | | Платформа для запису | Веб-пошук | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 249, чоловік 200, невідомі 45 |
|
| + | Валлійська (англійський акцент) | 8 кГц | Загальна розмова | 278 |
| Короткий опис | Дані про валлійську загальну розмову | | Опис набору даних | Незаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин, | | Аудіоканал | Подвійний | | Платформа для запису | робочий стіл | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Жінка 270, Чоловік 324, Невідомий 0 |
|
| + | Великобританія англійська | 16 кГц | Прокидай слово | Доповідачі 200 |
| Короткий опис | Wake Word UK English | | Опис набору даних | збір даних за ключовими фразами
- 200 колонки
- 4 унікальні ключові фрази на мовця
- 25-30 повторюваних записів ключових фраз на унікальну ключову фразу
- 25-30 аудіофайлів на унікальну ключову фразу
- Всього 120 записаних висловлювань на мовця
| | Аудіоканал | 1 канал | | Платформа для запису | Додаток для мобільних телефонів | | WER (%) | 5.0 | | Аудіо формати | . Wav | | Формат транскрипції | .json | | Використовуйте Case | ASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання | | Кількість спікерів | Стать: 50% чоловіків, 50% жінок, +/- 10%. |
|