Найнадійніші служби збору мовних даних для вашого ШІ

Навчайте свої моделі НЛП, VA, прототипи TTS та багато іншого з якісними розмовними даними за допомогою наших послуг зі збору аудіо та мовних даних

Збір мовних даних
країни
0 +
Години
Мовні дані
0 +
Проєкти
0 +
Мови (понад 100 діалектів)
0 +

8 / 16 / 44 / 48 кГц

частота вибірки

Професійні послуги збору аудіо/голосових даних

Будь-який предмет. Будь-який сценарій.

У Shaip наш досвід полягає у створенні високоякісних наборів мовних даних, розроблених для різноманітних вимог AI/ML. Ми пропонуємо широкий вибір мов і записи в різноманітних налаштуваннях, що робить наші набори даних всеосяжними та адаптованими. Ми зосереджені на тому, щоб надати моделям найбільший обсяг користувацьких мовних даних за найкоротший час. З нами на борту ви можете очікувати: 

Збірник промов
  • Підібрані високоякісні багатомовні аудіо/голосові дані для підвищення точності
  • Найвищий можливий рівень специфічності домену для налаштування різноманітних сценаріїв
  • Масштабуйте свою модель ML, щоб відповідати різноманітним демографічним і категоріям
  • Середовища запису: Студійна якість, кришталево чистий звук із мінімальним фоновим шумом, Природне середовище, де записи включають навколишні звуки для імітації реальних ситуацій.

Наша експертиза

Вирівняйте аудіодані для розумніших моделей NLP

Shaip пропонує наскрізні послуги збору мовних/аудіоданих більш ніж 100 мовами, щоб дозволити технологіям із підтримкою голосу задовольнити різноманітну аудиторію по всьому світу. Ми можемо працювати над проектами будь-якого обсягу та розміру; від ліцензування наявних готових наборів аудіоданих до керування збором власних аудіоданих до транскрипції та анотації аудіо. Незалежно від того, наскільки великий ваш проект зі збору мовленнєвих даних, ми можемо налаштувати послуги збору аудіо відповідно до ваших потреб, щоб створити високоякісні набори даних НЛП, орієнтовані на діалекти, тони та мови. Вибирайте з нашого широкого спектру наборів мовних даних та ресурсів збору аудіоданих для інтелектуальних налаштувань із голосовими функціями.

Монологічне мовлення

Монолог Сценарна та спонтанна мова

Він зосереджений на обробці мови від одного динаміка. Використовуйте сценарні підказки для введення в одноканальні аудіофайли, забезпечуючи захоплення унікальних моделей мовлення, тонів і нюансів, характерних для цієї особи.

Діалогічне мовлення

Сценарій діалогу та спонтанна мова

Взаємодія двох осіб, відтворення розмов і діалогів у реальному світі з використанням кількох мов за допомогою двоканальних файлів і транскрибованих ресурсів.

Багатосторонні розмови

Група / Muti-party
Спілкування

Дискусії з кількома особами, фіксація групової динаміки, накладень і різноманітних тонів для точного тренування моделей мовлення.

Колекція будильників

Колекція Wake-word / Key Phrase / Utterances​

Навчіть штучний інтелект визначати ключові фрази, пробуджувальні слова або висловлювання з подібним значенням, використовуючи різноманітні, насичені та автентичні висловлювання для вдосконаленої обробки та розуміння природної мови.

Акустична мова

Акустичні дані
COLLECTION

Ми можемо професійно записувати аудіодані студійної якості, будь то ресторани, офіси чи будинки, або з різних середовищ і мов, охоплюючи при цьому ширший акустичний діапазон (Comprehensive Sound Datasets).

Автоматичне розпізнавання мовлення

Автоматичне розпізнавання мовлення (ASR)

Підвищте точність ваших систем автоматичного розпізнавання мовлення (ASR), маючи доступ до найсучасніших диверсифікованих наборів мовних/аудіоданих із широкого спектру демографічних даних.

Висловлювання природною мовою

Багатомовні дані для мовлення/аудіо тренування

Наші кваліфіковані спеціалісти з мовлення по всьому світу пропонують багатомовні аудіо/мовні дані різними мовами та діалектами. Ці зусилля сприяють глобальній комунікації та долають мовні бар’єри, сприяючи більш інклюзивним та ефективним рішенням ШІ.

Цифрові віртуальні помічники

Перетворення тексту в мову
(TTS)

Створіть багатомовну модель перетворення тексту в мовлення (TTS) за допомогою нашої глобальної робочої сили, яка допоможе вам збирати мовленнєві дані більш ніж 150 мовами та діалектами, щоб покращити ваші моделі штучного інтелекту від елементів керування в автомобілі до чат-ботів і навчальних рішень із високим рівнем якісні аудіодані.

Запис кол-центру

Call Center
Спілкування

Справжній обмін між агентами та клієнтами, підтримка багатьох мов, таких як іспанська, німецька, американська англійська, бенгальська, японська, китайська та гінді.

Історії успіху

Розмовні набори даних ШІ з понад 3 тисячами годин даних 8 мовами

Прагнучи створити багатомовну платформу для індійських мов, клієнт співпрацював із Shaip для збору, сегментування та транскрипції великих наборів даних кількома індійськими мовами. Це допомогло б розробити ефективні мовленнєві моделі, які могли б використовувати нову інноваційну платформу клієнта.

Проблема: Понад 3,000 годин аудіоданих зібрано 8 індійськими мовами, сегментовано та транскрибовано для розробки автоматичного розпізнавання мовлення.

Рішення: Ми забезпечили збір даних, сегментацію, транскрипцію та доставку JSON-файлів з метаданими. Ми зібрали 3000 годин аудіоданих 8 індійськими мовами у великому масштабі для проекту клієнта з технології мовлення.

Тематика збору мовних даних

Причини вибрати Shaip як надійного партнера зі збору даних про мовлення

Люди

Люди

Спеціальні та навчені команди:

  • 30,000+ співробітників для створення даних, маркування та забезпечення якості
  • Сертифікована команда управління проектами
  • Досвідчена команда з розробки продуктів
  • Команда пошуку та адаптації кадрів
Процес

Процес

Найвища ефективність процесу забезпечується завдяки:

  • Надійний процес 6 Sigma Stage-Gate
  • Спеціальна команда з 6 чорних поясів Sigma – власники ключових процесів і відповідність якості
  • Постійне вдосконалення та цикл зворотнього зв’язку
платформа

платформа

Запатентована платформа пропонує такі переваги:

  • Наскрізна веб-платформа
  • Бездоганна якість
  • Швидше TAT
  • Безшовна доставка

Готові набори мовлення/аудіо

Набір мовних данихНорма вибіркиТип набору данихЗагальна кількість годин аудіо
+Народна мова афроамериканців8 кГцКоллцентр211
Короткий описДані кол-центру афроамериканської розмови
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка: 612, Чоловік: 1242 та Невідомо: 12
+16 кГцПодкаст154
Короткий описДані афроамериканських медіа
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
АудіоканалMono
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка: 151, Чоловік: 150 та Невідомо: 10
+Африкаанс8 кГцЗагальна розмова368
Короткий описДані про загальну розмову африкаанс
Опис набору данихНезаписана телефонна розмова між двома людьми. Приблизна тривалість аудіо (діапазон) – 15-60 хвилин, мова африкаанс, якою розмовляють в Африці.
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка: 502, Чоловік: 390 та Невідомо: 2
+16 кГцПодкаст658
Короткий описМедіафайли мовою африкаанс
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
АудіоканалMono
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка: 750, Чоловік: 1278 та Невідомо: 52
+Арабська8 кГцЗагальна розмова292
Короткий описДані про загальну розмову арабської мови
Опис набору данихНезаписана телефонна розмова між двома людьми. Приблизна тривалість аудіо (діапазон) – 15-60 хвилин, арабська з країн Перської затоки.
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка: 171, Чоловік: 534 та Невідомо: 1
+48 кГцСценарний монолог1,947
Короткий описАрабський сценарний монолог
Опис набору данихЗаписи окремих висловлювань, які зазвичай тривають від 5 до 30 секунд
АудіоканалMono
Платформа для записуДодаток для мобільних телефонів
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 838 Чоловік 1209 Невідомо 78
+Ассамська (у розробці) Коллцентр60
Короткий описДані кол-центру для ассамської мови (в процесі розробки)
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
Аудіоканал
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Загальна розмова100
Короткий описДані загальної розмови для ассамської мови (в процесі розробки)
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
Аудіоканал
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Подкаст40
Короткий описАссамська (в процесі розробки) аудіодані медіа
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
Аудіоканал
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Бенгальська (у розробці) Коллцентр60
Короткий описДані кол-центру бенгальською мовою (в процесі розробки)
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
Аудіоканал
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Загальна розмова100
Короткий описДані загальної розмови бенгальською (у розробці)
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
Аудіоканал
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Подкаст40
Короткий описБенгальські (в процесі розробки) аудіодані медіа
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
Аудіоканал
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Бостонська англійська8 кГцКоллцентр177
Короткий описДані кол-центру Бостона
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка: 605, Чоловік: 711 та Невідомо: 0
+8 кГцЗагальна розмова32
Короткий описДані загальної розмови в Бостоні
Опис набору данихНезаписана телефонна розмова між двома людьми. Приблизна тривалість аудіо (діапазон) - 15-60 хвилин,
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка: 53, Чоловік: 83 та Невідомо: 0
+16 кГцПодкаст93
Короткий описАудіодані Boston Media
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
АудіоканалMono
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка: 43, Чоловік: 181 та Невідомо: 2
+Канадська французька48 кГцСценарний монолог1,222
Короткий описКанадська французька
Опис набору данихЗаписи окремих висловлювань, які зазвичай тривають від 5 до 30 секунд
АудіоканалMono
Платформа для записуДодаток для мобільних телефонів
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 974 Чоловік 631 Невідомо 1
+Китайська англійська8 кГцКоллцентр169
Короткий описДані китайських кол-центрів
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінки: 1790, Чоловіки: 523 та Невідомо: 13
+16 кГцПодкаст249
Короткий описАудіодані китайських медіа
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
АудіоканалMono
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінки: 126, Чоловіки: 346 та Невідомо: 6
+Китайська спрощена48 кГцСценарний монолог2,762
Короткий описКитайська спрощена
Опис набору данихЗаписи окремих висловлювань, які зазвичай тривають від 5 до 30 секунд
АудіоканалMono
Платформа для записуДодаток для мобільних телефонів
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 1920 Чоловік 1535 Невідомо 270
+Китайський традиційний48 кГцСценарний монолог1,028
Короткий описКитайський традиційний
Опис набору данихЗаписи окремих висловлювань, які зазвичай тривають від 5 до 30 секунд
АудіоканалMono
Платформа для записуДодаток для мобільних телефонів
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 1069 Чоловік 262 Невідомо 3
+Данська8 кГцЗагальна розмова372
Короткий описДані про загальну розмову на датській мові
Опис набору данихНезаписана телефонна розмова між двома людьми. Приблизна тривалість аудіо (діапазон) - 15-60 хвилин,
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінки: 311, Чоловіки: 417, Невідомо: 0
+16 кГцПодкаст664
Короткий описАудіодані Danish Media
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
АудіоканалMono
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінки: 369, Чоловіки: 864, Невідомо: 27
+48 кГцСценарний монолог2,579
Короткий описДатський сценарний монолог
Опис набору данихЗаписи окремих висловлювань, тривалістю від 5 до 30 секунд, данська мова з Данії
АудіоканалMono
Платформа для записуДодаток для мобільних телефонів
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 1551 Чоловік 1233 Невідомо 42
+Англійський глибокий південь8 кГцКоллцентр151
Короткий описДані кол-центру English Deep South
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 221, Чоловік 1004, Невідомо 7
+8 кГцЗагальна розмова56
Короткий описДані загальної розмови англійською мовою з Глибокого Півдня
Опис набору данихНезаписана телефонна розмова між двома людьми. Приблизна тривалість аудіо (діапазон) - 15-60 хвилин,
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 99, Чоловік 31, Невідомо 0
+16 кГцПодкаст266
Короткий описАудіодані англійською мовою Deep South Media
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
АудіоканалMono
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 204, Чоловік 356, Невідомо 21
+Німецька8 кГцКоллцентр64
Короткий описДані німецьких кол-центрів
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
АудіоканалMono
Платформа для записуробочий стіл
WER (%)
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 478 Чоловік 1440 Невідомо 0
+8 кГц IVR200
Короткий описДані німецького IVR
Опис набору данихЛюдина-машина. Тип IVR-процесу, де є запит TTS (наприклад, «Чим я можу вам допомогти»), а потім спонтанна відповідь людини.
АудіоканалMono
Платформа для записуробочий стіл
WER (%)
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 10115 Чоловік 8750 Невідомо 0
+Гуджараті (у розробці) Коллцентр60
Короткий описДані кол-центру гуджаратською мовою (у розробці)
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
Аудіоканал
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Загальна розмова100
Короткий описДані загальної розмови гуджараті (у розробці)
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
Аудіоканал
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Подкаст40
Короткий описГуджараті (в процесі розробки) аудіодані медіа
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
Аудіоканал
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Іврит8 кГцЗагальна розмова399
Короткий описДані про загальну розмову на івриті
Опис набору данихНезаписана телефонна розмова між двома людьми. Орієнтовна тривалість аудіо (діапазон) – 15-60 хвилин, іврит (Ізраїль)
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 414, Чоловік 399, Невідомо 1
+16 кГцПодкаст427
Короткий описАудіодані івритських медіа
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
АудіоканалMono
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 361, Чоловік 513, Невідомо 13
+Хінді16 кГцПодкаст219
Короткий описАудіодані хінді медіа
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
АудіоканалMono
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 83, Чоловік 309, Невідомо 0
+48 кГцСценарний монолог2,867
Короткий описМонолог на хінді
Опис набору данихЗаписи окремих висловлювань, які зазвичай тривають від 5 до 30 секунд
АудіоканалMono
Платформа для записуДодаток для мобільних телефонів
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 1977 Чоловік 1864 Невідомо 147
+Гінгліш8 кГцКоллцентр208
Короткий описДані кол-центру (ХІНГЛІШ)
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 822, Чоловік 1262, Невідомо 0
+16 кГцПодкаст216
Короткий описАудіодані медіа ХІНГЛІШ
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
АудіоканалMono
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 75, Чоловік 380, Невідомо 0
+Іспанська англійська8 кГцКоллцентр212
Короткий описДані латиноамериканських кол-центрів
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 822, Чоловік 1262, Невідомий 0
+16 кГцПодкаст155
Короткий описАудіо для латиноамериканських дзвінків
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
АудіоканалMono
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 140, Чоловік 219, Невідомий 5
+Індонезійська8 кГцЗагальна розмова496
Короткий описДані про загальну розмову на індонезійській мові
Опис набору данихНезаписана телефонна розмова між двома людьми. Приблизна тривалість аудіо (діапазон) – 15-60 хвилин, індонезійська мова
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 524, Чоловік 454, Невідомий 2
+16 кГцПодкаст643
Короткий описАудіодані індонезійських медіа
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
АудіоканалMono
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 746, Чоловік 1507, Невідомий 129
+Ірландська8 кГцЗагальна розмова192
Короткий описДані про загальну розмову ірландської мови
Опис набору данихНезаписана телефонна розмова між двома людьми. Приблизна тривалість аудіо (діапазон) - 15-60 хвилин,
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 213, Чоловік 153, Невідомо 0
+Японська48 кГцСценарний монолог2,335
Короткий описЯпонський сценарний монолог
Опис набору данихЗаписи окремих висловлювань, які зазвичай тривають від 5 до 30 секунд
АудіоканалMono
Платформа для записуДодаток для мобільних телефонів
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 1460 Чоловік 1221 Невідомо 194
+Каннада (у розробці) Коллцентр60
Короткий описДані кол-центру для каннади (в процесі розробки)
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
Аудіоканал
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Загальна розмова100
Короткий описДані загальної розмови про каннаду (в процесі розробки)
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
Аудіоканал
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Подкаст40
Короткий описАудіодані медіа для каннади (в процесі розробки)
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
Аудіоканал
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Корейська8 кГцКоллцентр107
Короткий описДані корейських кол-центрів
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 1086, Чоловік 210, Невідомо 4
+16 кГцПодкаст204
Короткий описАудіодані корейських медіа
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
АудіоканалMono
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 70, Чоловік 303, Невідомо 25
+48 кГцСценарний монолог1,955
Короткий описКорейський сценарний монолог
Опис набору данихЗаписи окремих висловлювань, які зазвичай тривають від 5 до 30 секунд
АудіоканалMono
Платформа для записуДодаток для мобільних телефонів
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 1195 Чоловік 1134 Невідомо 122
+малайський8 кГцЗагальна розмова266
Короткий описДані про загальну розмову з малайської мови
Опис набору данихНезаписана телефонна розмова між двома людьми. Приблизна тривалість аудіо (діапазон) – 15-60 хвилин, малайська мова в Малайзії
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 316, Чоловік 176, Невідомо 0
+16 кГцПодкаст344
Короткий описАудіодані Malay Media
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
АудіоканалMono
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 236, Чоловік 626, Невідомо 47
+Малаялам (у розробці) Коллцентр60
Короткий описДані кол-центру для малаяламської мови (в процесі розробки)
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
Аудіоканал
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Загальна розмова100
Короткий описДані загальної розмови на малаяламській мові (в процесі розробки)
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
Аудіоканал
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Подкаст40
Короткий описАудіодані медіа з малаяламською мовою (в процесі розробки)
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
Аудіоканал
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Маратхі (у розробці) Коллцентр60
Короткий описДані кол-центру для маратхі (в процесі розробки)
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
Аудіоканал
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Загальна розмова100
Короткий описДані загальної розмови на маратхі (у розробці)
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
Аудіоканал
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Подкаст40
Короткий описАудіодані медіа на маратхі (в процесі розробки)
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
Аудіоканал
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Іспанська (Мексика)48 кГцСценарний монолог1,492
Короткий описМексиканський іспанський сценарний монолог
Опис набору данихЗаписи окремих висловлювань, які зазвичай тривають від 5 до 30 секунд
АудіоканалMono
Платформа для записуДодаток для мобільних телефонів
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 1016 Чоловік 1069 Невідомо 95
+Нідерландська48 кГцСценарний монолог1,205
Короткий описГолландський сценарний монолог
Опис набору данихЗаписи окремих висловлювань, які зазвичай тривають від 5 до 30 секунд
АудіоканалMono
Платформа для записуДодаток для мобільних телефонів
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 1285 Чоловік 531 Невідомо 3
+Нью-Йоркська англійська8 кГцКоллцентр103
Короткий описДані кол-центру англійською мовою в Нью-Йорку
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 610, Чоловік 532, Невідомо 0
+8 кГцЗагальна розмова107
Короткий описДані про загальну розмовну мову з англійської мови в Нью-Йорку
Опис набору данихНезаписана телефонна розмова між двома людьми. Приблизна тривалість аудіо (діапазон) - 15-60 хвилин,
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 118, Чоловік 114, Невідомий 0
+16 кГцПодкаст140
Короткий описАудіодані New York English Media
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
АудіоканалMono
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 66, Чоловік 230, Невідомий 11
+Новозеландська англійська 8 кГцЗагальна розмова148
Короткий описДані про загальну розмовну мову з англійської мови Нової Зеландії
Опис набору данихНезаписана телефонна розмова між двома людьми. Приблизна тривалість аудіо (діапазон) - 15-60 хвилин,
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 167, чоловік 121, невідомо 4
+16 кГцПодкаст400
Короткий описАудіо з англійських медіа Нової Зеландії
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
АудіоканалMono
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 367, чоловік 678, невідомо 26
+Орія (у розробці) Коллцентр60
Короткий описДані кол-центру Oriya (в процесі розробки)
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
Аудіоканал
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Загальна розмова100
Короткий описДані загальної розмови в Орії (в процесі розробки)
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
Аудіоканал
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Подкаст40
Короткий описАудіодані медіа Орія (у процесі розробки)
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
Аудіоканал
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Польська16 кГцПодкаст269
Короткий описАудіо польських медіа
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
АудіоканалMono
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 173 Чоловік 354 Невідомо 6
+Польська (Польща)48 кГцСценарний монолог1,482
Короткий описПольська Польща - Сценарійний монолог
Опис набору данихЗаписи окремих висловлювань, які зазвичай тривають від 5 до 30 секунд
АудіоканалMono
Платформа для записуДодаток для мобільних телефонів
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 1324 Чоловік 701 Невідомо 24
+Панджабі (у розробці) Коллцентр60
Короткий описДані кол-центру для панджабі (в процесі розробки)
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
Аудіоканал
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Загальна розмова100
Короткий описДані загальної розмови для панджабі (у розробці)
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
Аудіоканал
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Подкаст40
Короткий описАудіодані медіа для панджабі (в процесі розробки)
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
Аудіоканал
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Російська48 кГцСценарний монолог2,398
Короткий описМонолог за російським сценарієм
Опис набору данихЗаписи окремих висловлювань, які зазвичай тривають від 5 до 30 секунд
АудіоканалMono
Платформа для записуДодаток для мобільних телефонів
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 1689 Чоловік 1937 Невідомо 214
+Шотландський (англійський акцент)8 кГцЗагальна розмова292
Короткий описДані про загальну шотландську розмову
Опис набору данихНезаписана телефонна розмова між двома людьми. Приблизна тривалість аудіо (діапазон) - 15-60 хвилин,
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 285, Чоловік 260, Невідомо 3
+Сінгапурська англійська8 кГцКоллцентр218
Короткий описДані кол-центру Сінгапуру
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 2139, Чоловік 884, Невідомо 21
+16 кГцПодкаст247
Короткий описАудіодані Singapore Media
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
АудіоканалMono
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 160, Чоловік 455, Невідомий 37
+південноафриканська англійська8 кГцКоллцентр261
Короткий описДані південноафриканського кол-центру англійською мовою
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 1274, Чоловік 935, Невідомо 1
+16 кГцПодкаст251
Короткий описАудіодані англійських медіа з Південної Африки
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
АудіоканалMono
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 235, Чоловік 432, Невідомий 36
+Суахілі8 кГцКоллцентр230
Короткий описДані кол-центру мовою суахілі
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 611, Чоловік 833, Невідомий 0
+16 кГцПодкаст265
Короткий описАудіодані суахілі медіа
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
АудіоканалMono
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 118, Чоловік 493, Невідомий 25
+Шведська8 кГцКоллцентр250
Короткий описДані шведського кол-центру
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 1581, чоловік 727, невідомо 2
+16 кГцПодкаст278
Короткий описАудіодані шведських медіа
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
АудіоканалMono
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 195, чоловік 500, невідомо 21
+Тамільська (у розробці) Коллцентр60
Короткий описДані кол-центру тамільською мовою (у розробці)
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
Аудіоканал
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Загальна розмова100
Короткий описДані загальної розмови тамільською мовою (у розробці)
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
Аудіоканал
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Подкаст40
Короткий описАудіодані медіа тамільською мовою (у процесі розробки)
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
Аудіоканал
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Телугу8 кГцЗагальна розмова553
Короткий описДані загальної розмови на телугу
Опис набору данихНезаписана телефонна розмова між двома людьми. Приблизна тривалість аудіо (діапазон) - 15-60 хвилин,
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 574, Чоловік 564, Невідомо 0
+16 кГцПодкаст648
Короткий описАудіодані Telugu Media
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
АудіоканалMono
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 207, Чоловік 963, Невідомий 2
+Телугу (у розробці) Коллцентр30
Короткий описДані кол-центру для телугу (в процесі розробки)
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
Аудіоканал
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Загальна розмова50
Короткий описДані загальної розмови телугу (у процесі розробки)
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
Аудіоканал
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Подкаст20
Короткий описТелугу (в процесі розробки) аудіодані медіа
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
Аудіоканал
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерів
+Тайська8 кГцЗагальна розмова183
Короткий описЗагальна розмова тайської мови
Опис набору данихНезаписана телефонна розмова між двома людьми. Приблизна тривалість аудіо (діапазон) – 15-60 хвилин. Неформальний жартівливий прийом, що використовується між друзями.
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 338, Чоловік 96, Невідомий 8
+16 кГцПодкаст173
Короткий описАудіо тайських медіа
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
АудіоканалMono
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 143, Чоловік 502, Невідомий 26
+Турецька індичка48 кГцСценарний монолог2,027
Короткий описТурецька індичка
Опис набору данихЗаписи окремих висловлювань, які зазвичай тривають від 5 до 30 секунд
АудіоканалMono
Платформа для записуДодаток для мобільних телефонів
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 1561 Чоловік 1241 Невідомо 31
+В'єтнамська8 кГцЗагальна розмова295
Короткий описДані про загальну розмову з в'єтнамської мови
Опис набору данихНепідготовлена, штучна телефонна розмова між «агентом» та «клієнтом». Приблизна тривалість аудіо (діапазон) 5-15 хвилин, Північний (наприклад, Ханой), Центральний та Південний (наприклад, Хошимін) регіони.
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 400, чоловік 380, невідомі 2
+16 кГцПодкаст257
Короткий описАудіодані в'єтнамських медіа
Опис набору данихЛіцензовані аудіо/відео файли у вільному доступі, такі як інтерв'ю, подкасти тощо - від 1 до 5 осіб. Приблизна тривалість аудіо (діапазон) 15-60 хвилин
АудіоканалMono
Платформа для записуВеб-пошук
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 249, чоловік 200, невідомі 45
+Валлійська (англійський акцент)8 кГцЗагальна розмова278
Короткий описДані про валлійську загальну розмову
Опис набору данихНезаписана, штучна телефонна розмова між «агентом» та «клієнтом», приблизна тривалість аудіо (діапазон) 5-15 хвилин,
АудіоканалПодвійний
Платформа для записуробочий стіл
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівЖінка 270, Чоловік 324, Невідомий 0
+Великобританія англійська16 кГцПрокидай словоДоповідачі 200
Короткий описWake Word UK English
Опис набору данихзбір даних за ключовими фразами
  • 200 колонки
  • 4 унікальні ключові фрази на мовця
  • 25-30 повторюваних записів ключових фраз на унікальну ключову фразу
  • 25-30 аудіофайлів на унікальну ключову фразу
  • Всього 120 записаних висловлювань на мовця
Аудіоканал1 канал
Платформа для записуДодаток для мобільних телефонів
WER (%)5.0
Аудіо формати. Wav
Формат транскрипції.json
Використовуйте CaseASR, віртуальний помічник, чат-бот, розмовний AI, аналітика мовлення, TTS, мовне моделювання
Кількість спікерівСтать: 50% чоловіків, 50% жінок, +/- 10%.

Пропоновані послуги

Експертний збір текстових даних не є повноцінним інструментом для комплексних налаштувань AI. У Shaip ви навіть можете розглянути такі послуги, щоб зробити моделі більш поширеними, ніж зазвичай:

Збір текстових даних

Послуги збору текстових даних

Справжня цінність служб збору когнітивних даних Shaip полягає в тому, що вони дають організаціям ключ для розблокування важливої ​​інформації, знайденої в неструктурованих даних.

Збір даних зображення

Послуги зі збору даних зображень

Переконайтеся, що ваша модель комп’ютерного зору точно ідентифікує кожне зображення, щоб легко тренувати моделі ШІ наступного покоління майбутнього

Збір відеоданих

Послуги збору відеоданих

Тепер зосередьтеся на комп’ютерному бачення разом із НЛП, щоб навчити своїх моделей досконало розпізнавати об’єкти, індивідуумів, стримуючих факторів та інших візуальних елементів.

Рекомендовані клієнти

Розширення можливостей команд для створення провідних у світі продуктів штучного інтелекту.

Shaip, зв'яжіться з нами

Хочете створити власний набір аудіоданих?

Зв’яжіться з нашим власним експертом зі збору мовленнєвих даних, щоб створити аудіосховище, яке найкраще відповідає вашим вимогам

  • Це поле для цілей перевірки і повинні бути залишені без змін.
  • Реєструючись, я погоджуюся з Шайпом Політика конфіденційності та Умови надання послуг і надати мою згоду на отримання маркетингової інформації B2B від Shaip.

Збір мовних даних для моделі ML стосується процесу збору аудіозаписів розмовної мови. Ця колекція допомагає навчати та вдосконалювати алгоритми машинного навчання, зокрема ті, що зосереджені на розумінні та обробці людських голосів.

Прагнучи зібрати аудіодані для автоматичного розпізнавання мовлення (ASR), вам слід почати з визначення конкретних потреб вашого проекту, зокрема бажаної мови, акценту та типу мовлення. Після встановлення цих параметрів переконайтеся, що ви отримали всі необхідні дозволи для поваги конфіденційності користувача. Потім скористайтеся відповідними записуючими пристроями або програмним забезпеченням для запису чітких зразків звуку. Кожен запис має бути ретельно анотований його транскрипцією або іншими відповідними метаданими та систематично зберігатися для легкого доступу.

Набір мовленнєвих даних у машинному навчанні є ключовим для навчання, тестування та перевірки моделей, призначених для розпізнавання, транскрипції чи інтерпретації усної мови. Такі набори даних прокладають шлях для безлічі додатків, від голосових помічників і служб транскрипції до голосової біометрії.

Для збору точних даних з різних мов і акцентів життєво важливою є співпраця з носіями мови бажаного лінгвістичного походження. Прагніть до різноманітної та репрезентативної вибірки, щоб охопити широкий спектр демографічних нюансів. Використовуйте стандартизоване обладнання для запису в єдиному середовищі, щоб забезпечити узгодженість звуку. І, що важливо, анотуйте кожен фрагмент даних докладними транскрипціями та метаданими, вказуючи на конкретну мову та акцент.