Збір даних для індивідуального та брендованого Wake WordTraining

Створюйте голосові програми з постійним прослуховуванням та даними навчання за допомогою власних слів для пробудження. Вища точність виявлення, менше помилкових активацій.

Збір даних для навчання слову Wake

Створення шлюзу між вами та вашими голосовими продуктами за допомогою точних і налаштованих слів пробудження та покращення можливостей виявлення слів голосових помічників, щоб допомогти вам залишатися попереду конкурентів.

Голосові помічники кардинально змінили спосіб взаємодії клієнтів зі своїми пристроями. Вони полегшили користувачам пошук продуктів і послуг – швидко та ефективно. Однак чи слухає голосова програма? Щоб перевести ці програми в активний режим, їх потрібно розбудити та перейти від пасивного до активного прослуховування за допомогою WAKE WORDS. "Alexa" і "Hey Siri" є двома найпопулярнішими словами для пробудження в світі.

Statista

Прогнозується, що до 2024 року кількість цифрових голосових помічників досягне 8.4 мільярда одиниць – більше, ніж населення світу.

Ринки та ринки

Прогнозується, що обсяг ринку додатків для голосових асистентів зросте з 2.8 мільярда доларів у 2021 році до 11.2 мільярда доларів у 2026 році зі середньорічним темпом зростання 32.4%.

Що таке слово пробудження та його приклади 

Слово пробудження – це певне слово або фраза, така як «Hey Siri», «Okay Google» та «Alexa», призначена для активації голосового пристрою для реагування на його вимову. Однак, слово пробудження, яке постійно слухає та локально інтегроване з пристроєм, значно скорочує час відгуку та підвищує точність ідентифікації та обробки слова пробудження навіть без підключення до Інтернету. Shaip збирає дані для навчання слів пробудження більш ніж 100 мовами, різними акцентами, віковими групами та реальними шумовими середовищами, щоб максимізувати точність виявлення та мінімізувати помилкові активації. Вони також відомі як:

  • Тригерні слова
  • Слова активації
  • Гарячі слова
  • Фрази пробудження
  • Фрази активації
  • Команди пробудження
  • Команди активації
  • Голосові команди
  • Збірник висловів
  • Колекція ключових слів
  • Колекція ключових фраз
  • & більше….

Як Шайп може допомогти?

Завдяки програмі Shaip, яка пропонує постійне навчання слову пробудження, ваші моделі голосових помічників завжди налаштовані на прослуховування слова пробудження, але без фактичного запису чи передачі даних у хмару. Партнерство з Shaip дає вам перевагу роботи з експертами. Завдяки нашому великому досвіду використання технологій AI та ML у розробці навчання голосових помічників ми допомагаємо вам усунути ризики конфіденційності, покращити взаємодію з користувачем, зменшити витрати на розробку та підвищити масштабованість.

Збір даних про висловлювання

Ключові можливості

Спеціальні та брендовані слова для пробудження

Спеціальні та брендовані слова для пробудження

Shaip створює навчальні дані для повністю брендованих активаційних слів, щоб клієнти вимовляли назву вашого бренду, а не шаблонний помічник. Кожен набір даних налаштовано на вашу точну активаційну фразу, що посилює запам'ятовуваність бренду з кожною взаємодією та зберігає голосовий досвід у межах вашої екосистеми.

Збір даних на пристрої з урахуванням конфіденційності

Збір даних на пристрої з урахуванням конфіденційності

Shaip підтримує моделі слів-активаторів із постійним прослуховуванням, які працюють на пристрої без запису чи передачі аудіо в хмару. Дані навчання слів-активаторів на пристрої зменшують затримку, знижують ризик для конфіденційності та забезпечують надійну роботу виявлення навіть без підключення до Інтернету.

Багатомовність та різноманітність акцентів

Shaip збирає висловлювання слів-пробуджень більш ніж 100 мовами та регіональними акцентами — шотландською, канадською, австралійською, індійською англійською та іншими — тому точність виявлення зберігається на всіх глобальних базах користувачів, а не погіршується для неносія мови.

Надійність до шуму та дальнього поля

Надійність до шуму та дальнього поля

Shaip фіксує дані про пробуджені слова в тихих, галасливих умовах, в автомобілі, на вулиці та у віддалених умовах. Навчання на реальних акустичних варіаціях зменшує кількість помилкових відхилень, коли користувачі говорять на відстані або на фоновому шумі.

Виявлення фраз та вбудованих фрагментів

Окрім розпізнавання ключових слів, Shaip надає дані про розпізнавання висловлювань та фраз, щоб пристрої обробляли довші команди природною мовою з низькою затримкою. Вбудовані дані розпізнавання ключових слів підтримують обробку в браузері та на чіпі для високої точності та конфіденційності.

Цінні поради щодо того, як вибрати правильні слова для пробудження / слова, що викликають виклик

Вибирайте слова з різними звуками

Різні фонеми зазвичай створюють чіткіший підпис і забезпечують кращу точність результатів. Тому виберіть у своїх даних фрази, які створюють різні звуки.

Використовуйте відповідний префікс зі своїми словами

Зробіть слова пробудження ефективнішими, додавши до них такі префікси, як «Привіт», «Привіт», «Привіт» або «ОК». Це збереже однозначне слово пробудження та забезпечить відсутність випадкового збігу під час використання тригерного слова в звичайному мовленні.

Використовуйте фонеми, щоб побудувати свої тригерні слова

Зробіть свої слова пробудження комбінацією щонайменше шести фонем, які легко розрізнити машиною та легко вимовити людям. Наприклад, «Alexa» має шість феноменів, а «Ok Google» — вісім феноменів.

Уникайте використання одного слова

Не робіть помилки, використовуючи одне слово як слово для пробудження. Слова пробудження мають бути достатньо довгими, щоб їх можна було розрізняти.

Прості й унікальні слова

Переконайтеся, що тригерні слова, які ви створюєте, мають бути простими й унікальними, щоб їх можна було легко запам’ятати.

Уникайте довгих фраз

Довші фрази пробудження, що складаються з кількох слів, важко вимовляти, і це надто ускладнює процес.

Обмеження навчальних даних Wake Word

Плутанина через використання кількох висловлювань

Модель пробуджуючого слова зазвичай навчена розпізнавати ні. різних висловлювань, щоб він міг реагувати на різні заклики. Однак наявність занадто великої кількості чітких слів пробудження може просто активувати мовний конвеєр, не знаючи, яку фразу вимовив користувач.

Менш точні результати через зовнішнє оточення

Такі фактори, як шум, відстань і варіації в акцентах і мові, ускладнюють точне виявлення гарячих слів для вашої моделі AI.

Створення точних слів для вашого бренду

поїзд
поїзд

Наш досвід у голосових технологіях допомагає нам швидко розробляти індивідуальні слова для пробудження, які завжди прослуховуються, і фірмові фрази для пробудження. Завдяки розпізнаванню голосу в поєднанні з розумінням обробки природної мови алгоритми ML допомагають транскрибувати мовлення та ефективно виконувати голосові команди.

розвивати
розвивати

Ми зосереджуємось на швидкому розвитку прототипів слів для пробудження, щоб забезпечити персоналізацію фірмового слова. Прототип виступає як доказ концепції та допомагає в точному навчанні, швидшому виході на ринок, прискореному тестуванні та усуненні ризиків.

Рости
Рости

Насолоджуйтеся безперервним зростанням і безперешкодним залученням клієнтів завдяки унікальному голосовому помічнику. Ми надаємо можливості багатомовного розпізнавання мовлення, щоб програма могла точно розпізнавати слова та фрази навіть у шумному середовищі.

Розуміння концепції різноманітності даних

Що таке різноманітність даних?

Це спосіб збору важливих даних користувача, таких як його особистість, країна походження, вік, стать, мова, акценти тощо. Різноманітність даних використовується для вдосконалення орієнтованих на користувача алгоритмів для досягнення більш точних результатів.

Дані зазвичай мають тенденцію генерувати вбудовані упередження. Тому, коли ми збираємо дані з різних джерел, упередженість результатів значно зменшується.

Ось декілька параметрів різноманітності даних, на які Шайп звертає увагу під час створення слів пробудження та інших розмовних команд.

Різноманітність даних
Раса та етнічність Індуїсти, мусульмани, християни, африкаанс, європейці
Рівень освіти Бакалаврат, магістратура, докторант, магістр
Країна Китай, Японія, Індія, Корея, Дубай, Нігерія, США, Канада
секс Чоловіча Жіноча
вік Менше 10 років, 10-15, 15-25, 25-45, 45 років і старше
Language Англійська, японська, турецька, китайська, тайська, хінді
Навколишнє середовище Тиха, Гучна, Фонова музика, Фоновий звук/мовлення, У приміщенні, На вулиці, Театр, Стадіон, Кафетерій, В автомобілі, Офіс, Торговий центр, Домашній шум, Сходи, Вулиця/Дорога, Узбережжя (вітряно)
Акценти (англійська) Шотландська англійська, валлійська англійська, гіберно-англійська, канадська англійська, австралійська англійська, новозеландська англійська
Стиль мовлення Швидка/Нормальна/Повільна швидкість, Висока/Нормальна/Тиха гучність, Формальна/Невимушена
Позиції пристрою Портативний, настільний

Галузі та варіанти використання

Розумний дім / електроніка

Дані пробудження для динаміків, телевізорів та приладів, які мають активуватися миттєво та відключати фонові шуми.

Автомобільний та внутрішній голос

Набори даних про сигнали пробудження далекого радіуса дії, стійкі до шуму, для асистентів у салоні з функцією hands-free.

Носимі та чутні пристрої

Дані пробудження з низьким навантаженням для постійно ввімкнених пристроїв з обмеженим зарядом батареї.

Розмовний ШІ

Дані про слова та висловлювання, що активуються, для локалізації помічників різними мовами та діалектами.

Охорона здоров'я та медичні прилади

Дані пробудження на пристрої, що забезпечують конфіденційність насамперед, для клінічних налаштувань та налаштувань пацієнта без використання рук.

Робототехніка та втілений штучний інтелект

Мультимодальні слова та дані команд для роботів, які реагують у режимі реального часу без хмари.

Як це працює

1. Дайте визначення своєму слову/вислову, що використовується для пробудження

Shaip співпрацює з вами, щоб вибрати фонетично відмінне, узгоджене з брендом слово для пробудження та визначити правила колекціонування.

2. Зберіть різноманітні висловлювання

Глобальна робоча сила Shaip записує слово «wake» на різних мовах, з різними акцентами, віковими групами, пристроями та в різних шумових середовищах.

3. Позначте та перевірте якість набору даних

Кожне висловлювання транскрибується, маркується та перевіряється на відповідність вашим критеріям прийнятності.

4. Надайте дані, готові для навчання

Shaip надає структуровані, контрольовані політиками дані для навчання слів пробудження, відформатовані для вашого модельного конвеєра.

Чому Шайп

Щоб ефективно розгорнути вашу ініціативу AI, вам знадобляться великі обсяги спеціалізованих наборів навчальних даних. Shaip — одна з небагатьох компаній на ринку, яка забезпечує надійні навчальні дані світового класу в масштабі, що відповідає нормативним вимогам / вимогам GDPR.

Можливості збору даних

Створюйте, керуйте та збирайте спеціально створені набори даних (текст, мовлення, зображення, відео) з понад 100 країн по всьому світу на основі спеціальних інструкцій.

Гнучка робоча сила

Скористайтеся нашою глобальною робочою силою з понад 30,000 досвідчених і акредитованих співробітників. Гнучкість призначення завдань і моніторинг потенціалу, ефективності та прогресу в реальному часі.

Якість

Наша запатентована платформа та кваліфікована робоча сила використовують кілька методів контролю якості, щоб відповідати або перевищувати стандарти якості, встановлені для збору наборів навчальних даних AI.

Різноманітний, точний і швидкий

Наш процес спрощує процес збору за допомогою легшого розподілу завдань, керування та збирання даних безпосередньо з програми та веб-інтерфейсу.

Безпека даних

Зберігайте повну конфіденційність даних, роблячи конфіденційність нашим пріоритетом. Ми гарантуємо, що формати даних контролюються політикою та зберігаються.

Специфіка домену

Кураторські дані для певної області, зібрані з галузевих джерел на основі вказівок щодо збору даних клієнтів.

Рекомендовані клієнти

Розширення можливостей команд для створення провідних у світі продуктів штучного інтелекту.

Google Microsoft Веб-сервіси Amazon

Використання штучного інтелекту для покращення ефективності бізнесу завдяки клієнтському досвіду

Слово пробудження — це певне слово або фраза, така як «Alexa», «Okay Google» або власна брендована фраза, яка активує пристрій із підтримкою голосового керування та перемикає його з пасивного на активне прослуховування. Пристрій постійно локально прослуховує слово пробудження та починає обробку запиту лише після його виявлення.

Дані навчання слів у стані спокою – це позначений набір розмовних записів, що використовуються для навчання моделі розпізнавати свою активаційну фразу. Ефективні дані навчання слів у стані спокою охоплюють багатьох мовців, акценти, вік, пристрої та шумові умови, тому модель надійно спрацьовує, відкидаючи мовлення, схоже за звучанням.

Активне слово працює за принципом запуску невеликої моделі виявлення, яка постійно прослуховує звук і сканує вхідний аудіосигнал на наявність цільової фрази. Коли модель достатньо впевнено відповідає активному слову, пристрій активується та починає обробляти запит користувача за допомогою розпізнавання мовлення та обробки природної мови.

Сильне спеціальне слово для пробудження використовує різноманітні фонеми, містить щонайменше три-чотири склади та уникає поширених повсякденних слів, щоб зменшити кількість помилкових активацій. Додавання префікса, такого як «Hey» або «OK», покращує розрізняльність. Shaip допомагає вибирати та перевіряти слова для пробудження під час налаштування проєкту.

Так. Виявлення слів пробудження на пристрої запускає модель активації локально, тому аудіо не записується та не надсилається в хмару. Це зменшує затримку, захищає конфіденційність і забезпечує роботу виявлення в автономному режимі. Shaip збирає навчальні дані, спеціально адаптовані для розгортання на пристрої та вбудованих систем.

Shaip збирає дані для навчання розпізнаванню слів на основі пробудження більш ніж 100 мовами та з широким спектром регіональних акцентів, отримані від фахівців з понад 100 країн світу. Така широта охоплення зменшує розриви в точності для неносіями мови та підтримує глобальні запуски продуктів.

Shaip застосовує кілька етапів контролю якості — перевірку транскрипції, критерії прийняття та моніторинг робочої сили — щоб набори даних відповідали цільовій точності перед доставкою. Різноманітні, високоякісні дані зменшують як рівень помилкового прийняття, так і рівень помилкового відхилення в розгорнутій моделі.

Активне слово активує пристрій; висловлювання – це усний запит, який слідує за ним. Розпізнавання активних слів – це вузьке постійне завдання, тоді як розуміння висловлювання включає інтерпретацію різноманітних фраз природної мови. Shaip надає навчальні дані як для розпізнавання активних слів, так і для збору висловлювань.

Висловлювання — це фраза, яку користувач вимовляє, щоб зробити запит до програмного забезпечення для голосового керування. Програмне забезпечення визначає намір користувача з висловлювання та реагує відповідно. На відміну від повного речення, висловлювання — це одиниця мовлення, яка може не передавати повної думки та часто містить паузи. Приклади: «Покажіть мені останній фільм — той, що вийшов минулого тижня» або «Чи відкритий зараз магазин на 22-й вулиці?»

Ім’я виклику – це ключове слово, яке використовується для запуску певної «навички» в голосовому програмному забезпеченні. Воно може містити імена людей або місць і поєднуватися з дією, командою або питанням. Кожна власна навичка потребує імені виклику, щоб її запустити.

Слова для пробудження також називаються тригерними словами, гарячими словами, словами активації, словами заклику, фразами для пробудження та висловлюваннями.

Alexa використовує кілька вбудованих мікрофонів для виявлення свого сигналу пробудження, одночасно фільтруючи фоновий шум. Щоб запобігти хибним спрацьовуванням та хибним негативним результатам, вона починає активне прослуховування лише після виявлення «Alexa».