Компанія ElevenLabs, що спеціалізується на технологіях голосового штучного інтелекту, анонсувала запуск автономного мобільного додатка для користувачів iOS та Android, що дозволяє створювати голосові кліпи з тексту.
Раніше для генерації аудіо з голосових бібліотек ElevenLabs користувачі змушені були використовувати веб-додаток. Тепер же функціонал доступний і в мобільному додатку, що дозволяє генерувати кліпи в будь-який час.
Для використання програми потрібно просто ввести або вставити текст, обрати відповідний голос, і згенерувати аудіофайл. Безкоштовний тариф надає доступ до приблизно 10 хвилин генерації звуку. Користувачі можуть обирати різні моделі, щоб знайти оптимальне співвідношення між вартістю та якістю, а також мають спільний кредитний ліміт між веб-і мобільним додатком.
Також ElevenLabs повідомила, що додаток має доступ до нових текстово-голосових моделей v3 alpha, які дозволяють користувачам контролювати вирази за допомогою тегів.
Джек МакДермотт, керівник мобільного зростання компанії, зазначив, що багато творців контенту вже користуються веб-браузерами на мобільних пристроях для створення голосових зразків, щоб використовувати їх у відео з іншими додатками, такими як CapCut, Instagram або InShot. Зважаючи на цей попит, компанія вирішила створити нативний досвід.
“Протягом минулого року ми спостерігали вибух творчості з боку нашої спільноти — творців контенту, маркетологів, педагогів, голосових артистів та професіоналів, які використовують ElevenLabs для реалізації своїх проектів. Багато з них отримували доступ до ElevenLabs через мобільні веб-браузери і запитували про швидший, інтуїтивніший та потужніший досвід, розроблений спеціально для мобільних”, — написав він у листі.
Компанія також планує конкурувати з іншими інструментами для клонування та генерації голосу, такими як Speechify та Captions.
Це вже другий споживчий додаток ElevenLabs після запуску програми Reader минулого року, яка дозволяла користувачам слухати статті, блоги, PDF-файли та електронні книги на ходу. На початку цього року компанія також відкрила доступ до програми Reader для видавців для розповсюдження аудіокниг.
У майбутньому компанія планує впровадження нових функцій, таких як перетворення мови в текст та інструмент для розмовного штучного інтелекту, а також додати функції на базі MCP, такі як 11.ai, до додатка.