Назад
Suno представила нову функцію Speech, яка об'єднує голос і музику в одному треку
SiTech AI Team2 хв читання

Suno представила нову функцію Speech, яка об'єднує голос і музику в одному треку

Suno випустила нову функцію Speech, яка створює мовлення на основі сценарію чи текстового опису та об'єднує голос із фоновою музикою в одному аудіотреку. Функція доступна в публічній беті.

Suno, платформа для створення музики на базі AI, представила нову функцію Speech, яка генерує мовлення на основі сценарію чи текстового опису. Функція доступна в режимі публічної бети на вебсайті компанії та в мобільних додатках і створює фонову музику разом із голосом.

Голос і музика в одному треку

Suno описує нову функцію так: „Це перша аудіомодель, яка об'єднує голос і музику в єдиному треку". Керівник продукту компанії Jack Brody заявив, що музика завжди залишатиметься в серці Suno та всього, що компанія створює, хоча її бачення охоплює й інші форми людського самовираження.

Фонова музика не обов'язкова: її можна вимкнути перемикачем і отримати лише чисте мовлення. За поясненням Suno, музика підбирається під конкретні випадки, наприклад, тихий фон для лекцій або енергійний супровід для драматичних читань і мовних виступів.

Як працює Speech

Щоб скористатися функцією, відкрийте вкладку Create і виберіть параметр Speech. Існує два режими: простий, який створює голос на основі введеного опису (наприклад, „Капітан піратів звертається до команди"), та розширений, який використовує готовий сценарій, якщо ви точно знаєте, що має бути сказано. У розширених параметрах можна налаштувати стать голосу, стиль мовлення та різноманітність кожної генерації. Одна генерація триває максимум близько 8 хвилин.

Конкурентний ринок та обмеження бети

AI-мовлення — це не новина: Google DeepMind вже десять років досліджує синтез мовлення на основі глибокого навчання, Adobe має інструмент для перетворення тексту на мову, а ElevenLabs з 2023 року є однією з найвідоміших платформ у цьому напрямку. Цей крок вказує на те, що Suno шукає нові напрямки за межами генерації музики: генератор музики компанії супроводжувався численними судовими спорами.

Компанія визнає, що функція ще не досконала. „Бета — це справді бета", — сказав Brody і додав, що іноді британський акцент може зайти в Австралію і повернутися назад, а драматичні паузи можуть бути надто драматичними. За його словами, користувачі майже напевно знайдуть застосування цієї функції, які компанія не передбачила. Suno заявляє, що вдосконалить Speech на основі відгуків користувачів.

SSiTech

SiTech — веброзробка з підтримкою AI

Створюємо швидкі та сучасні сайти й інтегруємо AI у бізнес-процеси. Маєте проєкт чи запитання? Із задоволенням допоможемо.