Что умеет нейросеть для музыки
Музыкальный генератор создаёт трек целиком: мелодию, инструменты, структуру и вокал. Можно принести готовый текст песни, а можно описать только сюжет — тогда слова модель тоже напишет сама. Обычно первые варианты появляются через несколько минут.
Но кнопка «сделать красиво» пока не существует. Если написать только «песня про любовь», нейросети придётся самой угадать жанр, настроение, голос и историю. Скорее всего, получится аккуратно, но безлико. И наоборот: несколько живых деталей часто меняют результат сильнее, чем длинный перечень музыкальных терминов.
Зато с задачами вроде «песня на день рождения коллеге», «спокойный лоу-фай под работу» или «джингл для рубрики в блоге» такие сервисы справляются за то время, которое раньше уходило на поиск исполнителя.
Как из описания получается трек
Для пользователя процесс выглядит просто. Вы описываете будущую песню, а нейросеть превращает слова в музыкальные решения: выбирает темп, инструменты, характер голоса и форму трека. Если своего текста нет, она придумывает куплеты и припев, а затем собирает всё в одну аудиозапись.
Не выбирайте по первым пяти секундам. У двух версий могут быть похожие вступления, но совершенно разные припевы и вокальная подача. Иногда более спокойный вариант раскрывается только к середине.
Из чего собрать запрос
Хорошее описание отвечает на четыре вопроса: какой нужен жанр, какое настроение, кто поёт и о чём песня. Этого уже достаточно, чтобы нейросеть не гадала за вас.
«Красивая песня про любовь»
Под это описание подходит половина всей музыки, записанной человечеством, поэтому модель выдаст самое усреднённое, что знает.
«Медленная поп-баллада с фортепиано и струнными, тёплое ностальгическое настроение, мягкий женский вокал. Про то, как двое случайно встретились в поезде и проговорили всю ночь до утра.»
Второй запрос лучше не потому, что он длиннее. В нём уже приняты важные решения: «медленная» задаёт темп, «фортепиано и струнные» — звучание, а встреча в поезде даёт конкретную историю вместо дежурных строк о чувствах.
Что стоит указывать
- Жанр — поп, рок, шансон, лоу-фай, фонк, оркестр, эмбиент. Можно назвать сцену или эпоху: «звук восьмидесятых», «японский сити-поп».
- Настроение — торжественное, нежное, злое, ироничное, ностальгическое.
- Голос — мужской, женский, детский, дуэт. Или инструментал, если слова не нужны.
- Темп и инструменты — «медленная, только гитара и голос» звучит совсем не так, как «быстрая, с барабанами и синтезатором».
- Сюжет или повод — самая полезная часть, если песня для конкретного человека. Имена, детали, история.
Что мешает
Главная помеха — противоречивый список пожеланий: «нежный, агрессивный, танцевальный, акустический рок с оркестром и рэпом». Модель постарается учесть всё и потеряет главную идею. Выберите одно направление. И не маскируйте простую мысль профессиональными словами: фраза «тихо, медленно, только гитара и голос» часто точнее случайного набора терминов.
Свой текст или текст модели
Есть два режима работы, и выбор между ними определяет почти всё.
Когда текст пишет модель, вы отдаёте ей повод и детали, а слова она сочиняет сама. Это быстрее и обычно достаточно: для поздравления, фона под ролик или песни-шутки в чат результат выходит складным. Наш сервис работает именно так, поэтому от вас нужны ответы про повод и человека, а не готовые рифмы.
Когда текст ваш, вы получаете контроль над каждой строчкой, но вместе с ним и работу: слова должны ложиться в размер, иначе модель начнёт растягивать или комкать фразы. Если у вас уже есть стихи и они дороги вам как есть, этот путь единственный.
Если вышло не то
Не переписывайте описание целиком после первой неудачи. Сначала назовите, что именно мешает: слишком бодрый темп, неподходящий голос, общий текст или лишние инструменты. Затем измените только этот пункт и сравните версии.
| Что не так | Что поменять |
|---|---|
| Слишком бодро для тихого повода | Понизить темп и убрать барабаны из описания: «медленная, только фортепиано и голос» |
| Голос не тот | Указать пол и характер голоса прямо: «низкий мужской», «мягкий женский» |
| Текст общий, без вашей истории | Добавить конкретику: имя, город, привычку, фразу, которую человек повторяет |
| Звучит как реклама торгового центра | Убрать слова вроде «вдохновляющая» и «энергичная», назвать конкретный жанр |
| Всё вроде правильно, но не цепляет | Просто запустить ещё раз: каждая генерация даёт новую запись |
Про русский вокал стоит сказать отдельно. Модели поют по-русски, и в целом неплохо, но ударения в редких словах и именах иногда встают не туда. Дослушайте оба варианта целиком, прежде чем отправлять песню человеку, ради которого всё затевалось.
Где генерировать на русском
Сильные модели для музыки сделаны за рубежом, и главная сложность у российских пользователей не в доступе, а в оплате: сайт открывается, а подписку картой российского банка не оплатить. Мы разобрали это подробно в отдельной статье про Suno и оплату из России, включая обходные способы и их минусы.
Коротко про варианты. Российские сервисы вроде GigaChat умеют генерировать музыку и оплачиваются рублями. Агрегаторы дают доступ к зарубежным моделям через свой интерфейс по помесячной подписке. Телеграм-боты берут оплату картой МИР или через СБП, но библиотека треков остаётся в переписке. Novasound даёт доступ к ИИ-генерации музыки на русском: вы описываете песню своими словами, платите за песни вместо месяца подписки, и ни VPN, ни зарубежная карта для этого не нужны.
Первая песня у нас бесплатная и не требует регистрации, после регистрации начисляем ещё пять. Дальше пакеты от 149 ₽ за десять песен, причём онлайн-оплату мы пока подключаем, поэтому кредиты начисляет администратор по запросу.