Флоктор

Аудио

Генерация музыки нейросетью по описанию или по своим словам, озвучка текста голосом и расшифровка аудиозаписи в текст.

В разделе «Аудио» решаются три разные задачи. Какая из них перед вами, определяет выбранная модель.

Как сгенерировать музыку

Музыкальные модели работают в двух режимах.

По описанию. Вы описываете, каким должен быть трек: настроение, жанр, инструменты, о чём он. Слова и стиль модель придумывает сама.

По своим словам. Включите режим лирики, и текст песни напишете вы. Стиль при этом задаётся отдельным полем.

Второй режим нужен, когда слова важнее звучания: своё стихотворение, поздравление, готовый текст. Первый — когда нужен трек «в таком-то духе», а какой именно, вы решите, услышав.

Как озвучить текст

Модели «текст → речь» читают ваш текст голосом. Голос выбирается из списка: в нём есть поиск и кнопка прослушивания, поэтому перебирать вслепую не придётся.

Обратите внимание на язык. У большинства голосов он задаётся отдельным полем, и от него зависит произношение.

Как расшифровать запись в текст

Модели «аудио → текст» делают обратное: принимают запись и возвращают то, что в ней сказано. Файл прикладывается к запросу как вложение.

У части моделей есть отдельный переключатель, который просит вернуть словесную часть записи отдельным текстом. Он полезен, когда в файле не только речь.

Какие есть настройки

Как и в других разделах, набор полей зависит от модели. Поле, выключенное выбранным режимом, так и подписано: Флоктор не даст отправить запрос, который заведомо не имеет смысла.

Сколько стоит и где потом искать файл

Цена видна на кнопке запуска до нажатия. Готовый файл остаётся на экране, попадает в «Историю» и скачивается оттуда.

На этой странице