Перейти к содержимому
Опубликовано

Теперь звук дождя, скрип двери и короткий джингл можно не искать на стоках, а просто описать словами.

Автор
  • Имя
    Кибермаркетинг| AI+ опыт = деньги
    Telegram

Кратко

Теперь звук дождя, скрип двери и короткий джингл можно не искать на стоках, а просто описать словами.OpenMOSS выпустили MOSS SoundEffect v2.0. Это...

Теперь звук дождя, скрип двери и короткий джингл можно не искать на стоках, а просто описать словами.

OpenMOSS выпустили MOSS SoundEffect v2.0. Это открытая модель, которая генерирует до 30 секунд аудио по текстовому запросу. Поддерживает звуки природы, города, животных, действия людей и короткие музыкальные фрагменты. Аудио создаётся в качестве 48 кГц, запросы принимаются на английском и китайском языках.

Для игр, рекламы, подкастов и роликов инструмент полезный. Вместо часа на поиски подходящего звука можно написать: «тяжёлая металлическая дверь медленно открывается в пустом подвале» и получить основу для монтажа.

Сильные стороны

🖊 Бесплатные открытые веса

🖊 Коммерчески удобная лицензия Apache 2.0

🖊 Генерация звуков длиной до 30 секунд

🖊 Можно запускать локально и дообучать под свои задачи

🖊 Есть готовая демоверсия в браузере

Но есть важная оговорка

Это не готовый сервис уровня «зашёл, нажал кнопку, получил идеальный звук». Для локального запуска потребуются Python, зависимости и совместимое оборудование. Все далеко не просто, как пишут в сети.

Цена

Модель бесплатная, а протестировать её можно прямо в браузере через официальный Hugging Face Space. Для регулярного использования и локального запуска уже понадобятся видеокарта, настройка окружения или аренда облачного сервера. Готового официального API через Hugging Face Inference Providers пока нет.

Как протестировать:

1️⃣Откройте ссылку. В поле запроса опиши нужный звук. Лучше писать на английском или китайском, модель обучалась на этих языках.

Примеры запросов:

Crowded coffee shop ambience with cups and quiet conversations
Short energetic electronic jingle for a technology advertisement
2️⃣ Укажите длительность звука. Модель поддерживает генерацию до 30 секунд.
3️⃣ Нажмите кнопку генерации.
4️⃣ Прослушайте результат и скачайте аудиофайл. Если звук получился неточным, добавь в запрос источник звука, пространство, расстояние, интенсивность и настроение.
Например, вместо door opening лучше написать:
A heavy rusty metal door opening slowly in a large empty underground warehouse, loud creaking, realistic sound, no music

Что пишут в сети

Пока почти ничего. На странице модели около тысячи загрузок за месяц и чуть больше ста отметок нравится. Полноценных независимых тестов мало, поэтому судить о стабильности на сложных запросах рано.

Моё мнение

Для финального рекламного ролика результат всё равно придётся чистить и сводить. Но для прототипов, игр, коротких видео и контента модель выглядит очень полезно.

#этоститпротестить

Кибермаркетинг| AI+ опыт = деньги
5099 подписчиков
819 постов
Авторский канал про маркетинг и AI. Экономим время, не теряя в качестве!Личный опыт. Полезные ИИ сервисы. Современные тенденции. Я знаю, за что стоит платить, а что можно получить бесплатно. Контакт @ana_ai_marketing