Сколько именно убирать музыку
Ошибка новичка выглядит одинаково: музыка ставится «чтобы было красиво», голос тонет, и зритель уходит через пять секунд. Рабочий ориентир — фон на двенадцать-восемнадцать децибел тише речи. Меньшая разница годится для коротких динамичных роликов, где текста мало и он громкий. Большая нужна там, где важна разборчивость: обучение, инструкции, длинный дикторский текст.
Отдельно стоит помнить про содержание музыки. Инструментальный фон с редкими событиями прощает многое, а трек с вокалом или плотной серединой конкурирует с речью в тех же частотах, и разницу приходится увеличивать до двадцати и больше децибел. Проще выбрать другую музыку, чем бороться с этим уровнем.
Зачем приглушать фон автоматически
Если поставить музыку достаточно тихо, чтобы она не мешала речи, в паузах её почти не слышно и смысл фона теряется. Решение — динамическое приглушение: пока звучит голос, музыка уходит вниз, в паузах возвращается. Слушатель воспринимает это как естественное поведение звука и обычно вообще не замечает приём.
Важен характер срабатывания. Приглушение должно наступать быстро, чтобы не съесть первый слог, а возвращаться плавно, за полсекунды или дольше, иначе фон будет дёргаться между словами. Именно так и настроена обработка здесь.
Про громкость готового файла
Видеоплатформы и социальные сети приводят звук к своему уровню, поэтому итоговый микс имеет смысл сразу отдать в нужной громкости, а не громче. Ролик, выжатый до предела, после нормализации на площадке будет приглушён, и вы потеряете только динамику. Для веба берут около минус четырнадцати, для подкастов — минус шестнадцать, для телевещания действуют отдельные более строгие нормы.
Что делать дальше с полученным файлом
Готовый WAV можно сразу подставить на звуковую дорожку в монтаже вместо двух отдельных треков. Если нужно подвинуть голос по времени относительно музыки, сделайте это до загрузки: инструмент выравнивает оба файла от нулевой отметки.
Вопросы и ответы
На сколько децибел музыка должна быть тише голоса?
Рабочий ориентир — от двенадцати до восемнадцати децибел. Для рекламы и динамичных роликов берут меньшую разницу, для спокойного дикторского текста и подкастов — большую. Если музыка плотная и с вокалом, разницу увеличивают ещё сильнее.
Что такое приглушение музыки под голосом?
Это автоматическое снижение громкости фона в моменты, когда звучит речь, и возврат к прежнему уровню в паузах. Приём позволяет музыке звучать полноценно между фразами и не мешать разборчивости во время речи.
Какая громкость нужна готовому ролику?
Для видеоплатформ и социальных сетей ориентируются примерно на минус четырнадцать LUFS, для подкастов — на минус шестнадцать. Инструмент приводит готовый микс к выбранному значению.
В каком формате получается результат?
Несжатый WAV, шестнадцать бит, стерео. Этот файл можно сразу подставить в монтаж или загрузить туда, где нужен звук без потерь.
Файлы куда-то отправляются?
Нет. Оба файла обрабатываются в браузере, сведение и экспорт происходят на вашем устройстве.