Монтаж видео
Тихий звук в видео: 5 причин и как поднять громкость без хрипа
Ролик готов, картинка нравится, а голос приходится слушать на полной громкости и всё равно половина слов теряется. Вы поднимаете уровень, и вместе с голосом вылезают шипение, гул холодильника и треск на громких слогах. Убавляете обратно, и снова ничего не слышно.
Факты сверены с первоисточниками 14 сентября 2026: справки открывали живьём, цены и лимиты смотрели на сайтах сервисов. Список документов с адресами лежит в конце статьи.
Сначала отделим проблему файла от проблемы устройства, это минутная проверка. Потом главное объяснение: почему у звука две разные громкости и почему ползунок усиления не работает. Дальше три способа по возрастанию сложности, разбор хрипа и шума и правила записи, после которых тянуть не придётся.
Короткий ответ
Голос тихий не потому, что мало усиления, а потому что у звука две разные громкости. Пиковая это самый высокий всплеск, воспринимаемая это средний уровень, который слышит человек. Один резкий пик не даёт поднять всю дорожку: он первым упирается в потолок и начинает хрипеть.
Правильный порядок такой. Убрать шум, выровнять размах компрессором, если громкость скачет по ролику, и только потом нормализовать дорожку по воспринимаемой громкости. Ориентир нормы отраслевой: рекомендация EBU R 128 задаёт целевой уровень −23,0 LUFS и максимальный истинный пик −1 dBTP.
Сначала проверьте, где именно тихо
Половина случаев решается до всякой обработки. Задача проверки в том, чтобы отделить тихий файл от тихого воспроизведения.
| Что проверяете | Как | Что означает результат |
|---|---|---|
| Только этот ролик или всё подряд | включите любое другое видео на том же устройстве | тихо всё, значит дело в устройстве, а не в файле |
| Площадка или файл | откройте исходный файл в плеере на компьютере | в плеере нормально, значит приглушает площадка |
| Одна дорожка или весь ролик | послушайте разные куски | тихо местами, нужен компрессор, а не общий подъём |
| Наушники или динамики | послушайте в двух устройствах вывода | разница большая, дело в выводе и его настройках |
Почему «сделать погромче» не работает
Звуковая волна в файле измеряется двумя разными способами, и они отвечают на разные вопросы. Пиковый уровень отвечает на вопрос «насколько высок самый высокий всплеск». Воспринимаемая громкость отвечает на вопрос «насколько громким это кажется человеку в среднем».
Обычный ползунок усиления двигает всю волну целиком, и упирается он в пик. Если у вас в записи есть хлопок двери, стук по столу или резкое «п» в микрофон, этот всплеск уже близко к потолку, а голос сидит далеко внизу. Поднять голос, не тронув пик, ползунком невозможно.
Отсюда весь порядок работы. Сначала уменьшают разницу между пиком и средним уровнем, и только потом поднимают всё вместе. Этот порядок и отличает нормальный звук от вечной борьбы с ползунком.
Какая громкость считается нормальной
Тут есть отраслевой ответ, а не вкусовщина. Рекомендация EBU R 128 описывает, к какому уровню приводить программы, и вещатели Европы работают по ней с момента её выхода.
Уровень громкости программы нормализуется к целевому уровню −23,0 LUFS. Там, где точное попадание практически недостижимо, например в прямом эфире, допускается отклонение ±1,0 LU. Истинный пиковый уровень программы не должен превышать −1 dBTP.
Практический смысл для видеоблога простой. Цифра −23 LUFS это ориентир по методике, а не догма для интернет-ролика: площадки выравнивают загруженное к своим значениям. Но два принципа переносятся один в один: мерить нужно воспринимаемую громкость, а не пик, и оставлять запас до потолка, чтобы не поймать искажение.
Способ 1: нормализация по громкости
Нормализация отличается от усиления тем, что сначала измеряет. Она проходит по всей дорожке, считает воспринимаемую громкость и поднимает или опускает уровень ровно настолько, чтобы попасть в заданную цель, следя за пиками.
В ffmpeg это делает фильтр loudnorm, работающий по стандарту EBU R 128: задаётся целевая громкость, предел истинного пика и диапазон. В Audacity есть отдельный инструмент нормализации по громкости с выбором цели в LUFS, и в руководстве он прямо противопоставлен обычной нормализации по пикам.
Когда одной нормализации хватает
Когда запись ровная: человек говорил на одном расстоянии от микрофона, без выкриков и шёпота. Тогда вся дорожка просто поднимается на нужную величину, и звук становится нормальным за один проход.
Способ 2: компрессор, когда уровень скачет
Если в ролике есть и громкие места, и тихие, общий подъём сделает громкие невыносимыми раньше, чем тихие станут разборчивыми. Здесь нужен компрессор: он уменьшает размах между громким и тихим внутри записи.
Работает он так: всё, что громче заданного порога, приглушается в заданное число раз, а потом вся дорожка поднимается целиком. Результат воспринимается как более громкий и более ровный звук, хотя пики остались на прежней высоте. В ffmpeg за это отвечает acompressor.
Способ 3: выравнивание речи
Отдельный случай: человек говорил, отворачиваясь от микрофона, подходил и отходил, и громкость плавает волнами по всему ролику. Компрессор с этим справляется частично, потому что он реагирует на мгновенные уровни, а не на длинные участки.
Для таких записей есть инструменты, которые ведут уровень по времени: в ffmpeg это speechnorm и dynaudnorm. Они подтягивают тихие куски и придерживают громкие на протяжении всей дорожки, и для голосовой записи это часто работает лучше обычного компрессора.
Почему после подъёма появляется хрип
Хрип и треск на самых громких слогах это клиппинг. Сигнал упёрся в максимум шкалы, и всё, что выше, срезано. Никакая последующая регулировка громкости его не уберёт: срезанные вершины уже записаны.
Поэтому в норме EBU R 128 и стоит требование к истинному пику −1 dBTP: запас нужен не для красоты, а потому что при кодировании и перекодировании волна может оказаться выше, чем была в исходнике, и вылезти за потолок уже после вашего экспорта.
Правильный порядок
Сначала ограничить пики, потом поднять общий уровень, потом проверить результат. Если делать наоборот, вы сначала получите искажение, а потом будете его прятать.
Почему вместе с голосом растёт шум
Усиление умножает весь сигнал: и голос, и гул вентиляции, и шипение микрофона. Если голос записан тихо, доля шума в записи уже высокая, и подъём просто делает её слышимой.
Значит, шумоподавление идёт до подъёма уровня, а не после. Порядок именно такой, потому что шумодав работает по статистике фона, и на усиленной записи он ошибается чаще и съедает больше голоса.
Разбор самих способов убрать фон и их границ лежит в отдельной статье про фоновый шум в аудио и видео. Если же со звуком надо работать отдельно от картинки, дорожку сначала извлекают, и про это тоже есть своя инструкция.
Как записывать, чтобы потом не тянуть
Всё, что сделано на записи, обходится дешевле всего. Три вещи решают большую часть проблем с уровнем.
Первое: расстояние. Громкость падает быстро с удалением от микрофона, а вот шум комнаты не падает. Микрофон в двадцати сантиметрах от рта даёт принципиально другую запись, чем микрофон в двух метрах, и никакая обработка эту разницу не отыграет.
Второе: запас. Записывать нужно так, чтобы самые громкие места не доходили до потолка, оставляя место. Тихую запись поднять можно, перегруженную починить нельзя.
Третье: проверка на том, на чём будут слушать. Ролик почти всегда смотрят с телефона, и звук стоит проверять там же. То, что в студийных наушниках кажется нормальным, на телефонном динамике может пропасть целиком.
Определитель: что слышно и что делать
| Что видно | Почему так | Что делать |
|---|---|---|
| Тихо всё подряд, а не только этот ролик | дело в устройстве или в настройках вывода | не трогай файл, проверь систему и громкость приложения |
| В плеере нормально, на площадке тихо | площадка приглушила ролик своей обработкой | приведи дорожку к целевой громкости заранее, до загрузки |
| Голос ровный, но весь тихий | дорожка записана с низким уровнем и не нормализована | нормализуй по воспринимаемой громкости одним проходом |
| Местами громко, местами не слышно | большой размах между тихим и громким | компрессор, потом общий подъём уровня |
| На громких слогах треск | клиппинг: вершины волны срезаны | ограничь пики и оставь запас до потолка, потом поднимай |
| Стало громче, но шипит и гудит | усиление подняло и шум тоже | сначала шумоподавление, потом подъём уровня |
Памятка
Порядок действий, при котором голос становится слышно и ничего не начинает хрипеть.
Частые вопросы
Почему в видео тихий звук?
Причин пять: записали с низким уровнем, микрофон стоял далеко, дорожка не нормализована, площадка приглушила ролик при своей обработке или тихо только у вас из-за настроек устройства. Первым делом нужно понять, тихо ли это видео у всех или тихо всё подряд на вашем устройстве, потому что лечение у этих случаев разное.
Почему прибавление громкости не помогает?
Потому что громкость бывает двух видов. Пиковая показывает самый высокий всплеск сигнала, воспринимаемая показывает, насколько звук субъективно громкий в среднем. Если в записи есть один резкий пик, а весь голос тихий, то поднять уровень не выйдет: пик упрётся в потолок и захрипит, а голос останется тихим.
Какая громкость считается нормальной?
Отраслевая норма описана в рекомендации EBU R 128: целевой уровень программы −23,0 LUFS, допуск ±1,0 LU для случаев вроде прямых эфиров, а максимальный истинный пик не должен превышать −1 dBTP. Площадки в интернете выравнивают ролики к своим значениям, но принцип везде одинаковый: считается средняя воспринимаемая громкость, а не пик.
Что такое LUFS и зачем это знать?
Это единица измерения воспринимаемой громкости, привязанная к полной шкале. В отличие от пиков она учитывает, как громкость слышит человек, поэтому именно по ней выравнивают ролики площадки и вещатели. Практическая польза простая: если инструмент показывает LUFS, вы можете привести звук к нужному уровню числом, а не на слух.
Как поднять громкость видео без потери качества?
Нормализацией по воспринимаемой громкости, а не простым усилением. Инструмент измеряет уровень всей дорожки и поднимает её ровно настолько, чтобы попасть в цель, следя за тем, чтобы пики не ушли за потолок. В ffmpeg это делает фильтр loudnorm, в Audacity есть отдельная нормализация громкости, работающая по тем же принципам.
Что делать, если в одном месте громко, а в другом тихо?
Нормализация тут не поможет: она двигает всю дорожку целиком. Нужен компрессор, который уменьшает разницу между громким и тихим внутри записи, а после него уже общий подъём уровня. Это стандартная связка для голоса: сначала выравниваем размах, потом поднимаем всё вместе до целевой громкости.
Почему после увеличения громкости звук хрипит?
Потому что сигнал упёрся в потолок шкалы, и вершины волны срезало. Это называется клиппингом и звучит как треск на самых громких слогах. Лечится не уменьшением громкости после, а правильным порядком: сначала снизить пики компрессором или ограничителем, потом поднимать общий уровень, оставляя запас до потолка.
Почему вместе с голосом стал громче шум?
Потому что усиление не отличает полезный сигнал от фона: поднимается всё. Если голос был записан тихо, соотношение голоса и шума уже плохое, и подъём просто делает это слышимым. Правильный порядок: сначала убрать шум, потом поднимать уровень, а не наоборот.
Почему видео тихое только во ВКонтакте или в браузере?
Потому что там звук проходит через свою обработку и свои настройки вывода. Проверяется за минуту: откройте тот же файл в обычном плеере на компьютере. Если там нормально, дело не в ролике, а в площадке или в системе. Если тихо везде, значит, уровень действительно низкий в самом файле.
Какой битрейт звука ставить при экспорте?
YouTube в требованиях к загрузке рекомендует 128 кбит/с для моно, 384 кбит/с для стерео и 512 кбит/с для 5.1. Битрейт при этом не влияет на громкость: он отвечает за детальность звука, а не за уровень. Тихий ролик не станет громче от высокого битрейта, зато экономия на нём слышна быстрее, чем видна экономия на картинке.
Источники
Всё, на что опирается разбор, с датой, когда документ открывали. Сервисы меняют цены и правила молча, поэтому дата тут важнее ссылки: если она старая, цифру стоит перепроверить по первоисточнику.
- EBU R 128: нормализация громкости и допустимый уровень
Целевой уровень программы −23,0 LUFS, допуск ±1,0 LU там, где точное попадание невозможно, например в прямом эфире. Истинный пик программы не должен превышать −1 dBTP.
- Фильтры loudnorm, speechnorm, acompressor и dynaudnorm
loudnorm приводит дорожку к заданной громкости по стандарту EBU R 128, acompressor сжимает динамический диапазон, speechnorm и dynaudnorm выравнивают уровень речи по ходу записи.
- Loudness Normalization
Отдельный инструмент нормализации по воспринимаемой громкости с выбором цели в LUFS или по среднеквадратичному уровню, в отличие от обычной нормализации по пикам.
- Рекомендуемые настройки загрузки видео
Рекомендованный битрейт аудио: 128 кбит/с для моно, 384 кбит/с для стерео, 512 кбит/с для 5.1.