Настройка микрофона: усиление, шумоподавление, порог тишины
Опубликовано
Настройки микрофона в голосовых чатах обычно трогают в панике: вас плохо слышно, вы дёргаете все ползунки сразу и в итоге получаете громкий шипящий звук с обрезанными окончаниями. Разберём по порядку, что делает каждая настройка, в каком порядке они применяются и как настроить их так, чтобы голос звучал ровно, а вентилятор и клавиатура не приезжали к собеседнику.
Цепочка обработки: что за чем
Звук от микрофона до собеседника проходит несколько ступеней, и порядок здесь принципиален — настройка на любой ступени меняет условия для всех следующих.
- Аппаратное усиление — уровень входа на уровне драйвера или самого устройства.
- Автоматическая регулировка усиления (AGC) — подтягивает тихое, придавливает громкое.
- Эхоподавление — вычитает то, что пришло из ваших же колонок.
- Шумоподавление — убирает постоянные и распознаваемые как шум звуки.
- Шумовой гейт — полностью закрывает микрофон, когда громкость ниже порога.
- Кодек — сжимает результат для передачи.
Главное следствие: чинить надо снизу вверх. Задранный гейт не спасёт от плохого уровня входа, а мощное шумоподавление не исправит перегруженный сигнал — оно будет работать с уже испорченным звуком.
Ступень 1: уровень входа
Это самая важная и самая игнорируемая настройка, потому что живёт она не в приложении, а в системе.
Что нужно. Пики нормальной речи в районе −12…−6 dBFS. На индикаторе с полосой — примерно три четверти шкалы на самых громких словах, с запасом до края.
Почему не «погромче». Сигнал, упирающийся в потолок, ограничивается по амплитуде — это уже необратимое искажение. Дальше по цепочке шумоподавление получает материал, в котором речь и искажения перемешаны, и работает по нему заметно хуже.
Почему не «потише». Слишком тихий сигнал придётся усиливать позже, а вместе с голосом усилится и весь шум комнаты. Плюс шумовой гейт начнёт принимать вашу речь за тишину.
Отдельная ловушка Windows — вкладка «Уровни» в свойствах устройства записи. Там два регулятора: собственно уровень и «Усиление микрофона» (+10, +20, +30 dB). Второй — это грубый цифровой буст, который поднимает шум ровно так же, как голос. Если без него никак, микрофон стоит слишком далеко: сначала подвиньте, а не усиливайте.
Ступень 2: автоматическая регулировка усиления
AGC непрерывно подстраивает громкость: тихую речь подтягивает, громкую придавливает. В Discourse она включена по умолчанию.
Когда AGC полезна. Вы двигаетесь, говорите то ближе, то дальше, микрофон встроен в ноутбук. AGC выравнивает уровень и избавляет собеседников от американских горок.
Когда мешает. У AGC есть свойство: в паузах ей нечего выравнивать, и она поднимает усиление до предела. Получается характерный «вдох» шума между фразами — сначала тишина, потом нарастающий фон, потом снова речь. На микрофоне с ощутимым собственным шумом это слышно отчётливо.
Если голос и так ровный, AGC можно выключить и выставить усиление вручную. В Discourse ручной уровень — это шкала от 0 до 200 процентов, где 100 означает «ничего не менять», и она становится активной только при выключенной автоматике. Начинать стоит именно со 100 и двигать по 10–20 процентов, проверяя себя на записи.
Ступень 3: шумоподавление
Здесь начинается самое интересное, потому что режимов несколько и они устроены принципиально по-разному.
Встроенное подавление браузера. Работает на уровне getUserMedia, ничего не стоит по ресурсам, справляется с ровным фоном — кондиционер, вентилятор, гул улицы. С резкими звуками — щелчки клавиатуры, стук, лай — почти не справляется.
Speex. Классический алгоритм на основе оценки спектра шума. Предсказуемый и мягкий: убирает меньше, но и голос портит меньше. Хороший выбор, когда важнее естественность звучания.
RNNoise. Небольшая нейросеть, обученная отличать речь от всего остального. Убирает существенно больше, включая нестационарные звуки: клавиатуру, шелест, посторонние разговоры. Это режим по умолчанию в Discourse.
У RNNoise есть обратная сторона, о которой стоит знать заранее: он принимает решение «речь или не речь», и на тихом либо далёком голосе иногда ошибается. Симптом узнаваемый — начала фраз пропадают, шёпот исчезает целиком, а голос приобретает слегка «подводный» оттенок. Если это про вас, вернитесь на ступень 1: скорее всего голос приходит слишком тихим, и правильный ответ — поднять уровень входа, а не ослабить подавление.
В мобильной веб-версии тяжёлые режимы не запускаются вовсе — там всегда используется встроенное подавление браузера. Это сделано ради батареи: RNNoise и Speex считают DSP на каждый сэмпл, и на телефоне это заметная нагрузка.
Ступень 4: шумовой гейт и порог тишины
Гейт — самый грубый инструмент в цепочке: он не обрабатывает звук, а просто закрывает микрофон, пока громкость ниже порога.
Что он лечит. Постоянный фон в паузах, который шумоподавление не добивает. Собеседники слышат чистую тишину, когда вы молчите.
Как настроить. Порог нужно поставить между уровнем вашей тишины и уровнем вашей самой тихой речи. В Discourse шкала порога идёт от 0.1 до 10, гейт включён по умолчанию со значением 1.
Практический способ подобрать: помолчите и посмотрите на индикатор — это ваш фон. Скажите что-нибудь спокойным голосом, каким говорите к концу долгого созвона, — это ваш минимум. Порог ставьте ближе к фону, а не к речи. Ошибка в эту сторону стоит немного лишнего шума; ошибка в другую стоит срезанных слов.
Главная ошибка. Порог настраивают, произнося «раз-раз, проверка» бодрым голосом. Через час созвона вы говорите тише, речь проваливается под порог, и вас перестаёт быть слышно на середине фразы. Настраивайтесь по тихому голосу.
Порядок настройки
Один проход, снизу вверх, с проверкой на каждом шаге:
- Отключите всю обработку — шумоподавление, гейт, AGC. Нужен сырой сигнал.
- Выставьте уровень входа так, чтобы пики речи были около трёх четвертей шкалы. Двигайте микрофон, а не усиление.
- Запишите себя и послушайте. Всё, что слышно здесь, обработка будет только маскировать.
- Включите шумоподавление. Начните с RNNoise; если голос звучит обрезанным — Speex.
- Включите гейт и подберите порог по тихой речи.
- Решите про AGC. Ровный голос и хороший микрофон — можно без неё. Иначе включайте.
Весь проход занимает минут пять и делается один раз.
Что проверить, если ничего не помогает
Если после настройки вас всё ещё плохо слышно, проблема, скорее всего, не в настройках: пошаговая диагностика микрофона разбирает разрешения, выбор устройства и аппаратные переключатели.
А если голос звучит нормально, но доезжает рывками — обработка тут не поможет вообще, дело в канале: задержка, джиттер и потери пакетов.