Часто задаваемые вопросы по динамической обработке аудио сигнала. Динамический звук в разрушаемых уровнях Rainbow Six: Siege

27.05.2019

Skype

Что такое динамический диапазон?

Динамический диапазон можно определить как расстояние между уровнями самого тихого и самого громкого сигналов из возможных. К примеру, если в инструкции к процессору указано, что максимальный входной уровень сигнала до искажения равен +24 дБ, а шумовой порог на выходе равен -92 дБ, значит суммарный динамический диапазон процессора равен 24 + 92 = 116 дБ.

Динамический диапазон оркестра в среднем находится в пределах от -50 дБ до +10 дБ. Что в сумме даёт 60 дБ. Хотя вам может показаться, что динамический диапазон в 60 дБ - это мало, проведя простые расчёты, оказывается, что +10 дБ - это в 1000 раз громче, чем -50 дБ!

Динамический диапазон в рок музыке намного меньше, обычно от -10 dдБ до +10 Дб, или 20 дБ в сумме. Поэтому смешивание разных сигналов в рок музыке в единый микс довольно занудное занятие.

Для чего нам компрессия?

Допустим, вы работаете над сведением роковой записи, средний динамический диапазон у нее 20 дБ. И вы хотите добавить в микс необработанный компрессором вокал. Средний динамический диапазон у вокала равен примерно 40 дБ. Чем это чревато для микса? Слишком тихие вокальные куски будут просто не слышны, а слишком громкие будут выпирать из общей картины. В данной ситуации компрессор необходим для уменьшения (компрессии) динамического диапазона вокала в пределах 10 дБ.

В данном случае вокал будет находиться примерно на уровне +5 дБ. Диапазон - от 0 дБ до +10 дБ. Тихие фразы теперь будут выше самого низкого уровня сигнала в миксе, а громкие фразы не будут выпирать. Получается, что вокал занимает своё место в миксе.

Тот же самый принцип работает для любого инструмента в миксе. У каждого инструмента есть свое место в миксе, а хороший компрессор помогает звукорежиссеру правильно их смешать.

Разве компрессор нужен для всего?

Обычно в ответ на этот вопрос вы слышите: "Конечно же, нет! Перекомпрессированные треки звучат ужасно.” Это утверждение верно лишь в одном случае - если вы отчетливо слышите как работает компрессор на записи. Качественный дорогой компрессор, будучи правильно настроенным, звучит незаметно! Перекомпрессированный звук - это следствие ошибок в обработке конкретных инструментов, если конечно это не сделано умышленно с целью получить спецэффект.

Как вы думаете, зачем на всех дорогих микшерных пультах на каждом канале есть свой компрессор? Ответ прост - большинство инструментов нуждается в компрессии, пусть даже едва заметной. Это помогает им быть слышимыми в миксе.

Зачем нам нойз-гейты?

Давайте рассмотрим пример с вокалом. Допустим, вы установили для него диапазон в 20 дБ. Проблемы начинаются, когда компрессор усиливает самые тихие сигналы в вокальном треке. Всплывают всякие нежелательные шумы на заднем плане, куски фонограммы, попавшей в микрофон из наушников и т.п. Вы можете попробовать просто убрать громкость в паузах, но это обычно заканчивается полным провалом. Намного лучший способ - использовать нойз-гейт. Мы можем установить порог срабатывания нойз-гейта, к примеру, на -10 дБ, что соответствует нижней границе динамического диапазона вокала в нашем случае. Таким образом гейт будет автоматически убирать в ноль все нежелательные сигналы между фразами.

Если вы когда-либо пробовали сводить живую запись, вы знаете сколько проблем возникает с ударной установкой, а именно с железом, которое проникает в микрофоны, установленные на томах. Как только вы добавляете верхов на эквалайзере, чтобы сделать томы более яркими, начинают лезть наверх тарелки. И это особенно хорошо слышно через ВЧ громкоговорители в мониторах. Если же мы используем гейты на микрофонах, записывающих томы, так что железо больше не будет звучать через них в паузах, мы очень сильно прочистим общий микс и сделаем его в разы разборчивее.

Типы динамической обработки

Динамическая обработка - это процесс изменения динамического диапазона сигнала, позволяющий расширить возможности оборудования, через которое записывается или воспроизводится этот сигнал. Иными словами, мы получаем возможность записывать или проигрывать записанный сигнал без искажений и/или шума, тем самым упрощая себе задачу сведения.

Компрессор и лимитер

Пробивной, хорошо слышимый, с хорошим презенсом - это все описания звуковых сигналов, полученных при помощи их обработки компрессорами и лимитерами.

Компрессия и лимитирование - это формы управления динамическим диапазоном (громкостью) сигнала. Аудио сигналы имеют довольно большой разброс по уровням громкости. Пиковый сигнал может вызвать перегрузку в звукозаписывающей цепи, что в свою очередь вызовет искажение сигнала.

Компрессор/лимитер - это своего рода усилитель, в котором уровень громкости зависит от уровня проходящего через него аудиосигнала. Выбрав определённое значение компрессора/лимитера, сигнал будет автоматически ослабляться выше заданного уровня или порогового уровня.

В сущности, компрессия - это процесс ослабления входного сигнала в заданной пропорции. Используется для сужения динамического диапазона голоса или музыкального инструмента, позволяет производить запись без искажений. Также применяется при создании микса, уменьшая разницу частот каждой дорожки.

Вокалист, допустим, постоянно перемещается перед микрофоном и сигнал на выходе колеблется вверх-вниз, что звучит странно. В данном случае компрессор решит проблему, ослабив громкость отдельных фраз так, что в результате будет ровный вокал.

Степень ослабления сигнала зависит от соотношения компрессии и порогового уровня. Соотношение 2:1 или меньше считается слабой компрессией, при которой сигнал на выходе, превышающий пороговый уровень, уменьшается в два раза. Соотношения выше 10:1 можно называть сильным лимитированием.

Чем ниже пороговый уровень, тем большая часть сигнала подвергается компрессии (при определённом уровне входного сигнала). Важно знать меру, так как слишком сильная компрессия убивает динамику записи (при этом некоторые звукорежиссёры убивают её специально в качестве эффекта)!

Лимитирование - вид обработки сигнала, при котором подавляются всплески громкости (скачки амплитуды).

Компрессор/лимитер используется при выполнении многих задач при обработке звука, например:

Звук бочки ударной установки может затеряться среди электрогитар. И не важно, как громко звучит дорожка, бочка звучит “грязно”. Компрессия выправит звук бочки на фоне гитар.

Диапазон голоса на записи достаточно широк. Пики громкости могут сильно выпирать из общего звучания. Таких пиков может быть много, и они все разные, так что почти невозможно их выровнять через микшер. Компрессор/лимитер автоматически контролирует громкость, не искажая тонкостей вокала.

Соло гитара глушится ритмом. Не выкручивайте фейдер до предела, компрессия поставит ведущую гитару на своё место в миксе.

Бас-гитару сложно записывать. Ровный звук с хорошей атакой достигается за счёт правильной компрессии. И не нужно обрезать низы микса - компрессор/лимитер позволит басу проявиться на любых частота

Экспандер

Существует два основных вида экспансии: динамическая и нисходящая. Экспансия расширяет динамический диапазон сигнала, когда он выше порогового значения. Динамическая экспансия - это, по сути, компрессия наоборот.Динамическая экспансия применяется на ТВ и радио, чтобы отменить компрессию непосредственно до передачи аудио сигнала. Компрессию с последующей экспансией называют компандированием.На данный момент чаще всего применяют нисходящую экспансию. В отличие от компрессии, которая понижает сигнал выше порогового значения, экспансия понижает сигнал ниже порога экспансии. Степень понижения определяется соотношением экспансии. Например, соотношение 2:1 понижает сигнал вдвое (это значит, что если сигнал ниже порогового значения на 5дБ, экспандер понизит его до 10дБ).Экспансию часто используют для уменьшения шумов, это очень мощный и простой нойз-гейт. Главное различие между экспандером и нойз-гейтом в том, что экспансия зависит от того, насколько сильно сигнал ушёл “под порог”, тогда как при работе нойз-гейта это не имеет значения.

Шумоподавление

Шумоподавление - процесс устранения нежелательного шума из записи посредством ограничения сигнала ниже заданного порогового значения. Как было написано выше, работа нойз-гейта не зависит от уровня сигнала ниже порога. Выход устройства открыт, пока сигнал находится выше порога.

Длительность открытия выхода определяется скоростью атаки. Длительность работы устройства, когда сигнал ниже порогового называется временем удержания. Скорость закрывания выхода определяется временем возврата. Уровень подавления нежелательного сигнала в закрытом положении определяется диапазоном.

Краткий словарь терминов

Научно доказано, что если вы хотите быстро изучить какой-то предмет, вы должны для начала разобраться с основными понятиями. Тот же принцип действует и в звукозаписи и в дальнейшей работе со звуком. Большинство инструкций и учебников предполагают наличие базовых знаний, без которых читать их затруднительно. Надеюсь, что следующий раздел поможет вам навести порядок в голове и окончательно разобраться с основами.

Компрессоры

Атака (Attack).

Атака определяет скорость действия компрессора на входной сигнал. Долгая атака (регулятор по часовой стрелке до упора) вначале позволяет сигналу (т.н. начальный переходный процесс) проходить необработанным через компрессор, тогда как короткая атака (против часовой стрелки до упора) сразу же обрабатывает сигнал согласно соотношению компрессии и установленному пороговому уровню.

Авто (Auto).

Компрессор работает в режиме автоматической атаки и возврата. Регуляторы в этом случае не влияют на процесс, а используются запрограммированные значения параметров.

Боковой канал компрессора (Compressor Sidechain).

Вход бокового канала прерывает сигнал, с помощью которого компрессор определяет необходимой уровень компрессии. При отключенном боковом канале, входной сигнал идёт сразу на главную схему компрессора. При его включении, сигнал на главную схему не поступает. Теперь можно обрабатывать управляющий сигнал эквалайзером, например, применив де-эссинг (частотная коррекция голоса). После обработки управляющий сигнал поступает обратно в компрессор через выход канала. Типичное применение бокового канала - использование компрессора для приглушения фоновой музыки во время выступления ведущего или снижения громкости ритм-гитары на фоне вокала. Теперь голос легко различим. В этом случае голосовая дорожка идёт в боковой канал, в то время как фоновая музыка - на основную схему компрессора. Теперь компрессор понижает уровень фоновой музыки (процесс называется дакинг), когда вокалист начинает петь или говорить.

Жёсткая и мягкая компрессия (Hard/Soft Knee)

При жёсткой компрессии ослабление сигнала происходит максимально быстро в момент превышения пороговой величины. При мягкой, сигнал ослабляется более плавно, после того, как он превысил заданный порог, что обеспечивает более естественное для музыки звучание.

Лимитеры.

Лимитер - это компрессор, не допускающий увеличения сигнала выше уровня порога. Например, если порог установить на 0 дБ, параметр “Ratio” выкрутить полностью по часовой стрелке, то компрессор начнёт работу в режиме лимитера при 0 дБ, и выходной сигнал никогда не превысит этого значения.

Компенсирующее усиление (Makeup Gain).

При компрессии, сжатие сигнала обычно влияет на общий уровень громкости. Регулятор усиления позволяет восстановить утерянный при компрессии уровень.

Соотношение (Ratio).

Соотношение - это зависимость между выходным и входным сигналами, этот параметр устанавливает крутизну компрессии. Например, установив соотношение 2:1, любой сигнал выше порогового подвергнется компрессии в соотношении 2:1. На каждый децибел на входе компрессора приходится 0.5 дБ на выходе, таким образом образуется компрессия, сжимающая сигнал в два раза. При увеличении соотношения, компрессор постепенно переходит в режим работы лимитера.

Время возврата (Release).

Время возврата - это время, которое проходит между тем, как уровень входного сигнала упал ниже порога, и моментом, когда уровень компрессии вернулся на нулевой (компрессор перестал ослаблять сигнал). Короткий возврат создаёт неровный, “рубленый” звук, особенно у бас-гитары. Долгий возврат слишком “пережимает” звук, расплющивая его. Любому значению времени возврата найдётся применение - подбирайте на слух.

Threshold.

Пороговый уровень компрессии (порог компрессии) определяет значение, выше которого начинается ослабление сигнала. Обычно поворот регулятора порога влево увеличивает сигнал, который подвергается компрессии (при соотношении выше, чем 1:1).

Экспандеры

Нисходящая экспансия (Downward Expansion).

Нисходящая экспансия чаще всего применяется в профессиональной звукозаписи. Сигнал ослабляется ниже порогового значения. Это стандартный способ подавления шумов.

Соотношение (Ratio).

Соотношение экспансии определяет уровень ослабления сигнала, когда он опустился ниже порога. К примеру, при соотношении экспансии 2:1 каждый децибел ниже порогового значения ослабляется в два раза. При соотношении 4:1 и выше экспандер работает почти как нойз-гейт, только без возможности регулирования времени атаки, задержки и возврата.

Нойз гейты (Noise Gate)

Атака (Attack).

Параметр "время атаки" устанавливает величину, при которой открывается гейт. Быстрая атака подходит для перкуссивных инструментов, в то время как вокал и бас-гитара требуют плавного открытия. Применение к ним слишком быстрой атаки приведёт к появлению ощутимого “шёлкания” при сведении. Щелчок при открытии присущ любому гейту, но при правильной настройке его не слышно.

Время удержания (Hold).

Время удержания - фиксированный период времени, при котором гейт находится в открытом состоянии при уровне сигнала ниже порогового. Значение этого параметра играет роль при гейтировании, например, малого барабана - после удара по нему проходит определённое время, после которого гейт резко закрывается.

Диапазон (Range).

Диапазон гейта - величина ослабления сигнала, когда гейт закрыт. Таким образом, при значении этого параметра 0 дБ ослабления сигнала вообще не происходит. Значение -60 дБ означает, что при закрытом гейте сигнал будет ослаблен (гейтирован) на 60 дБ и т.д.

Время возврата (Release).

Время возврата гейта определяет скорость, с которой гейт переходит из открытого в полностью закрытое состояние. Время возврата обычно настраивают так, чтобы сохранить естественное затухание звука инструмента или вокала. Высокая скорость возврата убирает шумы, но может вызвать “заикание” ударных инструментов, которое устраняется низкой скоростью возврата. Внимательно настраивайте этот параметр для наиболее естественного эффекта.

Пороговый уровень (Threshold).

Пороговый уровень гейта устанавливает значение, при котором гейт открывается. Принцип прост - любой сигнал выше порогового проходит нетронутым, а сигнал ниже ослабляется на величину, зависящую от настроек диапазона. Если выкрутить регулятор влево до упора - гейт будет отключен (т.е. всегда открыт), и любой сигнал проходит без ослабления.

Ниже приведены пресеты компрессии, используемые в PreSonus BlueMax. Данные пресеты - стандартные установки, своего рода отправные точки для работы со звуком.

Вокал

Тёплый вокал. Это параметры для лёгкой компрессии с низким соотношением и расширенным диапазоном, в основном для лирических песен в живом исполнении. Вокал “на своём месте”.

Кричащий. Параметры для громкого вокала. Довольно жёсткая компрессия для вокалистов, которые не следят за расстоянием до микрофона. Голос сильно выступает из микса, создавая эффект присутствия.

Левый/правый (стерео) оверхэды. Параметры «соотношение» и «порог» здесь низкие, что даёт широкий диапазон, в который помещаются даже тарелки. Глубокие низы, общее звучание живое с невысокой реверберацией. Более пробивной звук, меньше эффекта комнаты.

Акустическая гитара. Пресет подчёркивает атаку акустической гитары и обеспечивает ровность звучания, что позволят гитаре оставаться слышимой.

Клавишные инструменты

Фортепиано. Особый пресет для выравнивания всего диапазона фортепиано - от нижнего звука до пятой октавы. Чётко слышны партии обеих рук.

Оркестр. Настройки подходят как для струнных, так и других оркестровых “наборов” синтезатора. Общий динамический диапазон снижен для удобного добавления в микс.

Контур. Настройки расширяют диапазон основного микса.

Threshold (порог)	Ratio (соотношение)	Attack (атака)	Release (возврат)
-13.4 дБ	1.2:1	0.002 мс	182 мс

Люди, увлеченные домашним звуком, демонстрируют интересный парадокс. Они готовы перелопатить комнату прослушивания, соорудить колонки с экзотическими излучателями, но смущенно отступают перед музыкальной консервой, будто волк перед красным флажком. А собственно, почему нельзя за флажок заступить, а из консервы попытаться приготовить что-то более съедобное?

Периодически на форуме возникают жалобные вопросы: «Посоветуйте хорошо записанные альбомы». Оно и понятно. Специальные аудиофильские издания хоть и порадуют слух первую минуту, но до конца их никто не слушает, уж больно уныл репертуар. Что же касается всей остальной фонотеки, то проблема, кажется, очевидна. Можно экономить, а можно не экономить и вбухать прорву денег в компоненты. Все равно мало кому нравится слушать свою любимую музыку на высокой громкости и возможности усилителя здесь ни при чем.

Сегодня даже в Hi-Res альбомах срезаны пики фонограммы и громкость загнана в клиппинг. Считается, что большинство слушает музыку на всяком барахле, а потому надо «поддать газку», сделать своего рода тонкомпенсацию.

Разумеется, делается это не специально, чтобы расстроить аудиофилов. О них вообще мало кто вспоминает. Вот разве что догадались сбагривать им мастер-файлы, с которых копируется основной тираж - компакт-диски, MP3 и прочее. Разумеется, мастер уже давно сплющен компрессором, никто сознательно не будет готовить специальные версии для HD Tracks. Разве что выполняется определенная процедура для винилового носителя, который по этой причине и звучит более гуманно. А для цифрового пути все заканчивается одинаково - большим толстым компрессором.

Итак, в настоящее время все 100% издаваемых фонограмм, за вычетом классической музыки, подвергаются компрессии при мастеринге. Кто-то выполняет эту процедуру более-менее умело, а кто-то совсем по-дурацки. В результате мы имеем пилигримов на форумах с линейкой плагина DR за пазухой, мучительные сравнения изданий, бегство в винил, где тоже нужно майнить первопресссы.

Самые отмороженные при виде всех этих безобразий превратились буквально в аудиосатанистов. Без шуток, они читают звукорежиссерское святое писание задом наперед! Современные программы редактирования звука имеют кое-какой инструмент восстановления звуковой волны, подвергшейся клиппингу.

Изначально этот функционал предназначался для студий. При микшировании бывают ситуации, когда клиппинг попал на запись, а переделать сессию по ряду причин уже невозможно, и здесь приходит на помощь арсенал аудиоредактора - деклиппер, декомпрессор и т.п.

И вот уже к подобному софту все смелее тянут ручки обычные слушатели, у которых идет кровь из ушей после очередной новинки. Кто-то предпочитает iZotope, кто-то Adobe Audition, кто-то операции разделяет между несколькими программами. Смысл восстановления прежней динамики заключается в программном исправлении клиппированных пиков сигнала, которые, упираясь в 0 дБ, напоминают шестеренку.

Да, о 100%-м возрождении исходника речи не идет, поскольку имеют место процессы интерполяции по довольно умозрительным алгоритмам. Но все-таки некоторые результаты обработки мне показались интересными и достойными изучения.

Например, альбом Ланы Дель Рей «Lust For Life», стабильно погано матерящейся, тьфу, мастерящейся! В оригинале песни «When the World Was at War We Kept Dancing» было вот так.

А после череды деклипперов и декомпрессоров стало вот так. Коэффициент DR изменился с 5 на 9. Скачать и послушать образец до и после обработки можно .

Не могу сказать, что метод универсальный и годится для всех угробленных альбомов, но в данном случае я предпочел сохранить в коллекции именно этот вариант, обработанный активистом рутрекера, взамен официального издания в 24 бит.

Даже если искусственное вытягивание пиков из звукового фарша не вернет истинную динамику музыкального исполнения, ваш ЦАП все равно скажет спасибо. Ему ведь так тяжело было работать без ошибок на предельных уровнях, где велика вероятность возникновения так называемых межсемпловых пиков (ISP) . А теперь до 0 дБ будут допрыгивать лишь редкие сполохи сигнала. Кроме того, притихшая фонограмма при сжатии во FLAC или другой lossless-кодек теперь будет меньше по размеру. Больше «воздуха» в сигнале экономит пространство хард-драйва.

Попробуйте оживить свои самые ненавистные альбомы, убитые на «войне громкости». Для запаса динамики сначала нужно понизить уровень трека на -6 дБ, а затем запустить деклиппер. Те, кто не верит компьютерам, могут просто воткнуть между CD-плеером и усилителем студийный экспандер. Данное устройство по сути занимается тем же самым - как может восстанавливает и вытягивает пики сжатого по динамике аудиосигнала. Стоят подобные устройства из 80-90-х не сказать чтобы очень дорого, и в качестве эксперимента попробовать их будет весьма интересно.

Контроллер динамического диапазона DBX 3BX обрабатывает сигнал раздельно в трех полосах - НЧ, СЧ и ВЧ

Когда-то эквалайзеры были само собой разумеющимся компонентом аудиосистемы, и никто их не боялся. Сегодня не требуется выравнивать завал высоких частот магнитной ленты, но с безобразной динамикой надо что-то решать, братцы.

ВОЛОГДИН Э.И.

ДИНАМИЧЕСКИЙ ДИАПАЗОН

ЦИФРОВЫХ АУДИО ТРАКТОВ

Конспект лекций

Санкт Петербург

	Динамический диапазон звуков и музыки......................................................................
	Динамический диапазон фонограмм.................................................................................
	Динамический диапазон цифрового аудио тракта.........................................................
	Расширение динамического диапазона c использованием технологии Dithering .....
	Расширение динамического диапазона с использованием технологии Noise Shaping
.......................................................................................................................................................
Список литературы...............................................................................................................

1. Динамический диапазон звуков и музыки

Человек слышит звук в чрезвычайно широком диапазоне звуковых давлений. Этот диапазон простирается от абсолютного порога слышимости до болевого порога 140 дБ SPL относительно нулевого уровня, за который принято давление 0,00002 Па (рис.1 .). Зона риска на этом рисунке обозначает область звуковых давлений, которые при

Абсолютный порог слышимости

Частота тональных звуков, кГц

Рис. 1. Области слышимости слуха

длительном воздействии могут привести к полной потери слуха. Болевой порог для тональных звуков зависит от частоты, для звуков с произвольным спектром за болевой порог принят уровень давления 120 дБ SPL. График абсолютного порога слышимости достаточно точно описывается эмпирическим равенством

В тишине чувствительность слуха человека повышается, а в атмосфере громких звуков – понижается, слух адаптируется к окружающей звуковой среде, поэтому динамический диапазон слуха не такой большой – около 70..80 дБ. Сверху он ограничен давлением 100 дБ SPL, а снизу шумом с уровнем -30…35 дБ SPL. Этот динамический диапазон может сдвигаться вверх и вниз до 20 дБ. Для комфортного восприятия музыки рекомендуется, чтобы звуковое давление не превышало 104 дБ SPL в домашних условиях и 112 дБ SPL, в специально оборудованных помещениях.

Динамический диапазон музыки определяется отношением в децибелах самого громкого звука (фортиссимо) и самого тихого звука (пианиссимо ).Динамический диапазон симфонической музыки составляет 65…75 дБ, а на концертах рок-музыки он возрастает

до 105 дБ, при этом пики звуковых давлений могут достигать 122…130 дБ SPL.

Динамический диапазон вокальных исполнителей - не превышает 35…45 дБ (табл.1 ).

Динамический диапазон музыки существенно зависит от выбора максимального

звукового давления P max , так как он ограничивается снизу абсолютным порогом

слышимости. Эта зависимость наиболее сильно выражена на краях звукового диапазона.

На рис. 2

приведены примеры изменения динамического диапазона тональных звуков. В

120dB Болевой порог

P max

80dB

DR 40 dB

50dB

80dB

50dB

Абсолютный порог

слышимости

Частота тональных звуков, кГц

Рис. 2. Динамический диапазон музыки и пороги слышимости слуха

зависимости от выбора P max

и частоты тональных звуков

динамический

диапазон

80 дБ уменьшается на краях

звукового диапазона до 40

Именно поэтому

принято измерять динамический диапазон звуков на частоте 1 кГц, на которой он может

достигать 117 дБ.

помещения маскирует звук и этим уменьшает его динамический диапазон

музыки снизу . Нарис.3 . показано как при уменьшении звукового давления от 120 до 80 дб

SPL динамический диапазон музыки из-за шума помещения уменьшается с 90 до 50 дБ.

120 dB SPL

DR 90 dB

Влиянием

полностью

пренебречь

только при

90dB

минимального уровня музыкальных звуков.

70dB

В студиях звукозаписи уровень шума не

90dB

превышает

квартирах

50dB

разговор

увеличивает уровень

шума до 60дБ SPL.

Именно поэтому тихая музыка часто тонет

Шум в квартире

помещения

прослушивания

невольно

возникает

увеличить

громкость.

Шум квантования, являющийся белым

шумом, заметен на слух при его

Шум в студии

интенсивности всего 4 дБ SPL, даже когда

общий шум аудио аппаратуры в помещении

достигает

Рис. 3. Динамический диапазон музыки в

необходимо сопоставить с тем, что полной

шкале FS цифрового измерителя уровня

соответствуют уровень между 105 и 112 дБ SPL. Поэтому для

бытовых помещений

динамический диапазон музыки не должен превышать 101 - 108 дБ.

Динамический диапазон микрофонов определяется так же, как это обычно делается в электрических трактах. Верхняя граница ограничивается допустимой величиной нелинейных искажений, а нижняя - уровнем собственных шумов. Современные студийные микрофоны допускают максимальное звуковое давление 125…145 дБ SPL, при этом нелинейные искажения не превышают 0,5% … 3%. Уровень собственных шумов микрофонов составляет 15…20 дБА, динамический диапазон – от 90 до 112 дБА, а отношение сигнал/шумот 70 до 80 дБА. Эти микрофоны с запасом перекрывают весь диапазон слуха человека от 120 дБ SPL до уровня шума студии 20 дБ SPL. В современных студиях запись производится с использованием 22 или 24 разрядных АЦП, иногда используется квантование с плавающей запятой, поэтому проблем с динамическим диапазоном не возникает. Стоит такая аппаратура крайне дорого.

2. Динамический диапазон фонограмм

Музыкальный и речевой сигналы представляют собой последовательность быстро нарастающих и более медленно затухающих звуковых импульсов (рис.4 .). Такой сигнал характеризуетсясреднеквадратическим и пиковым значениями уровней , разность этих уровней называется пик-фактором . Прямоугольная волна (меандр) имеет единичный пик-фактор 0 дБ, пик-фактор синусоиды равен 3 дБ. Фонограммы музыкальных и речевых сигналов имеют пик-фактор до 20 дБ и более.Время определения пик-фактора связано временем интегрирования при вычислении среднеквадратического значения сигнала, и обычно, оно равно 50 мс.

Динамический диапазон и пик-фактор музыкальной фонограммы определяют путем статистической обработкимгновенных значений сигналов. Наиболее подробно статистические характеристики рассчитываются в звуковом редакторе Audition 3 (рис.4 ).

Рис.4. Фрагменты фонограмм музыкальных отрывков различной длительности

Из них основными являются следующие: Peak Amplitude (L pic ), Maximum RMS Power (L max ), Minimum RMS Power (L min )и Average RMS Power (L avr ) (уровни максимального,

минимального и среднего среднеквадратического (эффективного) значения мощности сигнала).

Динамический диапазон фонограммы по данным этой таблицы определяется как

DR mL picL min ,

пик-фактор рассчитывается по формуле

PF mL picL avr

Динамический диапазон может быть также определен по гистограмме распределения уровней фонограммы, приведенной на рис.5. Такие операции удобно быстро делать до и после динамической обработки фонограммы.

Рис.4. Статистические характеристики фонограмммы музыки Бетховена «Элизе»

Рис.5. Гистограмма распределения музыки Бетховена «Элизе»

зависимости от задачи исследования. Если, например, важным является динамический диапазон мгновенных значений уровней фонограммы, то время интеграции должно быть 1-5 мс. Если измеряется динамический диапазон музыки с учетом слухового восприятия, то время интеграции выбирается равным 60 мс, это постоянная времени слуха.

позволяет определять динамический диапазон и пик-фактор с заданной вероятностью при выбранном времени интеграции. В звуковом редакторе Adobe Audition 3 используется нормализация гистограммы, при которой максимальной вероятности событий всегда соответствует значение 100. Такая гистограмма описывает распределение вероятностей уровней сигналов фонограммы относительно максимального значения. При ее построении автоматически подбирается масштаб по оси Х, поэтому затруднительно сравнивать гистограммы различных фонограмм.

Практическое применение. Кому и зачем нужна статистическая информация и гистограмма фонограммы. Эти данные прежде всего оказывают неоценимую помощь при динамической обработке фонограммы, так как они позволяются обоснованно выбрать характеристики компрессора и экспандера. Статистические результаты обработки фонограмм с музыкой различных жанров позволяют определить необходимый динамический диапазон электроакустического тракта, сформировать требования по пиковой и средней мощности головок акустических система. Они играют существенную роль при разработке алгоритмов компрессии звуковых сигналов.

Эмоциональную музыку с широким динамическим диапазоном и большим пик-
фактором можно слушать только на высококачественной дорогой аппаратуре с хорошими
		акустическими	агрегатами.
		наушниками и в автомобилях из-за шумов динамический
	15 диапазон сокращается и она			просто отвратительно.
		Поэтому широким спросом такие записи не пользуются и,
		неизбежно, с каждым годом динамический диапазон и пик-






		Рис.7. Фонограмма песни “I`ll Be There For You”
		Рис.7. Фонограмма песни “I`ll Be There For You”
Рис. 6. Пик-фактор CD дисков

фонограмм преднамеренно изготовителями уменьшается (рис.6 .). На современных CD

дисках в большинстве случаев динамический диапазон не превышает 20 дБ, а пик-фактор-

чуть больше 3 дБ, что вполне достаточно для танцевальной музыки. На рис.7. приведена

картинка современной фонограммы с компакт диска.

3. Динамический диапазон цифрового аудио тракта

Обычный цифровой тракт

включает в себя АЦП и ЦАП.

Первый осуществляет

квантование аналоговых сигналов, и преобразование их в цифровой поток. Второй

производит обратное преобразование цифрового потока в аналоговый сигнал.

Квантование

округление

последовательности выборок

до целого двоичного

значения. При импульсно-кодовой модуляции (ИКМ) такая

операция

осуществляется

линейного

квантователя, называемого в технической литературе Mid-

Tread . У

него передаточная

имеет форму

«лестницы» с одинаковыми ступеньками

обязательно,

нечетное число уровней квантования. Округление

цифровых данных в этом квантователе производиться

ближайшего

двоичного значения (рис.8 ).

Этот алгоритм

принято называть rounding.

алгоритме

выходной

квантователя

симметричен относительно оси времени, и квантование

Рис. 8. Передаточные

осуществляется с порогом, равным

0,5 шага квантования

функции квантователей

Пока входной сигнал меньше этого порога выходной

Mid-Tread и Mid-Riser

сигнал квантователя равен нулю, это значит, что

квантование осуществляется с центральной отсечкой.

входном сигнале несколько выше порога квантования выходной сигнал имеет вид

последовательности импульсов со скважностью, зависящей

от уровня

дальнейшем увеличении уровня ЗС формируется выходной сигнал ступенчатой формы.

Округление цифровых данных в квантователе Mid-Riser производится до ближайшей меньшей величины (рис.8 ), поэтому данный алгоритм принято называть- truncating . Квантователь Mid-Riser отличается тем, что у него отсутствует порог квантования, поэтому он передает звуковые сигналы очень маленьких уровней, даже ниже уровня

шума. Однако, при отсутствии ЗС любой ничтожный шум порождает на выходе последовательность случайных импульсов с амплитудой 1 квант, это значит, что такой квантователь усиливает шумы.

Динамический диапазон АЦП с квантователем Mid-Tread определяется через логарифм отношения максимального и минимального значений сигнала синусоидальной формы на входе квантователя

DR А 20 logA max ,

A min

Q 2 (q 1), A		Q – шаг квантования,q - число разрядов. Поэтому
Q 2 (q 1), A		Q – шаг квантования,q - число разрядов. Поэтому


	DRА		Q 2 (q 1)	) 6.02q (1)
	DRА			) 6.02q (1)
			Q / 2

При q = 8 этот динамический диапазон равен 48 дБ, а приq = 16 он увеличивается до 96 дБ. ЗначениеDR A определяет нижнюю границу динамического диапазона по уровню входных сигналов квантователя типа Mid-Tread.

Динамический диапазон ЦАПа измеряется в соответствии с рекомендациями стандартаEIAJ через отношение максимального среднеквадратического значения сигнала

синусоидальной формы A max на его выходе к среднеквадратическому значению шума квантования, измеренному в полосе от 0 до частоты НайквистаF N

A max

Q 2 (q 1)

A max

q 1, 76;q

При q = 16

DR R = 98 дБ, что

децибела

динамического диапазона

квантователя, определяемого формулой (1). Измеренный таким образом динамический диапазон ЦАПа отождествляется со значением его SNR .

Если верхний диапазон частот ограничивается значением F max F N , то расчетная формула дляSNR иDR R принимает вид

	SNR R DR R 6.02q 1,76 10 log
		2 F max

где f s - частота дискретизации,F max - максимальная частота звукового диапазона. При

f s = 44,1 кГц иF max = 20 кГц иSNR R =DR R = 98,5 дБ. Как видно, отношение сигнал/шум лишь на 2 децибела больше динамического диапазона. Надо обратить внимание на то, что величинаSNR зависит от частотf s иF max , тогда какDR от этих параметров не зависит.

Тем не менее, в большинстве технических публикаций динамический диапазон отождествляется с отношением сигнал/шум. Это подтверждается и стандартами AES 17 и

IEC 61606.

В стандарте IEC 61606 рекомендуется измерятьSNR иDR при подаче на вход АЦП синусоидального сигнала с частотой 997 Гц и уровнем минус 60 дБ FS c обязательным использованием технологииTPDF Dithering . При этом расчетное соотношение дляSNR из-за вносимого дополнительного шума предлагается в виде

	SNR T DR T 6.02q 3,01 10 log
		2 F max

При прежних условиях DR =SNR = 93,7 дБ, а не 96 дБ, как это часто встречается в технической литературе. Следовательно, уменьшается и расчетный динамический диапазон. ВместоSNR часто используется его обратная величина, определяющая интегральный уровень шума квантования

L nTSNR T.

В соответствии со стандартом IEC 61606 измерение динамического диапазонаDR R производится в соответствии со схемой, приведенной нарис.9. В этой схеме тестовый

Рис..9. Схема измерения динамического диапазона ЦАП

цифровой сигнал с частотой 1 кГц, и уровнем минус 60 дБ, сформированный с использованием технологии TPDF Dithering , подается на вход ЦАПа. Аналоговый сигнал с ЦАПа поступает на вход ФНЧ с частотой среза 20 кГц, ограничивающий спектр шума квантования. Далее производится фильтрация с помощью взвешивающего фильтра типаА , учитывающего особенности слухового восприятия шума квантования, что увеличивает динамический диапазон на 2-3 дБ. Тестовый сигнал и шум усиливаются на 60 дБ и подаются на измеритель уровняTHD+N . В этом измерителе тональный сигнал подавляется режекторным фильтром и вольтметром эффективных значений измеряется уровень шума в децибелах. Это измеренное значение уровня шума отождествляется, с обратным знаком, с динамическим диапазоном ЦАПа.

При квантовании сигналов минимального уровня возникают громадные искажения, достигающие 100% (рис.10 ). В связи с этим на практике приходиться руководствоватьсяреальным динамическим диапазоном АЦП. При определении этого диапазона необходимо учитывать: пик-фактор музыкальных сигналов, достигающий 12…20 дБ, необходимость поднимать уровень нижней границы динамического диапазона над уровнем шума квантования хотя бы на 20 дБ и иметь дополнительный запас в верхней части динамического диапазона около 10…12 дБ для предотвращения случайной перегрузки.

В результате реальный динамический диапазон			записи 16-ти разрядного АЦП ИКМ
			не превышает 48…54 дБ. Этого
			не превышает 48…54 дБ. Этого
	даже близко не хватает для хорошей
	студийной			звукозаписи.
	автоматической регулировке уровней, что
	имеет место при записи компакт-дисков,
		диапазон может быть расширен до 74
16 бит,1000 Гц, 93 дБ				заметным	ухудшением
16 бит,1000 Гц, 93 дБ	качества звука сигналов низкого уровня.
	качества звука сигналов низкого уровня.
Рис.10. Последовательность выборок искаженной	Запас динамического диапазона сверху
формы синусоидального сигнала	предохраняет от возможности перегрузки,
					превышают

ожидаемое значение. При записи танцевальной музыки вполне достаточно запаса в 6 дБ.

При записи симфонической музыки иногда приходиться иметь запас до 20…30 дБ. Запас динамического диапазона снизу предотвращает возможность тихих пассажей оказаться ниже уровня шума и, тем более, ниже порога слышимости.

В цифровых трактах верхняя граница динамического диапазонаограничивается уровнем сигнала 0 дБ FS . Без использования технологии Dithering нижняя граница динамического диапазонаограничивается уровнем

LA 1 / DRA .

При q = 8 бит он равен минус 48 дБ, а приq = 16 бит – минус 96 дБ. Неизбежный шум тракта повышает этот уровень.

Интегральный уровень шума минус 93,7 дБ – это много или мало. Важно насколько этот уровень превышает порог слышимости. С использованием технологии Dithering шум

Рис.11. Пороги слышимости шума квантования в зависимости от числа разрядов

квантования становится белым шумом, порог слышимости которого равен 4 дБ SPL . Это значит, что вблизи 3 кГц шум квантования при q = 16 бит будет превышать порог слышимости на 22,3 дБ (рис.11). Как видно из этого рисунка, для того чтобы шум квантования был не слышен требуется использовать 20-разрядное квантование.

4. Расширение динамического диапазона c использованием технологии Dithering

Для расширения динамического диапазона ИКМ тракта с квантователем типа MeadTread без увеличения числа разрядов и частоты дискретизации разработано множество

аналоговых сигналов к ЗС добавляется небольшой аналоговый шум. Более часто эта технология используется при реквантовании цифровых ЗС , когда производится

осуществляется с 24 разрядами, а затем производиться реквантование, обычно до 16 разрядов, как это принято в стандарте CD. При этом качество такого CD по шумам соответствует 20разрядной записи.

В процессе реквантования чаще применяют операцию truncating , при которой просто отбрасываются младшие разряды кодовых слов. В этом случае в выходном сигнале

Все права в отношении данного документа принадлежат автору. Воспроизведение данного текста или его части допускается только с письменного разрешения автора.

Б иты, герцы... Что скрывается за этими понятиями? При разработке стандарта аудио компакт дисков были приняты значения 44 кГц, 16 бит. Почему именно столько? В чем причина выбора, а также - почему предпринимаются попытки повысить эти значения до, скажем, 96 кГц и 24 или даже до 32х битов...

Разберемся сначала с разрешением сэмплирования - то есть с битностью. Так уж получается, что выбирать приходится между числами 16, 24 и 32. Промежуточные значения были бы, конечно, удобнее в смысле звука, но слишком неприятны для использования в цифровой технике.

За что отвечает этот параметр? В двух словах - за динамический диапазон. Диапазон одновременно воспроизводимых громкостей - от максимальной амплитуды (0 дБ) до той наименьшей, которую позволяет передать разрешение, например - примерно -93 дБ для 16 битного аудио. Как не странно, это сильно связано с уровнем шумов фонограммы. В принципе, для, к примеру, 16 битного аудио вполне возможна передача сигналов мощностью и в -120 дБ, однако эти сигналы будет затруднительно применять на практике из-за такого фундаментального понятия как шум дискретизации . Дело в том, что при взятии цифровых значений мы все время ошибаемся, округляя реальное аналоговое значение до ближайшего возможного цифрового. Самая маленькая возможная ошибка - нулевая, максимально же мы ошибаемся на половину последнего разряда (бита, далее термин младший бит будет сокращаться до МБ). Эта ошибка дает нам так называемый шум дискретизации - случайное несоответствие оцифрованного сигнала оригиналу. Этот шум носит постоянный характер и имеет максимальную амплитуду равную 0.5МБ. Это можно рассматривать как случайные значения, подмешанные в цифровой сигнал. Иногда это называется шум округления или квантования.

Остановимся подробнее на том, что понимается под мощностью сигналов, измеряемой в битах. Самый сильный сигнал в цифровой обработке звука принято принимать за 0 дБ, это соответствует всем битам, поставленным в 1. Если старший бит (далее СБ) обнулить, получившееся цифровое значение будет в два раза меньше, что соответствует потере уровня на 6 дБ. Никакими другими битами кроме СБ нельзя добиться уровня выше -6 дБ. Соответственно - старший бит как бы отвечает за наличие уровня сигнала от -6 до 0 дБ, поэтому СБ - это бит 0 дБ. Предыдущий бит отвечает за уровень -6 дБ, ну а самый младший, таким образом - за уровень (число_бит-1) * 6 дБ. В случае 16 битного звука, МБ соответствует уровень в -90 дБ. Когда мы говорим 0.5МБ, мы имеем в виду не -90/2, а половину шага до следующего бита - то есть еще на 3 дБ ниже, -93 дБ.

Возвращаемся к выбору разрешения оцифровки. Как уже было сказано, оцифровка вносит шум на уровне 0.5МБ, это говорит о том, что запись, оцифрованная в 16 бит, постоянно шумит на -93 дБ. Она может передавать сигналы и тише, но шум все равно остается на уровне -93 дБ. По этому признаку и определяется динамический диапазон цифрового звука - там, где соотношение сигнал/шум переходит в шум/сигнал (шумов больше, чем полезного сигнала), находится граница этого диапазона снизу. Таким образом, главный критерий оцифровки - сколько шума мы можем себе позволить в восстановленном сигнале? Ответ на этот вопрос зависит отчасти от того, сколько шума было в исходной фонограмме. Важный вывод - если мы оцифровываем нечто с уровнем шумов -80 дБ - нет совершенно никаких причин цифровать это в более чем 16 бит, так как, с одной стороны, шумы -93 дБ добавляют очень мало к уже имеющимся огромным (сравнительно) шумам -80 дБ, а с другой стороны - тише чем -80 дБ в самой фонограмме уже начинается шум/сигнал, и оцифровывать и предавать такой сигнал просто не нужно.

Теоретически это единственный критерий выбора разрешения оцифровки. Больше мы не вносим совершенно никаких искажений или неточностей. Практика, как не странно, почти полностью повторяет теорию. Этим и руководствовались те люди, которые выбирали разрешение 16 бит для аудио компакт дисков. Шум -93 дБ - довольно хорошее условие, которое почти точно соответствует условиям нашего восприятия: разница между болевым порогом (140 дБ) и обычным шумовым фоном в городе (30-50 дБ) составляет как раз около сотни дБ, и если учесть, что на уровне громкости, приносящем боль, музыку не слушают - что еще несколько сужает диапазон - получается, что реальные шумы помещения или даже аппаратуры получаются гораздо сильнее шумов дискретизации. Если мы можем расслышать уровень под -90 дБ в цифровой записи - мы услышим и воспримем шумы дискретизации, иначе - мы просто никогда не определим, оцифрованное это аудио или живое. Никакой другой разницы в смысле динамического диапазона просто нет. Но в принципе, человек может осмысленно слышать в диапазоне 120 дБ, и было бы неплохо сохранить весь этот диапазон, с чем 16 бит, казалось бы, не справляются.

Но это только на первый взгляд: с помощью специальной техники, называемой shaped dithering , можно изменить частотный спектр шумов дискретизации, почти полностью вынести их в область более 7-15 кГц. Мы как бы меняем разрешение по частоте (отказываемся от воспроизведения тихих высоких частот) на дополнительный динамический диапазон в оставшемся отрезке частот. В сочетании с особенностями нашего слуха - наша чувствительность к выкидываемой области высоких частот на десятки дБ ниже чем в основной области (2-4 кГц) - это делает возможным относительно бесшумную передачу полезных сигналов дополнительно еще на 10-20 дБ тише, чем -93 дБ - таким образом, динамический диапазон 16 битного звука для человека составляет около 110 дБ. Да и вообще - одновременно человек просто не может слышать звуки на 110 дБ тише чем только что услышанный громкий звук. Ухо, как и глаз, подстраивается под громкость окружающей действительности, поэтому одновременный диапазон нашего слуха составляет и совсем сравнительно мало - около 80 дБ. Поговорим о dithring-е подробнее после обсуждения частотных аспектов.

Для компакт дисков выбрана частота дискретизации 44100 Гц. Бытует мнение, что это означает, что воспроизводятся все частоты до 22.05 кГц, однако это не совсем так. Однозначно можно сказать лишь то, что частот выше 22.05 кГц в оцифрованном сигнале нет. Реальная же картина воспроизведения оцифрованного звука всегда зависит от конкретной техники и всегда не настолько идеальна, как хотелось бы, и как соответствует теории. Все зависит от конкретного ЦАПа.

Разберемся сначала, что нам хотелось бы получить. Человек среднего возраста (скорее молодой) может чувствовать звуки от 10 Гц до 20 кГц, осмысленно слышать - от 30 Гц до 16 кГц. Звуки выше и ниже воспринимаются, но не составляют акустических ощущений. Звуки выше 16 кГц ощущаются как раздражающий неприятный фактор - давление на голову, боль, особо громкие звуки приносят такой резкий дискомфорт, что хочется покинуть помещение. Неприятные ощущения настолько сильны, что на этом основано действие охранных устройств - несколько минут очень громкого звука высокой частоты сведут с ума кого угодно, и воровать что либо в такой обстановке становится решительно невозможно. Звуки ниже 30 - 40 Гц при достаточной амплитуде воспринимаются как вибрация, исходящая от объектов (колонок). Вернее будет даже сказать так - просто вибрация. Человек акустически почти не определяет пространственное положение настолько низких звуков, поэтому в ход уже идут другие органы чувств - осязательные, мы чувствуем такие звуки телом.

Для передачи звука как он есть было бы неплохо сохранить весь хоть как либо воспринимаемый диапазон от 10 Гц до 20 кГц. С низкими частотами в теории в цифровой записи проблем совершенно никаких нет. На практике же - все ЦАПы, работающие по дельта-технологии, имеют потенциальный источник проблем. Таких устройств сейчас 99%, поэтому проблема так или иначе имеет место быть, хотя откровенно плохих устройств почти нет (лишь самые дешевые схемы). Можно считать, что с низким частотами все обстоит благополучно - в конце концов, это лишь вполне решаемая проблема воспроизведения, с которой успешно справляются хорошо сконструированные ЦАПы ценой более $1.
С высокими частотами все немного хуже, по крайней мере точно сложнее . Почти вся суть усовершенствований и усложнений ЦАПов и АЦП направлена как раз на более достоверную передачу высоких частот. Под "высокими" подразумеваются частоты сравнимые с частотой дискретизации - то есть в случае 44.1 кГц это 7-10 кГц и выше. Поясняющий рисунок:

На рисунке изображена частота 14 кГц, оцифрованная с частотой дискретизации 44.1 кГц. Точками обозначены моменты взятия амплитуды сигнала. Видно, что на один период синусоиды приходится около трех точек, и чтобы восстановить исходную частоту в виде синусоиды, надо проявить некоторую фантазию. Саму синусоиду рисовала программа CoolEdit, она и проявляла фантазию - восстанавливала данные. Аналогичный процесс происходит и в ЦАПе, этим занимается восстанавливающий фильтр. И если сравнительно низкие частоты представляют собой почти готовые синусоиды, то форма и, соответственно, качество восстановления высоких частот лежит целиком на совести восстанавливающей системы ЦАПа. В CoolEdit очень хороший восстанавливающий фильтр, но и он не справляется в экстремальном случае - например, частота 21 кГц:

Видно, что форма колебаний (синие линии) далека от правильной, да и свойства появились, которых ранее не было. Это и составляет основную проблему при воспроизведении высоких частот. Проблема, однако, не так страшна, как может показаться. Во всех современных ЦАП используется технология пересэмплирования (multirate), которая заключается в цифровом восстановлении до в несколько раз более высокой частоты дискретизации, и в последующем переводе в аналоговый сигнал на повышенной частоте. Таким образом проблема восстановления высоких частот перекладывается на плечи цифровых фильтров, которые могут быть очень качественными. Настолько качественными, что в случае дорогих устройств проблема полностью снимается - обеспечивается неискаженное воспроизведение частот до 19-20 кГц. Пересэмплирование применяется и в не очень дорогих устройствах, так что в принципе и эту проблему можно считать решенной. Устройства в районе $30 - $60 (звуковые карты) или музыкальные центры до $600, обычно аналогичные по ЦАПу этим звуковым картам, отлично воспроизводят частоты до 10 кГц, сносно - до 14 - 15, и кое-как остальные. Этого вполне достаточно для большинства реальных музыкальных применений, а если кому-то нужно большее качество - он найдет его в профессионального класса устройствах, которые не то чтобы сильно дороже - просто они сделаны с умом.

Вернемся к dithering-у - посмотрим, как можно с пользой увеличить динамический диапазон за пределы 16 бит.

Идея dithering-а заключается в том, чтобы подмешать в сигнал шум . Как не странно это звучит - для того чтобы уменьшить шумы и неприятные эффекты квантования, мы добавляем свой шум. Рассмотрим пример - воспользуемся возможностью CoolEdit-а работать в 32х битах. 32 бита - это в 65 тысяч раз большая точность, нежели 16 бит, поэтому в нашем случае 32х битный звук можно считать аналоговым оригиналом, а перевод его в 16 бит - оцифровкой. Изображение показывает 32х битый звук - музыка, записанная на таком тихом уровне, что самые громкие моменты достигают лишь -110 дБ:

Это с запасом гораздо тише динамического диапазона 16 битного звука (1МБ 16 битного представления равняется единице по шкале справа), поэтому если просто округлить данные до 16 бит - мы получим полную цифровую тишину.

Добавим в сигнал белый шум с уровнем в 1МБ - это -90 дБ (примерно соответствующий по уровню шумам квантования):

Преобразуем в 16 бит (возможны только целые значения - 0, 1, -1, ...):

(Не обращайте внимание на синюю линию, которая принимает и промежуточные значения - это фильтр CoolEdit моделирует реальную амплитуду после восстанавливающего фильтра. Точки же взятия амплитуд расположены только на значениях 0 и 1)

Как видно, какие-то данные остались. Там, где исходный сигнал имел больший уровень, больше значений 1, где меньший - нулей. Чтобы услышать то, что мы получили, усилим сигнал на 14 бит (на 78 дБ). Результат можно скачать и послушать (dithwht.zip , 183 кб).

Мы слышим этот звук с огромными помехами в -90 дБ (до усиления для прослушивания), тогда как полезный сигнал составляет всего -110 дБ. Мы уже имеем передачу звука с уровнем -110 дБ в 16 битах. В принципе, это и есть стандартный способ расширения динамического диапазона, получающийся часто чуть ли не сам собой - шума везде хватает. Однако само по себе это довольно бессмысленно - уровень шумов дискретизации так и остается на прежнем уровне, а передавать сигнал слабее шума - занятие не очень понятное с точки зрения логики...

Более сложный способ - shaped dithering . Идея в том, что раз мы все равно не слышим высоких частот в очень тихих звуках, значит следует основную мощность шума направить в эти частоты, при этом можно даже воспользоваться большим шумом - я воспользуюсь уровнем в 4МБ (это два бита шума). Усиленный результат после фильтрации высоких частот (мы не услышали бы их в нормальной громкости этого звука) - ditshpfl.zip , 1023 кб (к сожалению, звук перестал архивироваться). Это уже вполне хорошая (для запредельно низкой громкости) передача звука, шумы примерно равняются по мощности самому звуку с уровнем -110 дБ! Важное замечание: мы повысили реальные шумы дискретизации с 0.5МБ (-93 дБ) до 4МБ (-84 дБ), понизив слышимые шумы дискретизации с -93 дБ до примерно -110 дБ. Отношение сигнал/шум ухудшилось , но шум ушел в высокочастотную область и перестал быть слышимым, что дало существенное улучшение реального (воспринимаемого человеком) отношения сигнал/шум. Практически это уже уровень шумов дискретизации 20 битного звука. Единственное условие этой технологии - наличие частот для шума. 44.1 кГц звук дает возможность размещать шум в неслышимых на тихой громкости частотах 10-20 кГц. А вот если оцифровывать в 96 кГц - частотная область для шума (неслышимая человеком) будет настолько велика, что при использовании shaped dithering 16 бит реально превращаются и во все 24.

[На заметку: PC Speaker - однобитное устройство, с однако довольно высокой максимальной частотой дискретизации (включения/выключения этого единственного бита). С помощью процесса, сходного по сути с dithering-ом, называемым скорее широтно-импульсная модуляция, на нем игрался довольно качественный цифровой звук - из одного бита и высокой частоты дискретизации вытягивались 5-8 бит низкой частоты, а фильтром высокочастотного шума выступала неспособность аппаратуры воспроизводить столь высокие частоты, как впрочем и наша неспособность их слышать. Легкий высокочастотный свист, однако - слышимая часть этого шума - был слышен.]

Таким образом, shaped dithering позволяет существенно понизить и без того низкие шумы дискретизации 16 битного звука, спокойно расширив таким образом полезный (бесшумный) динамический диапазон на всю область человеческого слуха. Поскольку сейчас уже всегда при переводе из рабочего формата 32 бит в конечный 16 бит для CD используется shaped dithering - наши 16 бит совершенно достаточны для полной передачи звуковой картины.

Единственное что - эта технология действует только на последней стадии - подготовке материала к воспроизведению. Во время обработки качественного звука просто необходимо оставаться в 32х битах, чтобы не применять dithering после каждой операции, более качественно кодируя результаты обратно в 16 бит. Но если уровень шума фонограммы составляет более -60 дБ - можно без малейших зазрений совести вести всю обработку в 16 битах. Промежуточный dithering обеспечит отсутствие искажений округления, а добавленный им шум в сотни раз слабее уже имеющегося и поэтому совершенно безразличен.

Почему говорят, что 32-х битный звук качественнее 16 битного?
A1:	Ошибаются.
A2:	[Имеют в виду немного другое: при обработке или записи звука нужно использовать большее разрешение. Этим пользуются всегда . Но в звуке как в готовой продукции разрешение более 16 бит не требуется.]

Q:	Имеет ли смысл увеличивать частоту дискретизации (например до 48 кГц или до 96)?
A1:	Не имеет. При хоть сколь грамотном подходе в конструировании ЦАП 44 кГц передают весь необходимый частотный диапазон.
A2:	[Имеют в виду немного другое: это имеет смысл, но лишь при обработке или записи звука.]

Q:	Почему всё же идет внедрение больших частот и битности?
A1:	Прогрессу важно двигаться. Куда и зачем - уже не столь важно...
A2:	Многие процессы в этом случае происходят легче. Если, например, устройство собирается обработать звук - ему будет легче это сделать в 96 кГц / 32 бита. Почти все DSP используют 32 бита для обработки звука, и возможность забыть про преобразования - облегчение разработки и всё же небольшое увеличение качества. Да и вообще - звук для дальнейшей обработки имеет смысл хранить в большем разрешении, нежели 16 бит. Для hi-end устройств которые лишь воспроизводят звук это абсолютно безразлично.

Q:	32х или 24х или даже 18 битные ЦАП лучше чем 16 битные?
A:	В общем случае - нет . Качество преобразования нисколько не зависит от битности. В AC"97 кодеке (современная звуковая карта до $50) используется 18 битный кодек, а в картах за $500, звук которых с этой ерундой даже сравнивать нельзя - 16 битный. Это не имеет абсолютно никакого значения для воспроизведения 16 битного звука . Стоит также иметь в виду, что большинство ЦАПов обычно реально воспроизводят меньше бит, чем берутся. Например, реальный уровень шумов типичного дешевого кодека составляет -90 дБ, что составляет 15 бит, и даже если он сам 24х битный - вы не получите никакой отдачи от "лишних" 9 бит - результат их работы, даже если он имелся, потонет в их же собственном шуме. Большинство же дешевых устройств просто игнорируют дополнительные биты - они просто реально не идут в расчет в их процессе синтеза звука, хотя и поступают на цифровой вход ЦАПа.

Q:	А для записи?
A:	Для записи - лучше иметь АЦП большей разрядности. Опять же, большей реальной разрядности. Разрядность ЦАПа должна соответствовать уровню шумов исходной фонограммы, или просто быть достаточной для достижения желаемо низкого уровня шума . Также удобно бывает иметь разрядность с запасом, чтобы использовать повышенный динамический диапазон для менее точной регулировки уровня записи. Но помните - вы должны всегда попадать в реальный диапазон кодека. В реальности 32х битный АЦП, к примеру, почти полностью бессмысленнен , так как младший десяток бит будут просто непрерывно шуметь - настолько малого шума (под -200 дБ) просто не бывает в аналоговом музыкальном источнике.

Требовать от звука повышенной разрядности или частоты дискретизации, по сравнению с CD, лучшего качества - не стоит. 16 бит / 44 кГц, доведенные до предела с помощью shaped dithering, вполне способны полностью передать интересующую нас информацию, если дело не идет о процессе звукообработки. Не стоит тратить место на лишние данные готового материала, также как не стоит ожидать повышенного качества звука от DVD-Audio с его 96 кГц / 24 бит. При грамотном подходе при создании звука в формате стандартного CD мы будем иметь качество, которое просто не нуждается в дальнейшем улучшении, а ответственность за правильную звукозапись конечных данных давно взяли на себя разработанные алгоритмы и люди, умеющие правильно их использовать. В последние несколько лет вы уже не найдете нового диска без shaped dithering и других приемов доведения качества звукопередачи до предела. Да, ленивым или просто криворуким будет удобнее давать готовый материал в 32х битах и 96 кГц, но по идее - стоит ли это в несколько раз больших аудио данных?...

"Чистые тоны субъективно воспринимаются громкими или тихими в зависимости от силы (интенсивности) звука. Сила звука (обозначаемая обычно символом I ) связана со звуковым давлением квадратичной зависимостью.

Это значит, что изменение силы звука пропорционально соответствующему изменению величины звукового давления, возведенному в квадрат (I пропорционально р2). Так, рост звукового давления в 2 раза влечет увеличение силы звука в 4 раза, при росте звукового давления в 3 раза сила звука возрастает в 9 раз и т.д. Сила звука определяется потоком той звуковой энергии, которая при распространении в пространстве проходит ежесекундно через каждый квадратный метр плоскости, перпендикулярной к направлению распространения волны. Измеряют силу звука в Вт/м.

Человеческий слух по восприятию звуков разной силы ограничен. Человек начинает слышать при силе звука, превышающей или равной некоторой величине, называемой порогом слышимости (или слуховым порогом). Более слабые звуки слухового ощущения не вызывают. При увеличении силы звука достигается нормальная слышимость, а затем при еще больших амплитудах звуковых колебаний к воспринимаемому звуку добавляется осязаемое ощущение давления, и, наконец, при дальнейшем росте силы звука раздражение органа слуха становится болезненным.

Так называемый болевой порог ограничивает область Слышимости при больших уровнях интенсивности. Чувствительность человеческого уха зависит от частоты приходящего сигнала, поэтому уровень порога слышимости для разных частот различный.

При смешении из области оптимальной слышимости в сторону низких и высоких звуковых частот чувствительность человеческого уха резко падает. Это видно по поведению кривой порога слышимости вблизи краев диапазона слышимости. А вот болевой порог от частоты зависит слабо.

Звуковое давление, вызывающее у человека болевое ощущение, приблизительно равно 20 Па. На средних частотах звуковое давление, соответствующее болевому порогу, превышает порог слышимости примерно в миллион раз. Поскольку поток энергии звуковой волны с величиной звукового давления связан квадратичной зависимостью, то по силе звука у порога слышимости и болевого отличается в 1011 раз. Это отношение и определяет динамический диапазон слуха. При оценке динамического диапазона применяются специальные единицы измерения, не зависящие от способа вычисления.

Согласно психофизическому закону Вебера-Фехнера слух одинаково оценивает равные относительные изменения силы звука. Другими словами, изменение громкости кажется человеку одинаковым, если сила звука изменилась в одно и то же число раз (или на один и тот же процент относительно своей первоначальной величины), при этом восприятие не зависит от абсолютного уровня силы звука. Так двукратный рост уровня тихого и громкого звука воспринимаются одинаково, хотя абсолютные приращения звукового давления существенно различны.

Минимальное изменение интенсивности звука, воспринимаемое нашим ухом, соответствует изменению звукового давления примерно в 1,12 раза (т.е. на 12%), что соответствует изменению силы звука в 1,25 раза (т.е. на 25%).

Итак, наряду со способностью различать звуки, имеющие уровни, отличающиеся в сотни и тысячи миллионов раз, человеческое ухо хорошо реагирует и на очень малые изменения уровней. Это объясняется логарифмическим законом восприятия. Наши ощущения изменений громкости пропорциональны не изменениям силы звука, а логарифму этих величин.

L=C lg I 2 / I 1,

где

L - кажущееся изменение громкости,

I 1 , I 2 - сила звука соответственно до и после его изменения,

С- коэффициент пропорциональности.

Например, если сила звука изменится в 100 раз, то субъективное ощущение громкости изменится пропорционально 2 (т.к. lg100 = 2); если это изменение- 1000, то громкость возрастет в 3 раза (т.к. lg1000 = 3); рост силы звука в 10000 раз воспринимается как 4-кратное увеличение громкости. Поэтому принято измерять увеличение или уменьшение силы звука в специальных логарифмических единицах- "белах" (Б). Различие величин звуковой энергии (силы звука) в белах: N6 = lg I 2 / I 1 Б.

Иными словами, десятикратное изменение силы звука оценивается одним Белом. Например,

если I 2 = 10/ I 1 то lg I 2 / I 1 = lg10 = 1, т.е. N Б = 1 Б;

если I 2 = 100/ I 1 , то lg100 = 2 и N Б = 2 Б.

Мелкие изменения звуковых уровней измеряют в долях Бела. На практике в основном используется производная от Бела единица измерения, равная десятой части Бела, т.е. децибел (дБ).

Изменение уровня силы звука, выраженное в дБ, равно численному значению десятичного логарифма отношения сравниваемых уровней, умноженному на 10, т.е. N дБ = 10 lg I 2 / I 1 .

Обратимся к примерам.

Пусть N = I 2 / I 1 = 100 (I 2 > I 1 - усиление ), тогда N дБ = 10 lg100 = 10*2 = 20 дБ.

Пусть N = I 2 / I 1 = 1/100 (I 2 < I 1 - ослабление), тогда N дБ = 10 lg0,01 = 10·(-2) = -20 дБ.

Из этих примеров видно, что рост уровня выражается в децибелах положительным числом, а уменьшение - отрицательным.

Оценка изменений интенсивности звука в логарифмических единицах удобна еще и потому, что она дает возможность весь слышимый диапазон звуковых колебаний изобразить графически.

Громкостью называют субъективное качество, определяющее силу слухового ощущения, вызываемого звуком у слушателя. Громкость не может быть определена только величиной силы звука, так как она зависит от частотного состава звукового сигнала, от условий его восприятия и длительности воздействия. В акустике для количественной оценки громкости применяют метод субъективного сравнения измеряемого звука с эталонным, в качестве которого применяется синусоидальный тон частоты 1000 Гц. В процессе сравнения уровень эталонного тона изменяют до тех пор, пока эталонный и измеряемый звуки станут казаться равногромкими.

Как уже было сказано выше, чувствительность слуха зависит от частоты звукового сигнала. Порог слышимости, изображенный графически, представляет собой кривую, опускающуюся ниже всего в области частот 3000-4000 Гц и поднимающуюся к краям звукового диапазона. Из этой формы кривой следует, что для равногромкого ощущения интенсивность высоких и низких частот должна быть выше, чем средних.

Для практической работы важно помнить, что кривые равной громкости, как бы, выпрямляются с ростом общей громкости прослушивания. Другими словами, частотная зависимость слуха в большей степени сказывается при тихом прослушивании, чем при громком. Это важно учитывать, если, например, музыка, записанная при высоких уровнях громкости, будет прослушиваться тихо. В этом случае может возникнуть кажущееся изменение соотношений между частотными составляющими музыкального произведения. Так, при малой громкости прослушивания, из-за ослабления чувствительности слуха на низких и отчасти на высоких частотах звучание может казаться обедненным, лишенным сочности, естественности. Весьма желательно поэтому, чтобы в студиях звукозаписи громкоговорители работали с одинаковым уровнем громкости: это уменьшит возможность ошибок при субъективной оценке качества звучания.

Практически уровень громкости измеряется и настраивается в студиях при помощи специального электроакустического прибора – шумомера.

Примерные уровни громкости некоторых типичных звуковых источников приведены в таблице

Громкость зависит от условий, в которых звук воспринимается слушателем. Здесь, в первую очередь, следует учитывать эффект звуковой маскировки, напомнив, что в реальных условиях акустический сигнал не существует в условиях абсолютной тишины. Вместе с ним на слух воздействуют те или иные посторонние шумы, затрудняющие слуховое восприятие и, как в таких случаях говорят, маскирующие, в определенной степени, основной сигнал.

Так, при передаче оркестрового произведения из-за маскировки аккомпанементом может стать плохо разборчивой, невнятной партия солиста. Если одновременно существуют два сложных звуковых сигнала (например шум и музыка), возникает эффект взаимной маскировки. При этом, если основная энергия сигналов принадлежит к одной и той же области звуковых частот, то эффект взаимной маскировки будет наиболее сильным.

Речь в записи становится менее разборчивой не только из-за маскирования другими звуками, но и в результате самомаскировки при воспроизведении с громкостью большей, чем она звучит в природе. Этот недостаток в известной мере устраняется компрессированием. При воспроизведении скомпрессированной речевой фонограммы звук воспринимается достаточно громким, в то время как индикатор модуляции может показывать небольшие отклонения."- пишет Б.Я.Меерзон -"Акустические основы звукорежиссуры". Уч. изд. ГИТР

"В настоящее время существует огромное множество различных процессоров для динамической обработки звуковых сигналов - это различного рода компрессоры, гейты, экспандеры, левеллеры, лимитеры, и т.д. и т.п. В этом многообразии нетрудно и запутаться. Какой прибор необходим в конкретной ситуации?

Устройства динамической обработки сигналов применяются в двух случаях - либо в художественных целях, либо для получения более качественного звучания.

Заявляемые для распространённого сейчас носителя (CD) цифры - динамический диапазон в 96дБ - не совсем верны. То есть, если рассматривать их как отношение самого громкого сигнала к уровню шумов в паузе - цифры, безусловно, правильны. Однако это справедливо только для сигналов максимальной амплитуды. Динамический диапазон CD реально составляет величину, существенно меньшую, чем 96дБ.

Динамический же диапазон реальных сигналов может быть гораздо больше - например, для симфонического оркестра он может составлять до 120дБ! И как его “впихнуть” в ограниченный диапазон тракта?

Все устройства динамической обработки можно разделить на два больших класса - по характеру взаимосвязи их коэффициента усиления и уровня входного сигнала.

Если при увеличении уровня входного сигнала коэффициент передачи устройства уменьшается - то это компрессор и/или его разновидности. Такие, как лимитер, левеллер, “дакер”, и др.

Если же при увеличении входного сигнала коэффициент передачи устройства также увеличивается - то это экспандер или гейт.

Компрессор и его производные

Название компрессор происходит от английского глагола “to compress” - сжимать. Как следует из самого названия, компрессор - это устройство для сжатия, в данном конкретном случае - динамического диапазона исходного звукового сигнала.

Основными параметрами компрессии являются: степень компрессии “ratio”, порог срабатывания “threshold”, а также время срабатывания “attack” и время восстановления “release”. Первые две величины отражены на графике компрессии.

На этом рисунке по горизонтали отложено входное напряжение компрессора, выраженное для удобства в децибелах, по вертикали - выходное, а толстая линия - это проходная характеристика компрессора. На этом графике видно, что выходной сигнал - в точности равен входному, до точки срабатывания (начала работы) компрессора - THRESHOLD (порог срабатывания). Начиная с этой точки, выходной сигнал компрессора увеличивается в меньшей степени, чем входной, т.е. осуществляется компрессия. Мерой компрессии служит степень компрессии (RATIO).

Степень компрессии - это отношение величины приращения входного сигнала к величине вызванного им приращения выходного сигнала. (При этом - измеряемые величины должны быть выражены в децибелах!)

RATIO=dUвх(дБ)/dUвых(дБ)

Динамические характеристики компрессоров определяются временами срабатывания ATTACK и восстановления RELEASE.

Время срабатывания (ATTACK) - это промежуток времени между моментом, когда от источника подаётся скачок сигнала с уровнем на 6 дБ выше исходного, и моментом, когда выходной уровень достигает значения на 2 дБ выше установившегося значения выходного сигнала.

Время восстановления (RELEASE) - это промежуток времени между моментом, когда уровень сигнала источника уменьшается на 6 ДБ от исходного, и моментом, когда выходной уровень достигает значения на 2 дБ ниже его установившегося значения.

Естественно, что всё это должно происходить в области уровней входного сигнала, лежащих выше порога срабатывания!

По характеру реакции на входной сигнал все компрессоры можно разделить на две большие группы - с ручным управлением параметрами компрессии, и “автоматизированные”, с той или иной степенью автоматического управления этими параметрами.

В “ручных” - все динамические параметры задаются пользователем. Это обеспечивает очень большую свободу в их выборе, для получения тех или иных необходимых вам художественных результатов. Ведь не секрет, что компрессором можно изменить исходное звучание как угодно, хоть до “полной неузнаваемости”. Вот “ручной” компрессор - как раз и служит именно для этого, для специального преднамеренного изменения характера исходного звучания в нужную вам сторону. В зарубежной литературе этот тип компрессоров часто носит название CREATIVE - “творческий”, “созидательный”.

Соответственно, для их правильного использования - необходима достаточно высокая квалификация, а то ведь вместо улучшения звука можно его непоправимо испортить! Учтите: Перекомпрессированный сигнал исправить в дальнейшем невозможно!

В противоположность этому, в автоматизированных компрессорах - динамические параметры раз и навсегда установлены изготовителем, и их изменение пользователем невозможно. Хотя некоторые серьёзные производители, выпускающие действительно добротную продукцию, в ряде моделей предлагают пользователю на выбор несколько алгоритмов автоматизации, для различных вариантов обработки.

Как правило, большинство автоматизированных компрессоров не изменяют динамические параметры звука сколько-нибудь существенным образом, а только “выравнивают” исходное звучание, делают его более плотным и насыщенным.

Помимо основных, в некоторых моделях компрессоров имеются и некоторые дополнительные устройства, улучшающие их потребительские свойства.

Так, например, для уменьшения заметности момента включения компрессора в работу многие компрессоры имеют так называемый "мягкий порог" (Soft Threshold), обеспечивающий плавное вхождение в режим компрессии. На рисунке изображены проходные характеристики (зависимость уровня выходного сигнала от уровня входного) для двух компрессоров - обычного (ломаная линия 1) и компрессора с "мягким порогом" (кривая 2).

Как видно из рисунка, во втором случае по мере возрастания входного сигнала степень компрессии увеличивается плавно, а не включается скачкообразно, как в обычном компрессоре. Таким образом, удаётся сильно ослабить заметность начала компрессии, сделать этот момент практически неслышным.

Лимитер. В принципе, это не какой-то “отдельный вид” компрессоров, а всего лишь один из частных случаев работы компрессора. Лимитирование отличается от компрессирования, прежде всего степенью компрессии RATIO. Для лимитирования достаточно перевести этот регулятор в положение RATIO=бесконечность:1, при этом - независимо от приращения входного сигнала - уровень сигнала на его выходе увеличиваться не будет. (Естественно, что речь идёт о сигналах, лежащих выше порога срабатывания!) Но... Здесь есть одна тонкость.

Дело в том, что основное предназначение лимитера - защита последующих узлов тракта от перегрузок. Любых, даже малейших. При этом он должен на 100% не допускать превышения, установленного Вами выходного уровня, но абсолютно не трогать сигналы, лежащие ниже порога срабатывания. Отсюда - с неизбежностью следует вывод, что компрессоры с “мягким коленом” - принципиально непригодны для этих целей. Ведь для них само понятие “порога” имеет весьма расплывчатый смысл.

Лимитер, помимо большего RATIO, имеет и принципиально иные динамические характеристики. В самом деле - он должен очень быстро (в идеале - мгновенно!) “съесть” сигнал перегрузки, и столь же быстро вернуться к исходному состоянию. В автоматизированном компрессоре получить это - попросту невозможно.

Де-ессер, де-поппер.

Отличие де-ессера и де-поппера в том, что де-ессер работает на высокочастотных сигналах, убирая “цыканье” и шепелявость. Де-поппер - наоборот, работает в низкочастотной области спектра, убирая “пыханье” и бубнение. В остальном они принципиальных отличий не имеют. Главное отличие этих приборов от остальных устройств динамической обработки - это то, что порог срабатывания в них не фиксированный (ручкой управления THRESHOLD, как обычно), а “плавающий”. Что значит - плавающий? То, что он определяется разностью уровней обрабатываемой части спектра, с одной стороны, и всего остального - с другой стороны. Такое построение обеспечивает нормальное их функционирование, независимо от абсолютных уровней входных сигналов. Т.е. де-ессер постоянно анализирует спектр входного сигнала, и если “видит”, что уровень сигнала в установленной вами полосе превышает допустимое соотношение его и “всего остального”, то он уменьшает уровень сигналов в этой полосе до допустимой (установленной вами) величины.

Экспандер - это “компрессор наоборот”. Название - происходит от английского глагола “to expand” - расширять, растягивать. У него, как ранее уже отмечалось, коэффициент передачи пропорционален уровню входного сигнала, т.е. чем громче входной сигнал - тем громче выходной. Существуют две основных разновидности экспандера - “экспандер вверх” (Upward Expander) и “экспандер вниз” (Downward Expander).

Отличаются они по характеру реагирования на входной сигнал. “Экспандер вверх” - обрабатывает только сигналы, лежащие выше порога его срабатывания, делая громкие - более громкими. Тихие же сигналы, ниже порога срабатывания, он не трогает. В реальной практике почти не встречается, единственное исключение - гитарный бустер.

“Экспандер вниз” - наоборот, не трогает сигналы выше порога срабатывания, а только делает тише сигналы, лежащие ниже этого порога. В принципе, по характеру своего действия на сигнал - это устройство схоже с гейтом, и, как правило, применяется для аналогичных целей, для подавления слабых - но мешающих - сигналов. В этом качестве “экспандер вниз” входит составной частью практически во все шумоподавители (денойзеры).

Гейт - один из самых распространённых приборов динамической обработки. Его название происходит от английского слова “Gate” - клапан, ворота. Основное, “исходное” назначение гейта - отсечка сигналов малого уровня, для которых он и является своеобразным клапаном, не пропуская их на выход.

Динамика обработанного гейтом сигнала - будет отличаться от исходной. Сигналы, лежащие ниже порога срабатывания, будут полностью подавлены. У сигналов же выше порога - атаки будут зависеть от соотношения их исходной скорости и времени открывания гейта, т.е. результирующая - может быть как более “резкая”, так и более плавная. Аналогично - и с процессом затухания сигнала RELEASE. С той только разницей, что затухание исходного сигнала гейтом не удлинить. Можно только укоротить.

Именно это свойство гейта - менять динамику сигналов - как раз и является той главной причиной, по которой гейт получил столь широкое распространение."- написал М.Чернецкий. "Устройства динамической обработки сигналов ". "Звукорежиссёр"