Страница 5 из 9

Мозг слушает. Как создается осмысленный звуковой мир

Краус Нина

Рис. 1.7. Полный диапазон частот голоса и музыкальных инструментов. Слева показан диапазон основных частот, справа – диапазон гармоник.

До сих пор мы говорили о камертоне, отдельных музыкальных нотах и гласных – все это примеры звуков, устойчивых на протяжении какого-то времени. Однако существует группа звуков, для которых определяющей характеристикой является время – не в том смысле, когда начинается и заканчивается звук, как слог или музыкальная нота, а в том смысле, как и когда звук развивается во времени. К этой группе относятся согласные звуки. При произнесении некоторых согласных звуков временная развертка играет важнейшую роль.

Рис. 1.8. “Бил” превращается в “пил” за счет добавления паузы длительностью 1 /20 с до начала произнесения гласного звука (по оси x отложено время, по оси y – энергия).

Произнесите вслух слово “был”. А потом слово “жил”. Можете описать, чем различаются механические движения вашего рта? Это довольно просто. В первом случае ваши губы смыкаются, а язык занимает некую нейтральную позицию. Во втором случае губы слегка приоткрыты, а задняя часть языка прижата к небу. А теперь скажите “бил” и “пил”. Это сложнее. В чем тут разница? Механическая разница между произнесением “б” и “п” не так уж очевидна. Язык и губы в обоих случаях находятся фактически в одном и том же положении. Основное отличие заключается во временной развертке – когда вы начинаете произносить гласную, то есть когда голосовые складки начинают издавать звук “и”. Произнося слово “бил”, вы включаете голос почти сразу. Однако при произнесении слова “пил” между тем, как ваши губы раскрываются, и тем моментом, когда вы начинаете произносить гласный звук, имеется очень короткий промежуток времени. В верхней части рис. 1.8 изображена звуковая волна слова “бил”. В нижнюю волну я включила паузу длительностью 1/20 секунды. Все колебания двух линий идентичны, за исключением этой добавленной паузы. Небольшой паузы до начала произнесения “и” достаточно, чтобы вторая волна отчетливо звучала как “пил”. Различие во времени в несколько долей секунды создает значительное различие в речи. Это одна из многих причин, почему для обработки таких едва заметных изменений звука нам с вами требуется сверхбыстрый слуховой мозг.

Такие различия во временной развертке, как в “бил” и “пил”, хорошо видны на графиках временной зависимости типа изображенного на рис. 1.8. Различие в частоте, как в “и” и “у”, отражаются на спектрах, подобных тем, что представлены на рис. 1.6. Однако ни один из графиков не смог бы показать акустическое различие между звуками “б” и “г”. Здесь дело заключается в изменении частоты во времени. Чтобы правильно описать различие между “б” и “г”, нам нужен третий и последний график, называемый спектрограммой.

На верхней панели на рис. 1.9 представлен простой пример, изображающий звуковой тон, который со временем переходит от низкочастотного к высокочастотному и обратно, как в одобрительном свисте при виде чего-то впечатляющего. Вспомните звук сирены или представьте себе, что водите пальцем по клавиатуре фортепиано.

Различие между согласными в слогах “ба” и “га” определяется изменением частот полос акустической энергии во времени (нижняя панель). Верхняя полоса гармоник для “ба” и “га” одинаковая: она изменяется во времени от низкой до высокой частоты, пока не выравнивается на звуке “а”. Но на нижней полосе два слога различаются. В случае “ба” частота изменяется от низкой до высокой, а затем выравнивается. В случае “га” звук начинается на относительно более высокой частоте, а затем снижается. Частотная модуляция (ЧМ, или FM, от frequency modulation) – важная характеристика звука, которая отражает это изменение частоты во времени.

Рис. 1.9. Спектрограмма (график изменения частоты во времени). Вверху: частота увеличивается, затем уменьшается. Внизу: слоги “ба” и “га”. Частоты обеих волн акустической энергии изменяются со временем, пока не стабилизируются на гласном звуке “а”.

Таким образом, в обоих наших примерах с парами согласных звуков (“б”/“п” и “б”/“г”) временная развертка является важнейшим фактором, который необходимо учитывать. В случае слогов “ба” и “па” время является необходимым и достаточным элементом для выявления различия. В случае слогов “ба” и “га” различие определяется взаимодействием обоих факторов – времени и частоты. Хотя мы способны уловить и выделить эти звуковые различия, замедлив произнесение и произведя измерения, на практике они произносятся слишком быстро, чтобы мы могли осознанно воспринимать отличающие их параметры. Удивительно быстро. Подумайте об этом: знали ли вы о разнице между “ба” и “га” в контексте компонентов звука до того, как я вам об этом рассказала? Понимали ли вы, что пара мгновенных частотных модуляций может превратить “пегого дога” в “беглого бога”? Я совершенно определенно не могу определить на слух, что какая-то энергетическая полоса поднимается в “ба” и опускается в “га”. И эта скорость и тонкость объясняют сложность восприятия согласных звуков и требуют применения фонетического алфавита (Антон, Борис, Василий, Григорий…). Тонкость и сложность дифференцирования и трудности в восприятии этих звуков у некоторых людей имеют интересные последствия для речи и даже для чтения, как мы увидим далее.

При обсуждении временных параметров мы сконцентрировались на речи. И это не случайно. Речь функционирует в гораздо более быстрых рамках, чем другие звуки, включая музыку. Например, allegro – это музыкальный темп в диапазоне 120–170 ударов в минуту (уд/мин). Для простоты давайте рассмотрим музыкальную пьесу в темпе аллегро в ритме 150 уд/мин. Это соответствует двум с половиной ударам (четвертным нотам) в секунду. Так что каждая четвертная нота длится целых 400 миллисекунд (тысячных долей секунды), одна восьмая – 200 мс, а одна шестнадцатая – 100 мс. Пьеса “Полет шмеля” исполняется в еще более быстром темпе presto и интересна тем, что обычно для восприятия двух нот раздельно нам требуется целых 100 мс. Заставив шестнадцатые доли главной темы звучать по 80–85 мс, Римский-Корсаков превратил ноты в нечто напоминающее жужжание шмеля. Однако с речью совсем другая история. Согласные в обычной речи длятся так же коротко или еще короче – примерно от 20 до 40 мс. И мы можем почти бесконечно произносить речь, наполненную согласными звуками. К счастью для всех музыкантов, исполнявших “Полет шмеля”, эта пьеса короткая.

Интенсивность – это мера амплитуды изменений давления воздуха, которую мы воспринимаем как громкость: сколько воздуха сдвигает гитарная струна на рис. 1.1 и насколько высоки создаваемые ею волны, изображенные на рис. 1.3. В абсолютном измерении звук производит едва заметные изменения давления воздуха. Однако мы воспринимаем изменения давления в широчайшем диапазоне – от тишайших до самых громких звуков, различающихся по физическому давлению воздуха в десять триллионов раз. Поэтому, чтобы отобразить наше восприятие громкости звука с помощью каких-то удобных показателей, мы используем логарифмическую шкалу, переводя количество перемещенного воздуха в знакомые всем единицы интенсивности звука – децибелы (дБ). В результате диапазон в десять триллионов раз можно выразить в единицах от 0 дБ (это порог слышимости, ниже предела чувствительности самых чувствительных микрофонов) до 140 дБ – самого громкого звука, который мы в состоянии вынести.