Добавить в цитаты Настройки чтения

Страница 8 из 12



Есть ещё вариант: нет ни наказания, ни поощрения — этот случай сам по себе эмоционально не окрашен, всё зависит от контекста. В одном случае бездействие дрессировщика воспринимается собакой как поощрение, в другом — как наказание. Например, собака, уже наученная идти «рядом», стремясь на прогулку, натягивает поводок. Дрессировщик не реагирует. Тем самым такое поведение закрепляется. Противоположный пример: собака лает, требуя у дрессировщика лакомство. Дрессировщик не реагирует. Такое поведение постепенно исчезает.

Обобщая, можно сказать: что бы ни делал дрессировщик во время дрессировки, его поведение можно описать одним из пяти вышеперечисленных вариантов. И все они для собаки эмоционально окрашены, все воздействуют на её поведение. Вывод о необходимости тщательного анализа и планирования выполнения дрессировочных приёмов предоставляю сделать читателю.

Длительность поощрения и наказания, их временная продолжительность могут вызвать проблемы во время дрессировки. Например: дрессировщик тренирует посадку собаки. В ответ на то или иное воздействие дрессировщика собака садится. Дрессировщик поощряет посадку лакомством. Но даже маленький кусочек сыра собака, как правило, не глотает целиком. Какое-то время, пусть непродолжительное, собака разжёвывает лакомство — и за это время успевает встать! Что, собственно говоря, поощрено в этом случае? Тот же пример — дрессировщик поощрил лакомством посадку собаки. Собака продолжает сидеть. Дрессировщик считает, что начало выработке навыка положено. Но через какое-то количество повторений приёма собака начинает вставать, после того как съест лакомство. Поведение «посадка» закреплялось началом поощрения — лакомства, и в то же время поведение «сидение на месте» угашалось окончанием поощрения — лакомства.

Как было бы хорошо, если бы существовало моментальное, не имеющее протяжённости во времени поощрение! Во-первых, точное совпадение во времени с подкрепляемым поведением перестало бы быть проблемой (а такая проблема, и очень серьёзная есть — это подтвердит любой дрессировщик). Во-вторых, не имея протяжённости во времени, такое поощрение имело бы только значение начала поощрения, то есть, значение, вызывающее положительную эмоцию, и не имело бы значения отмены поощрения, вызывающего отрицательную эмоцию.

В действительности все не так, как на самом деле.



Оказывается, такое поощрение существует. Это условное поощрение, — условный раздражитель, которому с помощью образования условного рефлекса, придано значение поощрения. Более того, поскольку это условное поощрение представляет собой короткий (значительно более краткий чем то поощрение, на которое он вырабатывался) сигнал, оказалось возможным придать ему значение начала поощрения. (Слукавил я, выходит, когда в полемическом задоре убеждал читателей, что условные рефлексы практически не используются в дрессировке. Ещё как используются, — для выработки условных подкреплений.). Итак, условные рефлексы используются в дрессировке активно, — для того чтобы связать произвольный и первоначально индифферентный (ничего не значащий) для собаки стимул с положительной или отрицательной эмоцией, превратив его тем самым в условное подкрепление. Англоязычные дрессировщики называют условное подкрепление специально связанное с тем или иным безусловным «бридж-сигнал», то есть сигнал-мостик. Название, весьма точно отражающее содержание понятия. На понятии условного подкрепления мы остановимся поподробнее, проиллюстрировав его примером из кликер-тренинга, одной из методик оперантной дрессировки (мотивированной дрессировки, обуславливания операнта, кондиционирования операнта и т. д., терминам несть числа). В начале дрессировки тренеры, применяющие кликер (это такая маленькая, щёлкающая при нажатии коробочка) проводят так называемую «презентацию кликера». Основой такой презентации может быть начало любого безусловного поощрения, например игры с апортиком или кормления, выдача лакомства. Дрессировщик щёлкает кликером и тут же даёт собаке лакомство (бросает апортик). И так 30—40 раз. В конце занятия вы заметите: услышав щелчок, собака активно ищет награду. Следующее занятие нужно проводить в другое время дня и в другой обстановке. Задача состоит в том, чтобы собака твёрдо усвоила: щелчок кликера, а не какая-либо обстановка или время суток, предвосхищает награду. Точно так же можно «представить» и свисток и просто короткое слово. Более того, слово в качестве условного подкрепления имеет то преимущество, что обладает интонацией. А тон (высота звука) для собаки является релизером, то есть врождённо понятным сигналом. Высокий (но не на уровне визга) тон — положительная эмоция, так мать поощряет щенков, низкий тон — отрицательная эмоция, угроза. Таким образом, слово — подкрепление условное, но, частично и безусловное (имеет безусловную компоненту). Все дрессировщики этим интуитивно, по аналогии с человеческим общением, или осознано пользуются в той или иной мере.

Точно так же, с помощью образования условного рефлекса, можно связать с каким-нибудь сигналом (словом) и начало наказания (пример: команда «Фу»), и окончание наказания, и окончание поощрения, и даже ситуацию «ничего не происходит», в значении «следует продолжать попытки». С этим значением слова «ищи» мы столкнёмся в ближайшем будущем при изучении этапов дрессировки собаки-детектора.

Кликер-дрессировщики в своей практике избегают прямых наказаний, предпочитая им отмену поощрений или непредоставление поощрений. Они справедливо утверждают, что как только собака понимает суть метода: отказ в поощрении мотивирует её, чтобы пробовать кое-что еще, она охотно экспериментирует с новым поведением. Однако, если неправильный выбор наказан, собака, из-за страха получения нового наказания, может начать сомневаться, стоит ли предлагать другое поведение. «Игнорируйте нежелательное поведение в максимально возможной степени. Каждый раз, когда Вы укрепляете желательное поведение, это походит на добавление денег к счету в банке. Чем больше денег на счету, тем более сильны отношения с вашей собакой. Положительное наказание — даже если оно эффективно — удаляет деньги из этого счета в банке, и это ослабляет отношения.