Другой трудностью в использовании слов являются наши постоянные разговоры рядом с собаками, и с самими собаками, которые мы ничем не подкрепляем. Для собак очень трудно рассортировать значимые слова от общего шума, который мы производим. Но щелчок кликера сильно отличается от остальных звуков, поэтому его значение так кристально ясно для собак. Вы действительно увидите, насколько точно условно подкрепляемая собака реагирует на трещотку (она наэлектризована, гальванизирована, возбуждена), по сравнению с собакой натренированной на слово «Молодец». («Что? А…» Собака улыбнулась, помахала хвостом.)
Итак, я слышала дрессировщиков, которые говорили, что кликер хорош только для обучения трюкам, но ни для чего больше. Вы не сможете использовать его, к примеру, в ринге обидиенс. Конечно, нет, но он там вам и не нужен. Значимость кликера заключается в формировании нового поведения или уточнении деталей, он не нужен животному, которое уже обучено. Но даже для знаменитого чемпиона по рабочим соревнованиям кликер в качестве условного подкрепления может стать очень полезным инструментом.
Когда поведение уже закреплено, его не нужно постоянно подкреплять
Один участник состязаний рассказал мне, что он обучил свою суку добермана сигналу кликера, а затем использовал этот сигнал для подкрепления того, чтобы собака смотрела в лицо хозяина во время работы вместо того, чтобы смотреть в сторону.
«Это выглядело, как будто она была признательна за информацию, потому что для неё все прояснилось», — сказал он. Конечно, когда собака начинает понимать, чего же от неё хотят, она будет делать это правильно и на ринге безо всякого кликера.
Не следует, однако, думать, что люди никогда не использовали условного подкрепления на ринге. Все дрессировщики делали это, чтобы закрепить в сознании собаки сигнал, который больше никто, кроме неё, не поймёт. Я знаю одного очень способного дрессировщика на послушание, использовавшего едва слышное фырканье как условное подкрепление. Я видела похвалу одной из участниц соревнований: «Хорошая работа!» (она тут же отразилась великим наслаждением на морде её собаки), которая была передана прикосновением пальца хозяйки к голове собаки. Я знаю, что одна участница соревнований научила свою собаку Рекса, что лакомства называются «Билли». Затем, когда собака все выполняла на ринге, она подкрепляла особенно хорошее поведение, например точное возвращение, что выглядело в виде команды: «Билли, рядом!» И всем казалось, что она использует обычное имя своей собаки.
Еда, еда, еда! Собака наслаждается, но общее впечатление отвратительное.
Насколько приятнее смотреть на собаку, которой щёлкнули, чтобы она приняла нужную стойку, ведь она знает, что её наградят позднее.
Когда собака обучена каким-то действиям, условное подкрепление позволяет не только отсрочить награду пищей, не теряя при этом совершенства исполнения, но и давать вообще меньше лакомства. Вам не следует волноваться, что ваше животное успеет насытиться ещё до конца работы. Один пример: на собачьих выставках я часто замечала хендлеров, которые раз за разом подкармливали собак, давали им пищу, чтобы получить наиболее совершенную выставочную стойку или напряжённое выражение. И когда бы я не наблюдала, как в собачью пасть падает все новая и новая пища, всякий раз я знала, что хозяин этой собаки не имеет ни малейшего представления об условном подкреплении! Намного эффективнее приучить животное к нужной позе, развить понимание словесного указания, а затем подкрепить собаку щелчком за то, что она сохраняла нужную стойку соответствующее время. Награда пищей последует потом, вне ринга или когда эксперт уйдёт.
Сила условного подкрепления заключается в его действии — оно передаёт информацию и влияет на поведение животного, причём во всех ситуациях, когда обычное подкрепление нежелательно или невозможно. Подумайте, к примеру, насколько было бы полезно условное подкрепление для обучения розыскных собак, ездовых, сторожевых, поводырей, разыскивающих птиц и приносящих убитую дичь и для формирования любого поведения собак, когда требуется, чтобы животное работало далеко от вас.
Контроль плохого поведения при помощи положительного подкрепления вместо «коррекции» может показаться бесперспективным занятием, но дрессировщики дельфинов знают множество способов, как это делать. Мы предлагаем три примера.
Это не будет сигналом, означающим «Я собираюсь тебя ударить», но это будет сигнал «Нет, я не буду тебя подкреплять». Оно говорит животному, что ряд его действий не будет оплачен. Например, вы можете просто повернуться спиной к своей собаке. Животное быстро поймёт, что, увидев этот «красный свет» или «плохой» сигнал, оно должно изменить своё поведение. Вы сможете использовать этот сигнал, чтобы, к примеру, отучить собаку прыгать на вас приветствуя, а вместо этого спокойно стоять — тогда её подкрепят лаской.
Если ваша собака ведёт себя плохо, например прыгает на вас, вы должны чётко объяснить ей, что такое поведение подкрепляться не будет.
Однако когда собака твёрдо стоит на земле, её нужно подкрепить.
В нашем шоу в Морском парке один дельфин просто изводил одну из девушек, выступавших в том же шоу. Прежде чем дать пловчихе водяной пистолет (или разрешить другое наказание), мы обучили дельфина давить на рычаг, торчащий над водой по свистку или за рыбу, и каждый раз, когда девушка оказывалась в воде, мы просили его давить на этот рычаг. Дельфин не мог одновременно давить на рычаг и преследовать пловчиху, эти действия были несовместимы (тем более что давление на рычаг всегда подкреплялось, поэтому прекратилось преследование пловчихи). Вы можете использовать эту технику для приучения собаки лежать в гостиной во время вашего обеда, тогда она не будет попрошайничать у вашего стола.
Иногда дельфин делает что-то действительно плохое, например проявляет агрессию (бьёт головой или зубами по руке дрессировщика). Когда такое происходит, нужно сразу же повернуться к нему спиной, забрать свои принадлежности и ведро с рыбой и уйти на целую минуту. Дельфин сразу же высовывает голову из воды и смотрит с недоумением: «Эй, что я такого сделал?» После нескольких повторений он учится думать о своих действиях. Собачий эквивалент может быть таким же: уберите лакомство и кликер — и конец всем развлечениям.
Дрессировщики в океанариуме успешно используют тайм-ауты для борьбы с агрессией, направленной на людей-пловцов, даже у таких высокодоминантных животных, как взрослые самцы-касатки. Но эта техника может приносить страдания животным, поэтому использовать её нужно осторожно.
Использование подкрепления составляет большую часть работы дрессировщика, поэтому оно заставляет вас думать. Но что за головная боль! Намного легче следовать таким простым правилам: если сделала кучу, ткните её носом, если собака не идёт рядом, дёрните поводок. Однако обдумав то, что вы собираетесь подкрепить, вы станете намного более искусным дрессировщиком. Но для совершенного выбора момента для подкрепления вам нужно сосредоточиться, тогда дрессировка станет очень волнующим, а не скучным занятием.