К книге
Руководство по поведенческой медицине собак и кошекРоль семьи в поведенческой терапии. Ж. Деасс (Joel Dehasse). Методы обучения, дрессировки и модификации поведения
25%
Роль семьи в поведенческой терапии. Ж. Деасс (Joel Dehasse). Методы обучения, дрессировки и модификации поведения
10

Д. Миллс (Daniel S. Mills)

Поведение развивается на протяжении всей жизни в результате взаимодействия генетических факторов и окружающей среды. Генотип в принципе неизменен, но существует возможность управлять раздражителями (совокупность которых и представляет окружающую среду) и тем самым изменять поведение индивида в пределах его генотипа. Подобное управление предполагает изменение либо внутренней среды субъекта (физиологическое вмешательство), либо внешней (вмешательство в окружающую среду).

• Обучение - это изменение поведенческого потенциала животного в результате опыта, приобретенного под воздействием окружающей среды.

• Дрессировка описывает методы, применяемые человеком для обучения животного в предсказуемом направлении.

Методы модификации поведения

Для модификации психических процессов животного (например, его восприятия окружающей среды), которые впоследствии повлияют на его поведение в конкретной ситуации, был заимствован ряд методик, применяемых в психотерапии человека. Их часто называют методами модификации поведения для того, чтобы отличать от методов дрессировки, которые обычно направлены на выработку послушания.

Оценка роли обучения в контроле поведенческих проблем_

Обучение не всегда является предпосылкой поведенческих изменений, поскольку ассоциации могут формироваться и без явных перемен в поведении, но обычно именно перемены в поведении позволяют установить, что обучение произошло. При наличии поведенческих проблем объективные параметры изменения поведения можно использовать для оценки того:

• как обучение сказалось на развитии проблемы;

• насколько эффективна поведенческая терапия.

Основные параметры изменения поведения приведены на фиг. 5.1.

Знание теории обучения и умение применять эти знания на практике крайне важны для диагностики и лечения поведенческих расстройств у животных-компаньонов. Например, при составлении анамнеза важно охарактеризовать нежелательное поведение, начиная с первых его проявлений, по каждому из параметров, приведенных на фиг.5.1, а затем оценить и причины произошедших изменений, потому что от этих оценок зависит выбор метода терапии.

• Если нежелательное поведение можно с уверенностью объяснить приобретенным стереотипом, то прогноз поведенческой терапии будет, как правило, положительным.

• Если приобретенный стереотип не объясняет всех аспектов изменения поведения, говорят о влиянии внутренних физиологических факторов. В этой ситуации для решения проблемы потребуется медикаментозное или хирургическое вмешательство.

Скрытое обучение

Тщательное изучение анамнеза позволяет выявить роль скрытого (латентного) обучения в возникновении проблемы. Во время скрытого обучения животное получает информацию, которая не вызывает немедленных перемен в поведении, но может повлиять на него в последующем.

Например, когда животное исследует нейтральную (без положительных или отрицательных стимулов) окружающую среду, оно знакомится с планировкой территории, что в дальнейшем поможет ему быстрее сориентироваться, где на этой территории его ждет вознаграждение, а где — наказание.

Подражание

Социальное обучение, или подражание, при котором животное учится, наблюдая за поведением другой особи в аналогичной ситуации, тоже рассматривают как форму скрытого обучения; оно является значимым фактором, влияющим на поведение кошек и собак, особенно в раннем возрасте (см. гл. 2 и 3). Приобретенный таким образом опыт сказывается на поведении животного в дальнейшем, что не противоречит основным законам процесса обучения.

Окружающая среда

Термином “обучение” обозначают целый ряд механизмов, посредством которых взаимодействие с окружающей средой приводит к долгосрочным изменениям поведения. Окружающая среда влияет на проявления любых поведенческих отклонений, но это не означает, что она является их первопричиной или ее изменение служит главным средством решения всех поведенческих проблем. Ветеринарный врач должен на основе индивидуального подхода оценивать роль различных факторов, способных повлиять на поведение, и принимать решение об использовании медицинского или этоло-гического вмешательства (см. гл. 7).

Ассоциативное обучение (формирование условных рефлексов)

Термин “ассоциативное” используется для определения тех форм обучения, при которых субъект должен построить ассоциацию между двумя объектами или событиями (фиг. 5.2).

Совпадение во времени и взаимозависимость событий

Совпадение во времени и взаимозависимость— это главные факторы, определяющие формирование ассоциации между любыми двумя событиями.

• Совпадение во времени означает взаимосвязь между двумя событиями во времени и пространстве. Если события происходят одновременно или следуют непосредственно друг за другом, ассоциативная связь между ними устанавливается легче.

• Взаимозависимость - это предсказуемость такой взаимосвязи двух событий. Высоко предсказуемые ассоциации усваиваются легче.

Два новых события, совпадающие по времени, воспринимаются как взаимозависимые, хотя в принципе такая ассоциация устанавливается не всегда. Это можно проиллюстрировать следующим примером. Собака идет вдоль дороги, как вдруг раздается звук выстрела и в этот же момент появляется мотоцикл. От того, установится ли у животного взаимосвязь между этими событиями, зависит в будущем его поведение по отношению к мотоциклам.

• Если раньше собака не раз видела мотоцикл и встречи с ним не сопровождались подобным звуком, то взаимозависимость мотоцикла и звука выстрела будет для нее низкой. Поэтому в дальнейшем животное вряд ли станет избегать мотоциклов; иное наблюдается в случае, если собака встречается с мотоциклом впервые.

• Если выстрел прозвучал настолько громко, что животное сильно испугалось, скорее всего, сформируется ассоциация между звуком выстрела и совпадающим по времени событием, даже если они не следуют непосредственно друг за другом. Это может быть мотоцикл, проехавший 5 минутами позже, если встреча с ним произошла впервые.

Воспринимаемая значимость

Пример с мотоциклом можно далее расширить иллюстрацией другого важного фактора, определяющего усвоение новой реакции, — значимости этого поведения для субъекта. Возможно, в будущем собака будет обходить данное место, даже если раньше она много раз там проходила, потому что теперь у нее имеется негативный опыт (испуг), связанный с этим местом. Изменение поведения возникает как результат анализа “выгоды и риска”, следующего за опытом, и это справедливо для любого приобретенного опыта.

Модификация поведения сводится к такому управлению ситуацией, которое заставило бы животное в результате анализа приобретенного им опыта выбрать и в дальнейшем воспроизводить желательную модель поведения. Этого можно достигнуть двумя путями:

• снижением воспринимаемого животным риска, связанного с поощряемым поведением; или

• усилением неприятных ощущений от нежелательного поведения.

Очень часто хозяин старается главным образом не допустить нежелательное поведение животного вместо того, чтоб уделять основное внимание поощрению того поведения, которого он хочет добиться. Вероятно, он достиг бы своих целей намного быстрее, если бы в первую очередь обучил своего четвероногого друга правильно вести себя в той или иной ситуации.

Респондентное и оперантное поведение

При описании механизмов обучения, приводящих к формированию ассоциаций, обычно различают респондентное и оперантное поведение.

Респондентное поведение

Проявления респондентного поведения, по-видимому, связаны с некоторыми раздражителями (стимулами), вызывающими врожденный (безусловный) рефлекс типа слюноотделения в ответ на пищу. Животное может научиться ассоциировать новые раздражители с рефлекторными врожденными реакциями посредством процесса, который обычно называется “выработкой классического (Павловского) условного рефлекса”. При этом необходимо наличие двух раздражителей: индифферентного, который в дальнейшем становится условным, и безусловного.

• Раздражитель, вызывающий рефлекторную реакцию (безусловный ответ, БУО), называют безусловным раздражителем (БУР).

• Новый раздражитель, ассоциируемый с данным БУО, называют условным раздражителем (УР).

В результате формирования ассоциации условный раздражитель рано или поздно начинает вызывать условный ответ (УО), подобный безусловному, даже в отсутствии безусловного раздражителя. Пример, приведенный на фиг. 5.3, показывает, что взаимозависимость условного и безусловного раздражителей устанавливается быстрее, если первый (УР) предшествует второму (БУР), а прочная временная ассоциация формируется при тесной связи этих двух раздражителей во времени.

Посредством выработки классического условного рефлекса животное усваивает, что можно убежать при виде ветеринарного врача (условный раздражитель):

1. Первый визит:

Боль ■* Попытка убежать

(БУР) ^ (БУО)

Ветеринар + Боль ^ Попытка убежать

(УР) + (БУР) -> (БУО)

2. Повторные визиты:

Ветеринар ■* Попытка убежать (УР) (УО)

3. Возможна выработка оперантного условного рефлекса:

Попытка убежать Избавление от боли

(Оперантное поведение) * (Отрицательное

подкрепление)

4. Повышается вероятность закрепления подобного поведения (попыток убежать) в аналогичных ситуациях в будущем.

Фиг. 5.3. Пример взаимодействия между классическим и оперантным условными рефлексами, которое часто происходит в подобной ситуации

Быстрее всего обучение идет в том случае, если УР не только предшествует БУР (боли), но и совпадает с ним по времени. Если БУО (попытка убежать) успешна, выработка оперантного условного рефлекса (см. ниже) проходит эффективно, поскольку бегство обеспечивает отрицательное подкрепление посредством избавления от боли, что делает эту реакцию более вероятной в будущем. Далее выработка классического условного рефлекса может привести к тому, что животное будет улавливать признаки предстоящей поездки к ветеринарному врачу, которые сами по себе будут указывать на боль и приведут к поведению избегания еще до того, как животное увидит ветеринара. Хозяева часто рассказывают о подобном поведении своих питомцев (“Он, казалось, знал, что идет к вам”), но это может быть просто усвоенная ассоциация с корзиной, которой пользуются только для транспортировки животного в клинику.

Оперантное поведение

Данное поведение определяется теми последствиями, к которым оно привело во внешней среде (обучение методом проб и ошибок), и формируется посредством процесса, известного как выработка оперантного (Скиннеровс-кого) условного рефлекса. Ряд терминов, используемых в описании этой формы обучения, часто вызывают недоразумения. Эти термины представлены на фиг. 5.4.

• Оперантный условный рефлекс определяется как ответная реакция, приводящая к желательному эффекту и поэтому закрепляющаяся в виде рефлекса,

• Если вероятность формирования рефлекса в результате подкрепления повышается, такое подкрепление называют аппетентным, т.е. основанным на удовлетворении инстинктивных потребностей животного; если вероятность формирования рефлекса снижается под воздействием подкрепления, то говорят об аверсив-ном, т.е. основанном на формировании отвращения, подкреплении (Mackintosh, 1974). Это позволяет широко использовать термин “подкрепление”.

• В более узком смысле термин “подкрепление” относится только к аппетентному подкреплению, а для аверсивного подкрепления используется термин

“наказаниея.

• Такие характеристики подкрепления, как “положительное” и “отрицательное”, не отражают вероятность изменения поведения в результате подкрепления (т.е. положительное подкрепление не является синонимом аппетентного подкрепления, а отрицательное подкрепление - не синоним наказания); они описывают лишь сам акт подкрепления (Ueberman, 1993):

- положительное аппетентное подкрепление предусматривает получение чего-либо, например лакомства, или наличие других стимулов для закрепления поведенческой реакции (положительное действие);

- отрицательное аппетентное подкрепление предусматривает устранение чего-либо неприятного, например пугающего раздражителя, с тем, чтобы закрепить поведенческую реакцию (отрицательное действие).

• Термины “положительное” и “отрицательное” наказание могут использоваться для описания чего-либо, что уменьшает вероятность повторного проявления поведения в аналогичных обстоятельствах. Например:

- положительное наказание может предусматривать физическое наказание или устный выговор;

- отрицательное наказание может предусматривать лишение чего-либо приятного (прекращение игры, если животное перевозбуждается).

Фиг.5-4. Уточнение некоторых основных терминов

Подкрепление_

Очень часто неудачи в дрессировке объясняются разницей между предполагаемым и фактическим подкреплением. Подкрепление определяется тем, каков его результат, а не предполагаемой его функцией.

Чаще всего источником приобретенных поведенческих проблем является неумышленное подкрепление (на действие которого субъект, как правило, не обращает внимание). Например, если строго прикрикнуть на собаку, поскуливающую для привлечения внимания, это станет положительным подкреплением, усиливающим данное поведение, поскольку одного аспекта желанной цели (т.е. вербального внимания) животное достигает. Точно так же, если отпустить собаку, которая вырывается, чтобы избежать осмотра в ветеринарной клинике, это усилит данное поведение в результате отрицательного подкрепления.

Эмоции

Эмоции определяют как состояния, формируемые оперантными подкрепляющими раздражителями (Rolls, 1999). Для объяснения факторов, которые обусловливают характер поведенческих реакций, необходимо понимать взаимосвязь эмоций с конкретными механизмами подкрепления.

Положительное аппетентное подкрепление

При положительном подкреплении воздействие раздражителя увеличивает вероятность проявления аналогичной поведенческой реакции в дальнейшем. Эмоционально это связано с удовлетворением, полученным в ответ на целенаправленное поведение. В результате поведенческая реакция, сформированная при помощи положительного аппетентного подкрепления, будет зависеть от ситуации, в которой она закрепилась.

Типы поощрения

Обычно применяются четыре типа поощрения: пища, виды активности, обладание и социальное подкрепление. Следует учитывать потенциальную ценность каждого из них для конкретного животного.

• Пища (лакомство) — форма подкрепления, наиболее широко применяемая в традиционной дрессировке животных.

• Различные виды активности (например, прогулки или игры) используются для подкрепления более редких форм поведения. Животному позволяют заняться каким-либо контролируемым видом активности (например, грызть что-либо или играть), для чего дают ему соответствующую игрушку.

• Обладание само по себе может служить подкреплением, даже если животное, по всей видимости, не использует полюбившийся предмет (скажем, игрушку) в каких-либо иных целях. Обладание является, по-видимому, особенно эффективной формой подкрепления для многих пород охотничьих собак.

• Социальное подкрепление (внимание, одобрение) имеет место при самых разных видах активности, от совместной игры и физического контакта до устного подбадривания и зрительного контакта.

Набор подкрепляющих факторов можно установить, определив, какие лакомства, виды активности, игрушки, социальные взаимодействия и каких компаньонов предпочитает пациент. Затем оценивают их значимость для животного (если необходимо, путем испытания) для того, чтобы построить иерархию подкрепляющих факторов (от наиболее ценимых животным, до тех, которые оно ценит меньше всего). Эта иерархическая шкала вполне пригодна для использования в любой последующей программе дрессировки.

Использование положительного подкрепления

Чтобы успешно осуществлять положительное подкрепление в программе дрессировки, следует придерживаться ряда правил.

• Выбрать наиболее предпочтительную форму подкрепления.

• Установить правила, которым предстоит следовать.

• Проследить за тем, чтобы доступ к формам подкрепления, применяемым в дрессировке, в остальное время был ограничен.

• Проследить за тем, чтобы подкрепление происходило в нужное время и в нужном месте с учетом требуемого конечного результата.

• С самого начала выстроить ситуацию таким образом, чтобы свести риск неудачи к минимуму.

Выбор адекватного подкрепления. В силу своих природных особенностей животные формируют одни ассоциации легче, чем другие. Поэтому для каждой поведенческой реакции следует, по возможности, использовать биологически уместные формы подкрепления. Например, если на занятиях разрешить щенкам бегать и играть после того, как они выполнят команду “Ко мне!”, это позволит сочетать социальное вознаграждение (игру) с данной командой; в противном случае эта команда будет восприниматься как сигнал к прекращению активности, что само по себе может создать трудности.

Установление правил. Сюда относится четкое и конкретное определение того момента, когда должно проводиться подкрепление. Предположим, нужно отучить собаку от попыток привлечь к себе внимание. Следует сказать хозяину, чтобы он поощрял ее, когда она спокойно сидит у его ног. Тогда контролировать ход дрессировки будет легче, чем в тех случаях, когда владельца инструктируют в общих словах. Оговаривая конкретное время для поощрения животного, вы тем самым помогаете владельцу сконцентрироваться на выполнении каждого шага. Это особенно важно на ранних этапах выполнения программы. Для отслеживания прогресса рекомендуется специальная дрессировка (успех оценивают по способности животного спокойно лежать в течение определенного времени). Правила могут быть изменены по мере разрешения проблемы (т.е. увеличения продолжительности выдержки, что можно рассматривать как успех).

Ограничение доступа к подкрепляющим факторам. Если проследить за тем, чтобы доступ к факторам подкрепления, используемым в дрессировке, в остальное время был ограничен, можно предотвратить перенасыщение и тем самым продлить и усилить эффект выбранного способа подкрепления. По этой причине не следует предоставлять животным свободный доступ к их игрушкам или еде, используемым как средства подкрепления.

Время и место. Легче всего формируется ассоциация между непосредственно следующими друг за другом действиями; поэтому важно проследить, чтобы подкрепление происходило сразу же, как только достигнута желательная реакция, а животное не успело сделать ничего прежде, чем эта желательная реакция была подкреплена. Например, если отрабатывается команда “Сидеть!”, а для получения лакомства за ее выполнение животному приходиться вставать, то в действительности на команду “Сидеть!” закрепляется ответная реакция “Сидеть, встать!”. Трудно выбрать точный момент поощрения, и здесь может помочь вторичный подкрепляющий фактор, например прищелкивание языком (см. ниже, раздел о вспомогательных средствах дрессировки). Первоначально реакция на команду будет ассоциироваться с конкретным местом, поэтому владельцу следует дрессировать животное в разных местах, если он хочет, чтобы ответная реакция была генерализованной, а не ограниченной конкретным местом.

Сведение риска неудачи к минимуму. Первоначальную дрессировку следует проводить в отсутствие отвлекающих раздражителей, например дома поздно вечером. При обучении питомца выполнению команд (например, “Сидеть!” и “Лежать!”) ему показывают лакомство, чтобы вызвать у него побуждение проявить желательную реакцию. Кошек можно научить пользоваться столбиком для царапанья, если играть с ними, передвигая игрушку вверх по столбику. В дальнейшем, когда животное прикасается лапками к столбику, ему дают лакомство.

Отрицательное аппетентное подкрепление

Отрицательное подкрепление представляет собой процесс, посредством которого удаление раздражителя увеличивает вероятность проявления поведенческой реакции в дальнейшем.

Этот процесс связан с эмоциями (облегчением), вызванными успешным спасением от потенциально опасных ситуаций. Поэтому и природа поведенческих реакций, усваиваемых подобным образом, несколько иная, чем в случае положительного подкрепления. Здесь животное не может добиться желаемого другими путями, в силу чего ответные реакции закрепляются намного прочнее. Они вызывают в головном мозге такие же химические процессы, как при формировании психической зависимости, а потому выработать реакцию альтернативную той, которая была усвоена подобным образом, становится значительно труднее.

Следовательно, прогноз коррекции поведения животного, убегающего из сада, будет различным для случаев, когда эта реакция появилась в момент сильного испуга или когда животное обнаружило ту же лазейку, обследуя сад из чистого любопытства. Страдающие фобиями питомцы, которых обеспокоенные хозяева оберегают и лелеют, являются особенно трудными пациентами, потому что у этих животных вырабатывается постоянная потребность в подобном комфорте (см. гл. 15 и 18).

Наказание

Положительное наказание

Положительное наказание должно сформировать у животного отвращение к демонстрируемой им форме поведения, и для этого у него провоцируют эмоцию страха посредством аверсивного раздражителя. Страх, связанный с положительным наказанием, может привести к оборонительной агрессии, поэтому данный метод противопоказан в тех случаях, когда животное трусливо, страдает повышенной тревожностью или не имеет возможности убежать.

Наказание не обеспечивает подкрепления желательного поведения; не имеет смысла сосредоточиваться на наказании, чтобы обучить животное определенному поведению,— это неэффективно. Применение наказания сопряжено со многими трудностями, поэтому оно часто употребляется неправильно.

Чтобы наказание было эффективным, оно должно отвечать одному из следующих критериев:

• наказание должно быть настолько сильным, чтобы страх перед ним быстро подавлял будущие попытки воспроизвести данную поведенческую реакцию; или

• в случаях нежелательного поведения наказание должно применяться настолько часто, чтобы, в конечном счете, питомец понял, что цена наказания за данное поведение перевешивает любую потенциальную выгоду от него.

Если владелец наказывает животное (используя положительное наказание) за то, что питомец натворил и при нем и в его отсутствие, то он рискует сформировать отвращение не к данному поведению, а к самому себе (ведь хозяин — более надежный прогностический фактор наказания, чем данное поведение) и фактически способствует тому, чтобы данное поведение проявлялось именно в его отсутствие. Такие нежелательные поведенческие реакции с трудом поддаются коррекции, поскольку, проявляясь в то время, когда нет хозяина, они получают отрицательное подкрепление за счет отсутствия привычного наказания и связанных с ним негативных ощущений.

Отрицательное наказание

Отрицательное наказание предусматривает отмену приятного события (включая ожидаемое вознаграждение) в ответ на данное поведение. Отрицательное наказание часто используется для контроля таких моделей поведения, как чрезмерно шумная игра у собак и кошек, а также слишком сильное покусывание у щенков; хозяин объявляет тайм-аут, когда поведение животного становится недопустимым.

Фрустрация

Отрицательное наказание вызывает фрустрацию, которая может проявляться как усугубление поведенческой проблемы или как общая депрессия. Поэтому ухудшение ситуации вслед за исключением предполагаемого подкрепления служит индикатором правильной оценки источников подкрепления. Необходимо предупредить владельца о риске интенсификации нежелательного поведения, в противном случае он может неверно оценить этот момент и отказаться от выполнения программы.

Другим возможным последствием фрустрации является агрессия. Поэтому для коррекции поведения животных с агрессивными тенденциями или неспособностью справиться с фрустрацией следует применять этот метод с особой осторожностью.

Практические соображения

Отрицательное наказание не обязательно должно быть абсолютным (т.е. исключать все факторы подкрепления): оно может состоять в снижении предыдущего уровня подкрепления. Поэтому в тех случаях, когда у животного начала проявляться агрессивность, важно выяснить, связаны ли агрессивные эпизоды с изменением ожидаемого вознаграждения.

Поскольку отрицательное наказание, как и положительное, не обучает животное определенному целевому поведению, для повышения эффективности этого воздействия его следует сочетать с той или иной формой ап-петентного подкрепления. Например, в случае слишком оживленной игры это может быть возобновление игры сразу, как только животное успокоится.

Консультирование владельцев по применению наказания

Животные выбирают, что им делать, оценивая “за” и “против” для разных вариантов поведения в данный момент времени. Цель программ модификации поведения - добиться, чтобы по результатам такой оценки животное гарантированно выбирало приемлемое поведение.

Владелец, как правило, сосредоточивается на наказании за недостойное поведение, тогда как на деле гораздо эффективнее вознаграждать за хорошее поведение. В лучшем случае наказание оказывается неэффективным (поскольку поведение сохраняется), часто же проблема только усугубляется вследствие эмоциональных последствий наказания.

Исходя из этих соображений, а также потому, что эффективное применение наказания обычно сопряжено с большими трудностями, следует отговаривать владельцев от его использования. Если же наказание представляется необходимым, специалист должен хорошо знать факторы, позволяющие добиться максимальной его эффективности при минимальном риске причинения вреда пациенту (Mills, 1997).

Режимы подкрепления_

Определив, какие поведенческие реакции (если таковые вообще имеются) подлежат подкреплению, можно использовать режимы непрерывного, прерывистого и затухающего подкрепления.

Режимы непрерывного подкрепления

Непрерывное подкрепление предусматривает подкрепление каждой желательной поведенческой реакции. В режиме непрерывного подкрепления новые модели поведения усваиваются животным быстро, но если подкрепление прекращается, они вскоре утрачиваются (угасание условного рефлекса). Этот режим наиболее эффективен на первых этапах дрессировки.

Режимы прерывистого подкрепления

Прерывистое подкрепление предусматривает подкрепление желательной ответной реакции от случая к случаю. Оно может проводиться несколькими способами.

• Фиксированный режим, при котором точно определяются временные параметры подкрепления ответной реакции; при этом можно использовать:

- фиксированное соотношение (например, каждая шестая реакция);

- фиксированный интервал (первая ответная реакция, полученная после определенного промежутка времени);

- фиксированную продолжительность (после того, как животное воспроизводит желательную реакцию в течение определенного периода).

• Переменный режим, при котором время подкрепления реакции устанавливается произвольно.

• Дифференцированный режим, при котором время подкрепления реакции устанавливается по ее качественной характеристике.

В режиме прерывистого подкрепления независимо от степени проявления поведенческой реакции объем подкрепления, по определению, всегда меньше, чем в режиме непрерывного подкрепления. Следовательно, дрессировка может продолжаться дольше. На практике чаще используют либо переменный, либо дифференцированный режим, поскольку их легче применять для формирования четкого и стойкого изменения поведенческих реакций животного.

Режим прерывистого подкрепления для выработки требуемой поведенческой реакции

Если режим прерывистого подкрепления используют для того, чтобы выработать определенную модель поведения, то первоначально подкрепление производят часто, а затем, как только устанавливается стабильная ответная реакция, начинают применять все реже и реже. Так, на начальном этапе животное поощряют за исполнение любого действия, приближающегося к целевому поведению, а позднее только за наиболее четкое выполнение требований, с тем чтобы его поведение формировалось в заданном направлении. Этот процесс, называемый последовательным приближением, наиболее эффективен в тех случаях, когда в определенный отрезок времени работа ведется только с одним аспектом поведения. Например, если животное учат садиться по команде, то первоначально его вознаграждают каждый раз, когда оно выполняет команду (непрерывное подкрепление); как только ответная реакция становится стабильной, обычно переходят на дифференцированный режим, т.е. поощряют только те случаи, когда животное садится правильно и быстро.

Режим прерывистого подкрепления для подавления нежелательного поведения

Использование режимов прерывистого подкрепления позволяет также снизить частоту некоторых поведенческих проявлений или даже полностью устранить их. Это достигается путем дифференцированного подкрепления ослабленных проявлений проблемного поведения (ДПО), причем для успеха не требуется активного участия животного в программе дрессировки.

При ограниченном ДПО подкрепляется поведение, при котором частота или продолжительность нежелательных проявлений не превышают предварительно заданного уровня. Экспериментально установлено, что некоторые варианты метода позволяют устранять усвоенное нежелательное поведение быстрее, чем простым прекращением подкрепления (Zeiler, 1971).

Этот метод наиболее целесообразно применять на ранних этапах борьбы с чрезмерно громкими голосовыми сигналами животного, особенно если цель данного поведения — привлечь внимание хозяина. Успех зависит от характера голосовых сигналов, а также от того, насколько животное заинтересовано в получаемом от владельца вознаграждении.

• Первоначально вознаграждаются менее интенсивные проявления, благодаря чему животное быстро понимает, что предпочтительны более мягкие формы поведения.

• Затем требования становятся строже: поощряется еще более спокойное поведение.

• Даже после того, как реакции животного станут стабильно менее интенсивными, эту стратегию продолжают до тех пор, пока не достигнут допустимого уровня громкости, либо совсем перестают обращать на проблему внимание.

• В качестве альтернативы можно использовать раздельное ДПО, при котором подкрепляют реакции, разделенные определенным временным интервалом.

Одна из причин, почему эти методы очень полезны для коррекции некоторых типов поведения, направленного на привлечение внимания, состоит в том, что трудно ожидать от хозяина, чтобы он не обращал внимания на своего питомца каждый раз, когда тот пытается установить контакт,— ведь большинство живот-ных-компаньонов содержат именно ради радости общения с ними. Практичнее попросить владельца ограничивать свое внимание к животному и не проявлять его хотя бы в те минуты, когда животное оставляет его одного.

При использовании данных методов следует очень осторожно относиться к росту ожиданий животного, поэтому важно увеличивать объем вознаграждения лишь по мере улучшения поведения. Если же животное будет получать все большее вознаграждение при минимальном уровне требований к нему, успеха не будет. Исходя из этого, необходимо, чтобы клиент вел записи того, какой объем вознаграждения он использует каждый день.

Режимы затухающего подкрепления — разрушение ассоциации

Принцип затухания заключается в следующем: если после обычно подкрепляемой поведенческой реакции не давать аппетентного подкрепления, вероятность ее проявления будет снижаться. По существу это форма отрицательного наказания за сформированное поведение.

Как правило, подкрепление, приводящее к возникновению проблемы, бывает неумышленным. Например, доставив почту, почтальон уходит, а непосредственно перед его уходом собака случайно начинает лаять. Поведение собаки подкрепляется уходом почтальона, так как собака не знает, что почтальон все равно ушел бы, даже если бы она не среагировала подобным образом. В этом случае для разрушения ассоциации методом затухающего подкрепления необходимо, чтобы “подставной почтальон” пришел в дом и не уходил до тех пор, пока собака не успокоится. Если повторить это упражнение несколько раз, собака, в конце концов, поймет, что ее реакция никак не влияет на исход ситуации.

Ограничения по использованию затухающего подкрепления

Хотя метод затухающего подкрепления часто рекомендуется для устранения многих приобретенных нежелательных поведенческих реакций, существует ряд факторов, ограничивающих эффективность программ, построенных на основе простого отказа от подкрепления.

• Для некоторых форм поведения (например, самоподкрепляющихся) этот режим не подходит, даже если данному поведению способствует внешнее подкрепление. Так, кошек, царапающих мебель, нельзя отучить от этой привычки только тем, что владелец не перестанет обращать на них внимание, поскольку сам процесс царапанья обеспечивает аппетентное подкрепление. Точно так же лай, мотивированный игрой, не поддается затухающему подкреплению.

• Определенное поведение часто подкрепляется несколькими источниками, и, чтобы выполнение режима затухающего подкрепления было эффективным, необходимо выявить и устранить каждый из них. Самую большую опасность в этом отношении представляют доброхоты - посторонние и домочадцы, которых обычно не слишком интересует питомец (и поэтому они не желают как-то изменять свои привычки ради него). Другим источником подкрепления, особенно тех форм поведения, которые направлены на привлечение внимания, бывает слабость со стороны хозяина.

• Процесс затухающего подкрепления приводит к эмоциональной фрустрации, а это означает, что поведение ухудшается перед тем, как выправиться. Многие владельцы не способны справиться с этим и поэтому бросают выполнение программы.

Повышение эффективности режимов затухающего подкрепления

• Эффективность режимов затухающего подкрепления можно повысить, если объединить их с программами, включающими положительное подкрепление допустимого уровня других форм нежелательного поведения (см. выше раздел о дифференцированном подкреплении).

• Чем лучше контролируется окружение собаки, тем больше шансов на успех, поскольку устраняются непредвиденные источники подкрепления. Если днем хозяина не бывает дома, а у него есть дети, которые могут подкреплять нежелательные модели поведения животного, простой режим затухающего подкрепления часто оказывается бесполезным.

• Четкие рекомендации, данные клиенту, помогают обеспечить требуемую согласованность действий (см. выше, отрицательное наказание).

• Мотивацию владельца можно повысить, объяснив ему эффект фрустрации.

• Нежелательное поведение можно постепенно устранить, если сначала выявить одну из специфических ситуаций, в которых оно возникает, и рекомендовать хозяину в это время исключить подкрепление. После выполнения этих рекомендаций, можно перейти к выявлению следующей ситуации.

Игра-наблюдение. Можно рекомендовать клиентам простой и эффективный практический подход - проведение затухающего подкрепления превратить в семейную игру. Например, если собака пытается привлечь к себе внимание, владельцы должны игнорировать ее в это время, а также следить за тем, кто из членов семьи не выдержит и ошибется. Заметившему ошибку засчитывается одно очко. Тот, кто наберет к концу недели больше очков, получает приз, оплачиваемый тем, кто допустит наибольшее число ошибок. Это также поможет членам семьи проследить за возможными способами подкрепления.

Использование непрерывного подкрепления вначале

Затухающее подкрепление быстрее даст успешные результаты, если нежелательное поведение подкреплялось непрерывно, а не периодически; поведенческие реакции, получавшие прерывистое подкрепление, труднее устранить этим методом. Поэтому в некоторых ситуациях используется следующий прием: вначале непрерывно положительно подкрепляют нежелательное поведение, чтобы сделать его более стабильным, а в результате — легче затухающим. Только достигнув стабильной ответной реакции, прекращают любое подкрепление с тем, чтобы устранить данное поведение.

В частности, этот метод вполне применим в случае, если собака лает на звук дверного звонка. Однако лай не должен быть прелюдией к всплеску активности, которая подкрепляет лай независимо от того, какие меры принимает владелец.

Проблемы, возникающие при использовании режимов затухающего подкрепления

К проблемам, наблюдаемым при работе с программами затухающего подкрепления, относятся неумышленное игнорирование хорошего поведения и последствия фрустрации, которую вызывает у особи недостаточное подкрепление. Последнее, как отмечалось выше, может приводить к интенсификации нежелательного поведения (“взрыв затухания”) перед его спадом, нарастанию агрессии, а также к различным формам амбивалентного, смещённого, “вакуумного” и перенаправленного поведения; в результате животное выглядит беспокойным, тревожным, что заставляет волноваться хозяина.

Как и в случае любой приобретенной ответной реакции, эффект затухания может исчезнуть, если не будет периодически подкрепляться. Требуется, чтобы время от времени животное подвергалось воздействию пускового раздражителя. Например, хозяин успешно и сравнительно быстро с помощью затухающего подкрепления отучил собаку попрошайничать у праздничного стола. После этого хозяин уехал, отправив питомца в гостиницу для собак. Таким образом, собака какое-то время была лишена возможности попрошайничать. Когда собаку возвращают домой, нежелательное поведение может проявиться вновь (восстановиться) без какого-либо поощрения со стороны владельца. Восстановленные поведенческие реакции обычно бывают менее интенсивными и, как правило, устраняются легче.

Если использование затухающего подкрепления не дало результата, это может объясняться следующим:

• удаленный фактор не оказывал в действительности подкрепляющего воздействия;

• сохранялся какой-то источник прерывистого подкрепления нежелательной поведенческой реакции;

• не подкреплялось альтернативное, приемлемое поведение и тем самым не были созданы предпосылки для его формирования.

Неассоциативное обучение: привыкание_

Привыкание (габитуацию) принято рассматривать как форму неассоциативного обучения, поскольку оно обеспечивает устранение поведенческой реакции посредством повторяющегося воздействия раздражителя, а не за счет формирования ассоциации между двумя событиями (Chance, 1994). В процессе развития животное обычно подвергается воздействию различных не представляющих угрозы раздражителей, и это обусловливает не только определенную реакцию на тот или иной раздражитель, но также и общую реакцию на новый фактор. Животные, подвергавшиеся ограниченному воздействию раздражителей, чаще проявляют реакцию страха, что позднее может привести к возникновению многих поведенческих проблем (см. гл. 2 и 3). Поэтому процесс привыкания к разнообразию внешних воздействий имеет важнейшее значение в формировании у животного нормальных реакций на новые раздражители.

Привыкание используется также как метод лечения в случаях неадекватной реакции на нейтральный раздражитель. При этом животное подвергают воздействию данного раздражителя и позволяют ему проявлять ответную реакцию до тех пор, пока оно не успокоится. Затем процесс повторяют несколько раз, пока животное не перестанет обращать внимание на этот раздражитель.

Простое привыкание может использоваться для устранения реакций на анксиогенные (вызывающие тревогу) раздражители, но оно неэффективно, если раздражитель провоцирует явную реакцию страха: животное под влиянием страха стремится спастись бегством от раздражителя вместо того, чтоб постепенно привыкать к нему. В подобных ситуациях применим метод, известный как систематическая десенсибилизация (см. ниже).

Методы модификация поведения

Существует три основных метода модификации поведения, разработанных на основе теории обучения: систематическая десенситиза-ция, выработка противоположных рефлексов и погружение.

Систематическая десенситизация

Систематическая десенситизация позволяет повысить порог реагирования животного на данный объект или ситуацию. Она широко применяется для лечения страхов и фобий (см. гл. 17 и 18) и может использоваться при других формах повышенной возбудимости (например, в случаях возбуждения собаки при звуке дверного звонка или индуцированной поглаживанием агрессии кошек). Данный метод относительно прост для понимания, однако выполнение его встречает серьезные трудности, главным образом потому, что клиенты зачастую слишком торопятся. Поэтому необходимо давать клиентам четкие инструкции и желательно - информационные материалы (фиг. 5.5).

Описание проблемы:

Проблемная поведенческая реакция:

Желательная поведенческая реакция:

Упражнение на расслабление:

Пусковые факторы проблемного поведения:

• вызывают наиболее интенсивную форму поведения (оценивают по шкале: 1 - наиболее сильный, 2 - второй по силе и так далее)

• вызывают реакцию умеренной интенсивности (продолжают оценивать по той же шкале)

• вызывают допустимую, но все же нежелательную степень возбуждения

Составляющие раздражители (визуальный, звуковой, химический, физический):

Упражнение номер:

Стартовый критерий:

Раздражители и их комбинации:

Желательная поведенческая реакция:

Число устойчивых проявлений желательного поведения: Примечания:

Режим лечения:

Дата отчета о ходе лечения/ цель:

Фиг. 5.5. Программа систематической де-сенситизации. Карта предписаний

Этапы:

• Идентификация и классификация раздражителей.

• Обучение животного расслабляться по команде.

5 - Собаки и кошки

• Определение допустимых ответных реакций на раздражитель.

• Классификация элементов проблемной ситуации.

• Подкрепление обучения.

Классификация раздражителей

В ситуации, вызывающей нежелательную поведенческую реакцию, обычно удается выделить ряд составляющих типа раздражителей, действующих на органы чувств (визуальных, слуховых, химических), или ранжировать раздражители (такие, как: люди, место, объекты или другие животные) по уровню реакции на них. Все раздражители должны быть идентифицированы и классифицированы, начиная с наиболее сильных и заканчивая наиболее слабыми.

Расслабление на команде

Следует научить питомца расслабляться по команде, заставляя его, например, спокойно лечь у ног и затем нежно поглаживая. В некоторых случаях может потребоваться применение психотропных средств для облегчения процесса расслабления, особенно на ранних этапах.

Перед тем как начать десенситизационные упражнения, рекомендуется дать животному побегать и поиграть, поскольку движение помогает расслабиться. В некоторых случаях, если возбуждение приближается к недопустимому уровню, до и во время упражнений по десенситизации приходится применять отвлекающие стимулы; обычно используют отвлечение с помощью любимой игрушки или расслабляющего поглаживания по спине.

Идентификация реакций

Далее нужно определить, какие реакции на пусковой раздражитель считать допустимыми. К ним может относиться внимание к раздражителю, но никак не явная агрессия или попытка убежать.

Воспроизведение элементов ситуации

Животному, находящемуся в расслабленном состоянии, предъявляют элементы проблемной ситуации, начиная с самых слабых по действию. Команду расслабиться дают после каждого воздействия, чтобы выработать у животного ассоциацию данного раздражителя с расслаблением. Этот прием повторяют несколько раз в разных ситуациях до тех пор, пока животное станет стабильно реагировать на раздражитель не более чем поверхностным интересом.

В тот же период, но не одновременно, а в виде отдельных упражнений, проводимых по той же схеме, животному предъявляют другие проблемные раздражители того же уровня действия. Для определения момента, когда следует переходить к следующим по силе воздействия раздражителям или их комбинации, пользуются четкими правилами, одно из которых - наличие спокойной ответной реакции в пяти последовательных случаях.

Важно, чтобы процесс протекал не слишком быстро, и упражнения выполнялись в доступном для животного темпе. Большее число кратких сеансов скорее дадут нужный результат, чем меньшее число более продолжительных сеансов. В любом случае, прежде чем перейти на следующий уровень, необходимо добиться стабильной реакции.

Подкрепление

На этапах, когда процесс десенситизации постепенно приближается к завершению, необходимо периодически возвращаться к воздействию раздражителей более низкого уровня. Каждое новое упражнение следует начинать с воздействия, оцениваемого на несколько уровней ниже, чем то, которым завершился предыдущий сеанс. В дальнейшем, после достижения цели, важно подкреплять приобретенные навыки посредством периодического воздействия раздражителей, ранее создававших проблемы, чтобы животное не забывало то, чему научилось.

Выработка противоположных условных рефлексов

Выработка противоположных условных рефлексов представляет собой процесс, при котором на вызывающий проблему стимул формируют реакцию, которая заменяет собой искореняемую. Широко распространены две формы выработки таких рефлексов: респондентная (классическая) и оперантная (инструментальная).

Респондентная выработка противоположных условных рефлексов

Данный метод предусматривает использование безусловной ответной реакции, например пищевой или двигательной (игра), в качестве желательного поведения. Вначале животное дрессируют вне проблематичной ситуации, формируя классический условный рефлекс на получение лакомства или любимого развлечения. Например, в качестве условного раздражителя можно использовать свист перед тем, как собака начнет играть с любимой игрушкой. В результате свист будет предсказывать любимую игру. Как только эта ассоциация будет сформирована, свист можно использовать для привлечения внимания животного к хозяину перед лицом потенциальной проблемы, такой, скажем, как приближение другой собаки.

Для эффективного применения этого метода необходимо, чтобы мотивация к респон-дентному поведению была сильнее мотивации к отвлечению внимания.

Оперантная выработка противоположных условных рефлексов

Этот методический прием называют также за-мещением ответной реакции, “посадкой на команду” или выработкой конкурирующего ответа. Он предусматривает использование условно-рефлекторной реакции (например, на команды “Сидеть!” или “Стоять!”) для контроля над нежелательным поведением.

Для эффективного применения метода необходимо, чтобы мотивация к противоположной (желательной) поведенческой реакции была сильнее, чем мотивация к нежелательной, когда обе реакции вызываются одновременно. Это достигается в несколько этапов.

1. У животного вырабатывают условно-реф-лекторный ответ на четкий сигнал (например, команду) в наименее отвлекающей окружающей обстановке. Учебная площадка должна быть спокойной и закрытой.

2. Животное вознаграждают за правильную реакцию, используя режим непрерывного положительного подкрепления. Первоначально определяют его общую реакцию на подкрепление. Когда животное начинает более стабильно реагировать на команду, переходят на режим прерывистого подкрепления, добиваясь сокращения задержки ответной реакции, а затем и нужной ее продолжительности.

3. Как только устанавливается быстрая и стабильная реакция (т.е. когда в 90% случаев она соответствует требованиям стандарта), начинают воспроизводить ее в отвлекающей обстановке.

4. По мере повторения процесса животное должно реагировать все быстрее. Цель заключается в том, чтобы выработать форму “избыточного усвоения” требуемой поведенческой реакции, другими словами - чтобы животное приобрело привычку немедленно реагировать на команду должным образом.

5. Строят шкалу уровней воздействия раздражителей, подобную используемой при систематической десенситизации, и применяют ее аналогичным образом в работе с конкурирующим раздражителем.

6. После этого можно вводить составляющие проблемной ситуации (например, если проблема — перевозбуждение в ответ на дверной звонок, на первом этапе можно приглушить его звук). Отдается словесная команда, животное должно ее выполнить. Это упражнение повторяют несколько раз.

7. Теперь словесную команду соединяют с вызывающим проблему раздражителем, и пока животное продолжает выполнять команду, следует постоянно увеличивать интенсивность раздражителя. Каждый раз его воздействие комбинируют со словесной командой, а адекватную реакцию животного вознаграждают.

8. Как только установилась желательная ответная реакция на фоне вызывающего проблему раздражителя, можно ослаблять словесную команду, последовательно уменьшая громкость голоса, которым она отдается. Это продолжают до тех пор, пока для проявления противоположного условно-рефлекторного поведения не будет достаточно только раздражителя, который ранее вызывал проблему.

Правила успешной выработки

противоположных условных рефлексов

• Дрессировка не должна быть монотонной. Несколько коротких сеансов вечером предпочтительнее одного длинного занятия.

• Темп работы хозяина должен задавать его питомец. Только когда 90% ответных реакций будут отвечать всем требованиям, можно переходить на следующий уровень дрессировки (т.е. отрабатывать другой параметр поведения или вводить большее число возбуждающих раздражителей). Следует побороть искушение перейти на следующий уровень, даже если хозяину кажется, что они с питомцем повторили упражнение достаточно много раз. Решающим фактором является ответная реакция животного, а не нетерпение владельца. Необходимо следовать четко построенной программе (см. формуляр программы на фиг. 5.6).

• Не следует пытаться вызвать противоположное условно-рефлекторное поведение в присутствии вызывающего проблему раздражителя во время формальной дрессировки.

• Перед тем как воспроизвести реальную ситуацию, следует использовать модифицированную версию проблемной ситуации в комбинации с командой.

• Важно и в дальнейшем положительно вознаграждать желательную реакцию в проблемной ситуации, чтобы сделать эту реакцию максимально стабильной.

• Время от времени следует воспроизводить проблемную ситуацию, дабы убедиться, что у животного не утрачена выработанная реакция.

Проблемная поведенческая реакция:

Противоположная поведенческая реакция (условный рефлекс, требующий выработки):

Используемое вознаграждение:

Последующие этапы:

Дата отчета о ходе дрессировки/ достигнутых результатах:

Фиг. 5.6. Формуляр отчета о ходе выполнения программы выработки противоположных условных рефлексов

Погружение (гипер-раздражение)

Погружение, называемое также предотвращением ответной реакции, представляет собой форму регулируемого воздействия раздражителей. Этот способ предполагает воздействие вызывающего нежелательную реакцию раздражителя, которого животное не может избежать до тех пор, пока оно не научится адекватно реагировать на него. Погружение применяется также в психотерапии человека для лечения некоторых страхов и фобий. Прежде чем использовать данный метод для лечения имеющейся поведенческой проблемы, необходимо учесть ряд предварительных условий.

• Реакция на раздражитель должна быть неадекватна какой-либо связанной с ним угрозе.

• Реакция не должна быть сопряжена с получением удовольствия или другого внутреннего вознаграждения (т.е. должна быть возможна адаптация к раздражителю); например, погружение неэффективно в случае, если реакцией является игра.

• Поскольку подлежащая лечению поведенческая реакция связана, как правило, с состоянием психологического расстройства (избегание под действием страха), необходимо тщательно оценить этическое значение этого метода.

• Метод нельзя использовать, если невозможно обеспечить безопасность, ограничивая передвижения пациента во время сеанса.

• Состояние сильного возбуждения, наблюдаемое на ранних этапах воздействия раздражителя, способно привести к сенсибилизации относительно данного раздражителя (т.е. к усилению реакции), поэтому необходимо выделить время для отработки данного этапа. Это бывает связано с весьма большими трудностями.

• Отвлечение внимания во время дрессировки тоже может привести к повышенному возбуждению и утрате усвоенной реакции (отвыканию).

• Все участвующие в выполнении программы должны только наблюдать за происходящим, невзирая на интенсивность реакции животного на раздражитель. Если удалить раздражитель, считая неправильным продолжать сеанс, когда питомец находится в состоянии крайнего возбуждения, то фактически можно отрицательно подкрепить экстремальное поведение и усугубить ситуацию. Необходимо учитывать возможность подобного сценария, и если она представляется вероятной, то с самого начала использовать другой метод.

Для правильного применения метода погружения требуются практические навыки и чутье; его не следует использовать тем, кто не имеет необходимой подготовки.

При правильном выполнении погружения первоначальное улучшение часто наступает быстрее, чем при использовании методов противоположных условных рефлексов или систематической десенситизации. Хотя это привлекает клиентов, в любой конкретной ситуации следует тщательно рассмотреть все риски и преимущества этого метода.

Безопасность

Для обеспечения безопасности нужно надежно ограничить свободу движений животного, чтобы оно не принесло вреда себе или другим. Для собаки, помимо обычного поводка и ошейника, может потребоваться более длинный и прочный поводок, с одного конца пристегнутый к отдельному ошейнику, шлейке или предохраняющему воротнику, а с другого закрепленный на пластине с крюком, вделанной в прочную стену. Этот дополнительный поводок должен быть длинным, поскольку он используется только в том случае, если сброшен или порвался обычный поводок. Для кошек можно использовать клетку из проволочной сетки.

Затем животному предъявляют проблемный раздражитель, воздействие которого прекращают лишь после того, как пациент с ним смирился. Такие сеансы проводят несколько раз, чтобы обеспечить хорошую генерализацию реакции.

Применение седативных препаратов

В некоторых случаях, когда погружение представляется единственным практически применимым методом, можно использовать его модифицированную форму, включающую применение на первых сеансах седативных средств, чтобы снять возбуждение. Переход от обучения под воздействием седативного средства к обучению без его использования не должен быть резким; для достижения нужного результата обычно требуется постепенное снижение седативного воздействия. Чтобы добиться генерализации ответа, на первых сеансах следует воздействовать на животное разнообразными раздражителями, аналогичными проблемному, начиная с наименее интенсивного и постепенно переходя к более интенсивным.

Скорость выработки ответной реакции

Как правило, быстрее всего ликвидируются наиболее явные признаки, тогда как устранение менее выраженных требует намного больше времени. Упорное продолжение занятий, после того как видимое возбуждение уже исчезло, позволяет закрепить новую усвоенную реакцию, но при этом может сделать ее менее генерализованной. Улучшить генерализацию реакции можно, если по достижении первоначальной адаптации использовать разнообразные, но похожие друг на друга раздражители.

Агрессия животного на поводке

Метод погружения часто применяется в отношении тех собак, которые, находясь на поводке, агрессивно реагируют на других собак, и при этом установлено, что подобное поведение является в значительной степени проявлением приобретенной реакции страха. Нередко такая агрессия неумышленно подкрепляется владельцем, натягивающим или дергающим поводок при любом возбуждении своего питомца, что поощряет попытки последнего отогнать другую собаку. Погружение в этих случаях проводится следующим образом.

1. Собаку привязывают, как описано выше. Если хозяин не способен воздержаться от рефлекторного подергивания поводка или окрика, следует надежно привязать собаку к столбу.

2. Затем подводят к ней на поводке “подсадную” (“нереактивную”) собаку, сохраняя достаточное расстояние, чтобы вызвать проблемную ответную реакцию. Подсадная собака остается на этом расстоянии до тех пор, пока собака-пациент не перестанет на нее реагировать.

3. Как только пациент расслабился, подсадную собаку подводят ближе (но она по-прежнему вне досягаемости). Это почти неизбежно вызовет повторную реакцию пациента, который на этот раз успокоится быстрее.

4. Тогда владельцу рекомендуют поощрить своего питомца спокойно, не усиливая возбуждение (дифференцированное подкрепление противоположного поведения), например нежным поглаживанием и успокаивающей интонацией.

5. Процесс повторяется, и подсадную собаку уводят только тогда, когда она может свободно пройти мимо пациента.

6. По ходу подобного затухания реакции па

циент часто поглядывает на хозяина, особенно если раньше тот невольно поощрял нежелательное поведение. Владельцу следует избегать зрительного или любого другого контакта, поскольку это усиливает возбуждение и замедляет адаптацию. По мере того, как пациент учится контролировать свое возбуждение, он может также демонстрировать ряд смещенных реакций, например обнюхивать землю, кружиться, задирать лапу, поворачивать голову и зевать. Все это хорошие прогностические признаки прогресса в лечении. Затем процедуру повторяют с использованием разных подсадных собак и в разной обстановке. *

Не следует прибегать к методу погружения, пока не соблюдены необходимые предварительные условия. Если врач знает этот метод недостаточно хорошо, лучше поискать другой путь во избежание неумышленного усугубления проблемы.

Звуковые раздражители, применяемые при дрессировке_

Формирование условного рефлекса происходит значительно легче, если условный раздражитель является новым для животного. По этой причине желательно ввести новую словесную команду, чтобы сформировать у животного поведенческую реакцию, выработать которую ранее хозяину не удавалось.

Новые раздражители важны также и потому, что они привлекают внимание, увеличивая скорость формирования ассоциации. Этот процесс можно сделать еще более эффективным, если обеспечить адекватность раздражителя и в других отношениях (например, по его интенсивности).

В качестве подобных условных раздражителей широко применяются два средства дрессировки — трещотки и тренировочные диски. Вначале формируется условный рефлекс на эти раздражители.

Ничего “магического” в них нет: того же эффекта можно достичь с помощью устной похвалы и выговора; но упомянутые выше средства обнаруживают некоторые преимущества. Звук каждого уникален и различим, что выделяет их из общего шумового фона. Некоторым владельцам трудно привлечь внимание питомца с помощью своего голоса; к тому же звук голоса для животного может быть неоднозначен, поскольку в прошлом он часто использовался как для похвалы, так и для порицания. Дрессировочные звуковые раздражители лишены такого недостатка, поэтому с ними новые ассоциации формируются быстрее.

Трещотки

Как только раздается звук трещотки, животному дают лакомство. В результате быстро формируется ассоциация: трещотка предвещает вознаграждение. Считается, что в результате установления прочной ассоциации трещотка сама по себе приобретает некоторые положительные подкрепляющие свойства и, подобно тому, как устная похвала служит вознаграждением, становится заменой лакомству.

Трещотки просты в применении, и многие владельцы находят эту форму подкрепления более удобной, чем устная похвала, которую к тому же часто произносят с задержкой, формируя этим несоответствующие ассоциации или замедляя обучение. Трещотку можно использовать как сигнал того, что животное ведет себя правильно, даже если оно находится на некотором расстоянии от хозяина. Это является большим преимуществом по сравнению с лакомством. Еще одно преимущество состоит в том, что питомец меньше концентрируется на хозяине как на источнике вознаграждения и поэтому способен более свободно проявлять целый ряд моделей поведения. Более подробно об использовании трещоток говорится в работе Джонса (Jones, 1999).

Тренировочные диски

Диски (фиг.5.7) используются как сигнал изъятия вознаграждения. Лакомство кладут перед собакой; когда собака приближается к нему, диски роняют и одновременно убирают лакомство. Следовательно, диски служат сигналом отрицательного наказания. Когда диски впервые применяют в тихом закрытом помещении типа ветеринарной клиники, собака обычно быстро реагирует, возвращаясь к хозяину при этом звуке. Если такое поведение подкрепить лакомством, то диски превратятся в форму команды “Ко мне!” и приведут к условнорефлекторному избеганию раздражителя.

Фиг.5.7.

Тренировочные диски

Звук дисков может использоваться для контроля поведения во многих случаях (например, когда животное вырывается из дверей или когда оно перевозбуждается); более подробное описание и примеры приводит Фишер (Fisher, 1990). Применение тренировочных дисков наиболее эффективно, если владелец комбинирует их с положительным аппетентным подкреплением желательного поведения (в данном случае — приближение к хозяину). По истечении периода выработки условного рефлекса можно надежно объединить диски с вызывающими проблему раздражителями, которые раньше отвлекали внимание собаки; в результате эти раздражители превратятся в сигналы возвращения к хозяину.

Литература

Borchelt FL, Voith VL (1996) Punishment. In: Readings in Companion Animal Behavior, ed. VL Voith and PL Borchelt, pp. 72-80. Veterinary Learning Systems, Trenton, New Jersey Chance P (1994) Learning and Behavior, 3rd edn. Brooks/Cole, Pacific Grove, California Donaldson J (1996) The Culture Clash. James and Kenneth, Berkeley, California Fisher J (1990) Think Dog. Blandford, London Jones D (1999) The Clicker Workbook-А Beginner’s Guide. Howl “n" Moon Press, Eliot, Maine Lieberman DA (1993) Learning, Behavior and Cognition, 2nd edn.

Brooks/Cole, Pacific Grove, California Lindsey SR (2000) Handbook of Applied Dog Behavior and Training. Iowa State University Press, Ames, Iowa Mackintosh NJ (1974) The Psychology of Animal Learning.

Academic Press, London Mackintosh NJ (1983) Conditioning and Associative Learning.

Clarendon Press, Oxford Marder A, Reid PJ (1996) Treating canine behavior problems: behavior modification, obedience and agility training. In: Readings in Companion Animal Behavior, ed. VL Voith and PL Borchelt, pp. 56-61. Veterinary Learning Systems, Trenton, New Jersey

Martin G, Pear J (1992) Behavior Modification: What It Is and How to Do It, 4th edn. Prentice Hall, Englewood Cliffs, New Jersey

Mills DS (1997) Using learning theory in animal behavior therapy practice. Veterinary Clinics of North America: Small Animal Practice 27, 617-635 Premack D (1959) Toward empirical behavioural laws, 1: Positive reinforcement. Psychology Review 66, 219-233 Pryor К (1999) Don’t Shoot the Dog. Bantam Books, New York Reid PJ, Borchelt PL (1996) Learning. In: Readings in Companion Animal Behavior, ed. VL Voith and PL Borchelt, pp. 62-80. Veterinary Learning Systems, Trenton, New Jersey Reid PJ (1996) Excelerated Learning. James and Kenneth, Berkeley, California Rolls ET (1999) The Brain and Emotion. Oxford University Press, Oxford

Spreat S, Spreat SR (1982) Learning principles. Veterinary Clinics of North America: Small Animal Practice 12, 593-606 Walker S (1987) Animal Learning. Routledge & Kegan Paul, London Wolpe J (1958) Psychotherapy by Reciprocal Inhibition. Stanford University Press, Stanford, Connecticut Zeiler MD (1971) Eliminating behaviour with reinforcement. Journal of Experimental Analysis of Behavior 16, 401 -405

Предыдущая главаГлава 10 из 40Следующая глава