Теоретические основания дрессировки - Гриценко Владимир Васильевич. Страница 21

Особое значение имеет время подачи подкрепления. Следует отметить, что закрепляется только непосредственно предшествующее подкреплению поведение. В оперантном научении считается, что разрыв между нужной формой поведения и фактом подкрепления не должен составлять более 10 секунд. Если этот разрыв больше, научение может не произойти.

Школой И.П. Павлова были описаны так называемые «отставленные рефлексы», когда разрыв между действием условного раздражителя и подкрепления составлял минуты и десятки минут. Выработка «отставленных рефлексов» осуществима только в специфических условиях павловской «башни молчания», но и при этом была отмечена закономерность — чем дальше во времени оставляется подкрепление, тем медленней вырабатывается условнорефлекторная реакция. В реальных условиях избежать факта оставления подкрепления помогает использование условного подкрепления.

Оказалось, что частичное подкрепление условных сигналов (до 50% случаев, а по некоторым данным до 33—25%), не затрудняет выработку условного рефлекса, но значительно замедляет его угашение при последующей отмене подкрепления. Но при свободном выборе режима положительного подкрепления, животные выбирают режим с большей вероятностью его получения. Возможно общее число случаев подкрепления важно только для упрочения реакции до навыка. Однако вариационный (вариабельный) режим подкрепления значительно закрепляет отработанный навык.

Значимость подкрепления, то есть его способность оказывать влияние на модификацию поведения определяется, с одной стороны его величиной. Оказалось, что животные при условии свободы выбора величины подкрепления, выбирают те случаи, в которых величина положительного подкрепления больше. Учитывая закон сохранения (экономии) энергии, животное может прийти к выводу, что величина подкрепления не окупает энергитические затраты связанные с его достижением. С другой стороны, величина подкрепления должна быть такой, чтобы вызвать безусловную реакцию животного. Например, отрицательное подкрепление только тогда эффективно, когда способно вызывать оборонительную реакцию.

Следует всегда помнить об относительности биологической значимости подкрепления. Так для совершенно сытого животного вряд ли значимым будет пищевое подкрепление, как для некоторых собак ласковое слово или поглаживание хозяина бывает безразличным и, следовательно, не воспринимается подкреплением. Для одних животных игра является сильным подкрепляющим фактором, для других возможность свободы и физической активности, одни собаки воспринимают рывок поводком средней силы как значимое отрицательное подкрепление, другие не обращают внимание и продолжают тянуть.

Относительность подкрепления также связана с потребностью, испытываемой организмом. Если ваша собака очень хочет погнаться за кошкой, то ваш кусочек сыра вряд ли будет подкреплением команде подхода.

Но связь выбранного подкрепления с насущной потребностью гораздо глубже. Дело в том, что потребность и способы ее удовлетворения достаточно жестко наследуемы и возможности, например, пищевого подкрепления не всесильны. Мак-Фарленд в своей книге «Поведение животных» приводит случай произошедший с супругами Бреланд почитателями и последователями Скиннера. Бреланд были уверены, что с помощью метода Скиннера можно выработать и закрепить у животных совершенно необычные и несвойственные для них реакции и в доказательство этого выработали у нескольких видов животных — енотов-полоскунов, свиней, кур и др. — различные формы поведения с помощью оперантного обусловливания. Вначале работа шла легко. Еноты подбирали монетку и переносили ее в металлическую коробку. Свиньи рылом подталкивали деревянную монетку к большой копилке в виде поросенка. Куры дергали за резиновое кольцо и высвобождали таким образом капсулу, которую они клювом выталкивали из клетки. Разумеется, каждая такая поведенческая реакция сопровождалась подкреплением.

Однако по прошествии некоторого времени еноты уже не так охотно опускали свои монетки, а предпочитали оставлять их у себя, манипулируя ими, потирая их передними лапами, а если и опускали их в коробку, то затем снова вынимали обратно. Свиньи уже не так спешили подтолкнуть монету к кормушке, для того чтобы получить себе пищу, а по дороге подбрасывали ее в воздух или пытались зарыть в землю, а затем снова выкопать. Куры же стали поклевывать свои капсулы, вместо того чтобы выталкивать их из клетки. То есть так или иначе, но оказалось, что вид подкрепления генетически связан с ограниченным поведенческим репертуаром.

Значимость подкрепления определяется также положением связанной с ним потребности в иерархии потребностей. Например, витальные потребности более значимы, чем потребности саморазвития. А в опытах по изучению влияния различных видов подкрепления на осуществление реакции экстраполяции оказалось, что при подкреплении самостимуляцией положительных зон мозга крысы оказались способными не только к многократному решению задачи, но и усложненного ее варианта, тогда как при пищевом подкреплении они этого не могли.

На значимость подкрепления также оказывают влияние индивидуальные особенности животного и его ранний опыт. Как уже упоминалось, для животных, выращенных в условиях ранней сенсорной депривации, отрицательное подкрепление более значимо, чем для животных, выращенных в нормальной или обогащенной среде. Кроме того, значимость подкрепления определяется величиной базовой для него потребности. Кстати, при отработке какого-либо действия, использование подкреплений, ориентированных к различным потребностям, способствует более быстрому научению.

Как при реактивном (классическом), так и при оперантном научении приобретенная реакция сохраняется лишь до тех пор, пока ее поддерживают безусловным раздражителем (в первом случае) или специальным подкреплением (во втором случае). Если же эти подкрепляющие факторы перестают действовать, то выработанное на их основе поведение быстро угасает и после нескольких попыток прекращается вовсе. Важно отметить, что речь здесь идет именно об угасании, а не об исчезновении или «стирании следов». Дело в том, что если снова начать предъявлять безусловный раздражитель или подкрепляющий фактор, то исчезнувшее поведение почти сразу же восстанавливается.

НАКАЗАНИЕ

Наказание чисто человеческое понятие, имеющее свои человеческие особенности, может быть и пригодно для человечества, но в дрессировке не только бесполезно, но и опасно. Привнесение этого «человеческого» понятия в дрессировку имеет следующие отрицательные стороны:

1. Наказание неизбежно (в отличие от отрицательного подкрепления), поэтому оно не влияет на модификацию поведения. Наказание учит только как не попадаться или как принимать такую позу подчинения, которая снижает его интенсивность или исключает его.

А отрицательное подкрепление, в отличие от наказания, это событие, которое можно прекратить или избежать, изменив поведение сейчас же.

Целью дрессировки является не применение наказания, как впрочем и отрицательного подкрепления, а создание таких возможностей для животного, в которых оно могло бы избежать их, изменив поведение.

2. Как правило, наказание используется после того как поведенческий акт уже завершен. По своему физиологическому действию наказание является отсроченным отрицательным подкреплением, а, как известно, чем далее во времени отсрочено подкрепление, тем с большим трудом модифицируется поведение.

3. Как считает К. Прайор, «если наказание помогло прекратить нежелательное поведение, то такое воздействие служит мощным подкреплением для наказывающего. В дальнейшем наказывающий будет стремиться к наказанию».

4. Наказывающий может быть бессознательно заинтересован не в исправлении поведения, а в получении доказательств своего лидерства, так как наказание способствует сохранению и упрочнению доминирующего положения наказывающего.

Наказание может оказаться эффективным, если мотивация ненужного нам действия (поведения) невелика, если это поведение еще не упрочилось, а наказание неожиданно, ново, необычно или очень сильно.