Добавил:
ivanov666
Опубликованный материал нарушает ваши авторские права? Сообщите нам.
Вуз:
Предмет:
Файл:Зоопсихология и сравнительная психология. Учебник
.pdf
91
2) психомоторный навык;
3) инсайт;
4) научение путем рассуждений.
Классификация научения по У. Торпу (1963 г.):
1. Неассоциативное научение — привыкание (габитуация). Оно возникает
без ассоциативных связей со средой.
2. Ассоциативное научение, при котором возникает ассоциативная связь
между двумя психическими явлениями:
а) классический условный рефлекс;
б) оперантный условный рефлекс.
3. Латентное (скрытое) научение.
4. Инсайт (озарение):
а) собственно инсайт («улавливание отношений»);
б) подражание типа социального облегчения — инстинктивное подражание;
в) истинное подражание («копирование поведенческих актов»).
5. Импринтинг (запечатление):
а) запечатление привязанности;
б) половой импринтинг.
Отметим, что в отечественной психологии научение (синоним «дресси-
ровка») — это приучение особи к желаемому поведению, а обучение — это та же
выработка новых умений и навыков (еще и знаний), но с объяснением и пояснением. В английском языке такого деления нет и все это называется learning.
За аксиому примем правило: животное нужно НАучать, человека —
ОБучать.
Иногда можно услышать реплики мамы к ребенку «учи уроки, потому что
я так сказала» — это научение ребенка. Так можно обращаться лишь к животному, поскольку оно не поймет мотивирующих фраз. Человеку же нужно объяснить, внести мотивацию, зачем ему это полезно и выгодно.
Можно услышать, наоборот, реплику девушки к своей собачке после ко-
манды «сидеть»: «Милая, садись, а я за это дам тебе вкусняшку. А если ты будешь
слушаться, то мы пойдем и купим тебе новый комбинезончик…» Это обучение.
Оно для животных бессмысленно, они не понимают мотивирующих объяснений.
4.2.3. Облигатное и факультативное научение
По критерию необходимости той или иной реакции для выживания особи
в стандартных условиях этологи выделяют облигатное и факультативное
научение.

92
Облигатное (обязательное) научение — это совокупность умений, не-
обходимая для выживания особи и вида. Оно основано на инстинктивном, видоспецифичном поведении. Если животное его не освоит, оно умрет. Например,
путем облигатного имитационного научения молодые птицы и шимпанзе
накапливают опыт в гнездостроении. Охотиться, забивать добычу — это тоже
облигатное научение. Облигатное научение у человека — это прямохождение
и речь.
Факультативное научение — это необязательное научение, улучшающее
жизнь конкретной особи в конкретных условиях среды. Это индивидуализированный опыт животного. Волчонок, лисенок освоили местности и знают, куда
надо ходить пить, а где вода невкусная. У человека обучение интегралам и логарифмам, иностранному языку, вязанию крючком, вышивке крестиком — это
факультативное научение.
4.2.4. Респондентное научение (научение по И. П. Павлову)
И. П. Павлов сформулировал условия, необходимые для образования
условных рефлексов54, которые в современном варианте выглядят так:
I. Либо условный и безусловный раздражители совпадают во времени,
либо условный опережает безусловный на 0,1–5 с.
Важно помнить, что в своих знаменитых опытах И.П. Павлов сначала ми-
гал лампочкой или звенел в звонок, и через долю секунды собака получала еду.
Но не наоборот, поскольку для голодной едящей собаки звуки и мигания света
будут индифферентны.
Когда мы дрессируем животное, то сначала даем ему команду, а потом
механически помогаем эту команду сделать, но не наоборот. То есть, например,
сначала даем команду «сидеть» и только потом, через долю секунды, ведем перед ее носом лакомством, направляя его вверх. При этом собака рефлекторно
садится. В советской кинологической школе механически помогали собаке поводком или нажимом руки.
II. Постоянство окружающей среды. Отсутствие посторонних раз-
дражителей во время выработки условного рефлекса. Когда рефлекс вырабо-
тан, им можно пользоваться везде, например, служебные и цирковые собаки
могут работать абсолютно в любых условиях. Но вырабатывать его нужно на
одной территории без посторонних раздражителей.
Если дрессировать самца на небольшом расстоянии от самки, готовой
к спариванию, или на участке, где та побывала, то половой безусловный рефлекс неизбежно будет затруднять выработку условного. Если перед началом
54
Павлов И. П. Избранные труды / под ред. Э. А. Асратяна. М.: Изд-во Акад. пед. наук РСФСР, 1951.

93
занятий не выгулять собаку, то ее внутренние мочеиспускательные стимулы
будут более значимы, чем команды дрессировщика.
III. Сила безусловного раздражителя при выработке условного рефлекса
должна быть гораздо большей, чем сила условного раздражителя. Безуслов-
ный раздражитель должен быть настолько сильным, чтобы вызывать доминантное возбуждение в центральной нервной системе. Условный раздражитель
должен быть привычным, чтобы не вызывать ярко выраженного ориентировочного рефлекса.
4.2.5. Оперантное научение
Оперантное научение синонимично называется методом проб и ошибок, инструментальным научением, оперантным обусловливанием, научением по Б.Ф. Скиннеру. Дрессировка животных через выработку такого
рефлекса называется оперантной дрессировкой, американским стилем
дрессировки.
Авторами методики стали Э. Торндайк и Б.Ф. Скиннер. Популяризировала ее К. Прайор55.
Почему оперантное? В менеджменте и инженерных науках операцией
называется мелкий шажок, маленькое действие. Такие маленькие действия составляют участки большого важного пути. И суть оперантного научения состоит в том, чтобы вырабатывать отдельно каждое маленькое действие особи,
направляя ее к чистому выполнению и затем подкрепляя.
Слово «обусловливание/обуславливание» во фразе «оперантное обусловливание» означает не создание определенных условий, а создание условного
рефлекса.
Оперантное научение — особый путь образования условных рефлексов, ко-
торый заключается в подкреплении спонтанно возникающей у субъекта реакции,
а не стимула56.
Главные правила оперантной дрессировки животных:
1. Подстройка под животное. Дрессировщик и животное — тандем.
Это пара, в которой дрессировщик — ведущий, но он подстраивается под темперамент, характер, привычки, скорость реакции животного и затем ведет его
к нужному результату, опираясь на органику животного. Схема «считывание —
подстройка — ведение» для оперантной дрессировки крайне важна. В совет-
55
Прайор К. Не рычите на собаку. М., 2023.
56
Скиннер Б. Ф., Зинченко В. П., Мещеряков Б. Г. Большой психологический словарь. М.: ОЛМА-ПРЕСС, 2003.

94
ской дрессировке, наоборот, предполагалось стереть, иногда даже сломать индивидуальность, воспитывая всех животных одинаково.
2. Инициатива от животного. Животное само предлагает игру, которая
оказывается важным веселым уроком. Например, собака залаяла — дрессировщик дает команду «голос», собака играет с любимым мячиком — дрессировщик включается в игру, бросает мячик, давая команду «апорт».
3. Приоритет положительного подкрепления. При обучении не дается
отрицательного подкрепления. Неправильный результат игнорируется, либо дается сигнальная команда, например «нет». Если животное старается, но у него
не получается, зачем его ругать? Это принципиальный бихевиористский вопрос. Но отрицательного подкрепления нет именно во время научения, когда
у животного не получается нужный результат при всем его старании. При вос-
питании же, когда животное создает проблемы (грызет обои, ходит в туалет на
кровати), отрицательное подкрепление и наказание необходимы.
4. Пробы и ошибки. Вся оперантная дрессировка выросла из метода проб
и ошибок Э. Торндайка, а сегодня это лишь одно из правил оперантности: дать
животному возможность при научении пробовать и искать самый интересный
результат. По сути, это правило — обобщение правил 1–3.
5. Современная оперантная дрессировка иногда применяет кликер в качестве подкрепления (см. рис. 32). Кликер — это механическое устройство размером с брелок, как правило, с пластмассовой цепочкой, надеваемой на запястье, которое дрессировщик берет в руку и щелкает при правильном поведении животных (неправильное поведение не наказывается, а игнорируется).
Рис. 32. Кликер
Кликер-дрессировка или кликер-тренинг создан Карен Прайор, ученицей
Б. Ф. Скиннера для дрессировки дельфинов в дельфинарии. Как наказать дельфина? Это невозможно сделать. В том числе отсюда пришло правило отсутствия наказания и отрицательного подкрепления. Как похвалить дельфина?
Рыбкой. Но дельфин, быстро объевшийся рыбы, перестает работать. К. Прайор
нашла такой выход: сначала она, давая рыбу дельфину, щелкала кликером, опустив руку с ним в воду. После нескольких таких связок «клик — рыба» у дель-

95
фина вырабатывался рефлекс «клик = похвала». Так, сначала трюки дельфина
переставали подкреплять рыбой каждый десятый раз, подкрепляя кликером. Затем хвалили рыбой все реже и реже, при этом кликали за каждый правильно
выполненный трюк. В итоге рыбу дельфин получал только в конце представления в дельфинарии, а клик — за каждый правильно выполненный трюк.
Вы дрессируете собаку выполнению команды «сидеть» по И.П. Павлову, т.е. ре-
спондентно, «по-советски», если вы следуете схеме:
Этап первый — стимул условный (команда «сидеть»).
Этап второй — стимул безусловный (надавить на круп, либо дернуть поводком,
либо поднять лакомство над головой собаки, чтобы она рефлекторно задрала голову и
села).
Этап третий — реакция, т.е. собака сидит.
Этап четвертый — подкрепление (пока собака сидит, вы ее хвалите: «Хорошо сидеть», причем делаете это несколько раз счастливым голосом, даете лакомство).
Так делаете около 20 раз, четко и без сбоев — произошла выработка рефлекса.
Потом еще от двухсот до тысячи раз — произошло закрепление рефлекса. (Чем больше
и чаще закрепляется рефлекс, тем лучше.) Потом повторяете по мере надобности —
происходит воспроизведение рефлекса.
Вы дрессируете собаку команде «сидеть» по Ф. Скиннеру, т.е. оперантно, «поамерикански», если у вас нет никакой схемы и вы используете природные данные со-
баки.
Этап первый — вы случайно, проходя мимо, заметили, что собака садится (не сидит уже давно, а именно садится).
Этап второй — вы к ней подходите и хвалите ее, повторяя несколько раз: «Хорошо
сидеть, прекрасно сидеть», — и так раз пять, чтобы собака запомнила команду и связала
ее с положительной эмоцией. Даете лакомство, если оно под рукой.
Этап третий — собака шокирована, ведь внезапно оказалось, что она сделала чтото хорошее.
Так случайно «подлавливаете» несколько раз, пока собака не выучила словокоманду и не поняла, что надо делать, когда ее слышит.
Логика современных бихевиористов такова: важно «поймать» желательное поведение у животного, дать этому поведению название, т.е. команду, и хвалить его за случайное выполнение этой команды. Сначала животное будет недоумевать, а потом сообразит, что такого хорошего оно сделало.
Высшим пилотажем уже опытных собак и дрессировщиков является игра с собакой «предложи мне что-нибудь», когда собака сама предлагает игру или начинает выполнять команды, «продавая» эти действия за похвалу или лакомство.
Виляние хвостом при выполнении команды — это главный критерий того, что собаке нравится. При оперантной дрессировке собаки гораздо чаще, чем при респондентной, виляют хвостами,

96
Лучший вариант при дрессировке собак — сочетать респондентное и оперантное
научение у собак.
Знаменитый дрессировщик кошек Юрий Куклачев неоднократно в интер-
вью подчеркивал, что у каждой кошки нужно найти ее «природную изюминку»,
а не дрессировать всех одинаково. Кошки более подвержены оперантному
научению, нежели респондентному.
Карен Прайор дрессировала дельфинов только оперантно, поскольку
дельфина невозможно заставить что-либо делать. По этой же причине она использует при дрессировке только положительное подкрепление, а отрицательное — никогда.
Оперантное научение — научение, при котором особь случайно сделала
нужное действие и поучает за это положительное подкрепление.
На первом месте — активность животного, а не просто реагирование на стимулы дрессировщика.
«Правило 21»
Бихевиористы доказали, что навык и рефлекс вырабатываются обычно за 21
предъявление стимула. У умных, и/или заинтересованных особей, и/или при угрозе
для жизни — быстрее. Возможна выработка условного рефлекса даже за одно
предъявление — при обычном стрессе или эустрессе (положительном стрессе, типа
предсвадебного стресса, стресса при путешествиях, т.е. при психическом напряжении
с положительной эмоциональной окраской).
То есть любая, даже самая сложно вырабатываемая привычка выработается в
среднем за 21 раз. Если 21 раз заставить себя ходить в спортзал, питаться правильной
пищей, то на 22 раз вы получите нужную привычку легко и просто.
Но если на каком-то из этих предъявлений стимулов получена недостаточная
реакция, то и она «записывается» как правильная. Например, собаку учат садиться по
команде, и на какой-нибудь, к примеру, 11, 16, 20 раз собака не села, а легла или
осталась стоять, но дрессировщик ее почему-то подкрепил машинально или просто
не добился выполнения команды и стал давать следующую. У собаки записалась как
норма возможность не выполнять ее. В итоге мы получим непослушную, «глупую»
собаку. Кто в этом виноват — собака? Нет, человек.
4.2.6. Виды оперантного научения
Оперантное научение имеет несколько видов в зависимости от истории
создания и применяемых методик.

97
Первый метод — метод проб и ошибок, созданный Э. Торндайком
(см. раздел «История зоопсихологии»).
Многие домашние кошки/собаки самообучаются методом проб и ошибок: одна кошка попыталась поцарапать обои — получила наказание. Попробовала — ошиблась. Другая поцарапала, но наказания не получила. «Ага, значит эта проба — не
ошибка, можно продолжать в том же стиле».
Огромное количество навыков, приобретаемых человеком, образуется не
инструментально, а именно оперантно — методом проб и ошибок. Самообразование, т.е. посещение различных секций, кружков, — пример метода проб и ошибок.
Попробовали — получилось — понравилось, т.е. возникло положительное подкрепление. Следовательно, будем заниматься этим делом. Попробовали — не получилось — не понравилось, следовательно не будем продолжать. Мы учимся житейским навыкам тоже зачастую именно методом проб и ошибок: готовить, убирать, стирать… Кататься на велосипеде, рисовать, вышивать, шить — шаг за шагом,
пробуя и ошибаясь или не ошибаясь.
Второй метод — свободно-оперантная методика, созданная Ф. Скин-
нером. Он взял за основу опыты Э. Торндайка, но, в отличие от него, подкреп-
лял каждую правильно выполненную операцию, поэтому данное направление
было названо оперантным научением. О ящике Скиннера см. в главе «История
зоопсихологии», параграф «Бихевиоризм».
Самый знаменитый эксперимент Ф. Скиннера.
Беррес Фредерик Скиннер предпочитал работать с голубями. В ящике Скиннера на уровне головы голубя находилась кнопка, именуемая ключевым стимулом, или
ключом. При клевании ключа снизу выпадало зернышко — подкрепление.
Как обучали голубей клевать эту кнопку? Голодного голубя помещали в скиннеровский ящик (см. рис. 33). Сначала ему туда кидали зернышко, когда он только
подходил к кнопке (конечно, он это делал случайно), потом, когда подходил очень
близко, почти касаясь, потом, когда случайно клевал ее. То есть голубя направляли к
этому действию, но ни к чему не принуждали его. Затем, когда голубь клевал кнопку,
автоматически открывалась кормушка с кормом. И вот рефлекс создан, осталось его
только закрепить несколькими десятками повторений.
Ф. Скиннер полагал, что так можно сформировать любую реакцию. А вы как
думаете?
Далее ученый вознаграждал голубя не за каждый удар клювом, а за каждый
N-й удар. Так голубь начинал отбивать что-то типа барабанной дроби на кнопке клювом. Такой метод называется вознаграждением по постоянному соотношению.

98
Рис. 33. Эксперимент Б. Скиннера
Б. Ф. Скиннер57 в 1958 г. описывал, как голубя тренировали боковым
движением клюва запускать деревянный шарик по миниатюрному желобу, чтобы сбить игрушечные кегли. «Результат поразил нас… Это зрелище произвело
такое впечатление на Бреленда, что он отказался от многообещающей карьеры
в области психологии и стал платным дрессировщиком».
Карен Прайор
58
следующим образом усовершенствовала методику
Б. Ф. Скиннера, стимулируя креативность дельфинов: если какое-то действие
подкреплялось сейчас, то оно не подкреплялось в следующий раз. Когда дельфины исчерпали весь репертуар известных им реакций, они стали фантазировать и создавать новые творческие реакции.
Третий метод — дифференцировочная дрессировка. Так же оперантно
можно научить животных «находить» фигуры определенного цвета или размера, подкрепляя только нужные выборы, и так же учат служебных собак находить человека по запаху, наркотики.
Каждый человек ежедневно сталкивается с дифференцировкой: отделяет
звонок своего сотового телефона от чужого, сказанные ему слова — от сказанных другому и т.д. Собака дифференцирует звонок в дверь от звонка на мобильный. На первый реагирует, на второй — нет.
Смысл дифференцировочной дрессировки: из всего многообразия под-
крепляется только правильный выбор. Важно помнить, что дифференцировоч-
ную дрессировку могут освоить только животные с высоким уровнем элементарной рассудочной деятельности, а также человек.
Одним из вариантов дифференцировочной дрессировки является выбор
на образец: ворону предъявляли стимул — дощечку с нарисованными на ней
точками. Ему было необходимо среди лежащих на столе дощечек найти дощечку с таким же количеством точек59. Или рыбе необходимо проплыть именно в
дверь-треугольник, потому что в качестве образца лежал именно треугольник.
Существует огромное количество вариантов выбора на образец в прикладной деятельности: работа собак по следу, поиск преступников, взрывчатки,
57
Скиннер Б. Ф. По ту сторону свободы и достоинства. М.: Оперант, 2015.
58
Прайор К. Несущие ветер. М.: Селена +, 1995.
59
Эксперимент по дифференцировочной дрессировке (и многие другие виды научения), например, представлен
в советском документальном фильме «Думают ли животные», снятый в 1977 г. на киностудии «Киевнаучфильм».

99
наркотиков и т.п. Во всех этих случаях у животного есть изначальный образец,
а остальные вещи надо отдифференцировать.
Существует еще и дифференцировка в чистом виде: нужно выбрать
предмет, не похожий на других. Из двух кругов и квадрата выбрать квадрат, из
двух красных и синего шаров выбрать именно синий. Приматы после недолгого
обучения с этим справляются.
Сложный вид дифференцировки — это решение задач на абстрактные
понятия. Опыты проводятся только на приматах. Им необходимо выбрать «третий лишний» по непонятному критерию, например самый большой цилиндр
или самый маленький. Причем самый большой в одном опыте может быть самым маленьким в другом.
Различия респондентного и оперантного научения представлены в табл. 6.
Таблица 6
Отличия респондентного и оперантного научения
Критерии
Респондентное научение
Оперантное научение
Основоположник изучения
И.П. Павлов
Ф. Скиннер
Эмоциональный фон при подаче команды
Нейтральный либо отрицательный — голод либо стро-
гий ошейник и т.п. Команда
отдается жестко, четко, строго
Положительный эмоциональный фон, т.е. интерес, азарт —
основа научения
Связь учителя и научаемого
По принципу «труд»
По принципу «игра»
Наличие стимула
Есть внешний, условный стимул
Условного стимула нет. Есть
потребность в подкреплении
Характер реакции
Респондентное (реактивное)
действие — действие, совер-
шаемое в ответ на определенный стимул
Оперантное действие —
спонтанное, без какого-либо
очевидного стимула.
Пробы и ошибки
Рекомендуемые действия при
ошибках научаемого
Отрицательное подкрепление,
наказание, чтобы искоренить
ошибки в дальнейшем
Игнорирование ошибок. Респондент старался — нельзя
его наказывать за это
Типы связей
Физиологическая связь между
условным стимулом и безусловной реакцией на основе
ассоциации между индифферентным и безусловным стимулом
Связь между реакцией и естественным поведенческим репертуаром организма
Смысл научения
Связь образуется между ранее
значимым (безусловным) и
ранее нейтральным (условным) стимулами, в результате
чего животное начинает реагировать на последний
Подкрепляется случайно выполненная нужная экспериментатору реакция. Возникает
«реакция без стимула»

100
Критерии
Респондентное научение
Оперантное научение
Уровень самостоятельности
Низкий
Высокий
Временные правила
Условный стимул должен
предшествовать безусловному
Реакция всегда должна предшествовать подкреплению
Угасание
В результате отмены безусловного стимула и подкрепления
В результате отмены подкрепления
4.2.7. Привыкание
Привыкание (у примитивных — габитуация, у обладающих нервной системой —
сенсорная адаптация) — это исчезновение реакции или снижение ее интенсивно-
сти, возникающее при неоднократном предъявлении стимула. Наблюдается во
всем царстве животных, начиная с простейших.
Особенности габитуации:
1. Спонтанное восстановление. Если амебу или инфузорию колоть мик-
роиглой, то сначала они будут сокращаться, а потом постепенно перестанут на
это реагировать — привыкнут. Но пройдет время, эти простейшие «забудут» и
в следующей серии опять начнут реагировать, как будто и не было этой «привычки».
2. Развитие потенциала габитуации. При выполнении таких проб на
спонтанное восстановление с каждой пробой скорость привыкания простейших
увеличивается: они перестают сокращаться с каждым разом за все меньшее
и меньшее количество уколов.
3. Генерализация стимула. Привыкание к каждому стимулу распростра-
няется и на сходные стимулы. Например, тараканы привыкают к любым условиям среды, вплоть до радиации.
4. Привыкание развивается быстрее, если интервал между раздражения-
ми не более минуты.
5. Скорость привыкания зависит от природы раздражителей.
Растормаживание (дегабитуация) — это применение нового, очень ин-
тенсивного стимула, которое приводит к восстановлению исчезнувшей реакции. Например, вы уже привыкли к шуму за стеной у соседей и не реагируете
на него. Но сильнейший звон однажды ночью заставит вас теперь слышать любые шумы за этой стеной. Рыбы в аквариуме привыкают к пузырькам и струям
воздуха, не замечают их. Но если на жабры однажды направить струю физраствора, то теперь рыбки будут вновь реагировать и на струи воздуха.
Организм человека аналогично привыкает ко всему, но необходимо раз-
личать несколько основных видов адаптации. Физическую адаптацию, которая
Соседние файлы в предмете [НЕСОРТИРОВАННОЕ]
