Пирс и Чини: Генерализованная имитация и научение через наблюдение

Пирс и Чини: Генерализованная имитация и научение через наблюдение, image #1

Обучение имитации происходит аналогично формированию любого операнта социальным контекстом. Дискриминативный стимул — это поведение модели, оперант — это действие, повторяющее модель, а подкрепление — социальное одобрение. Соответствующие модели действия подкрепляются, а не соответствующие угасают. Социальный контекст работает подобно экспериментам с дискриминацией, которые включают сопоставление с образцом.

Миллер и Доллард (1941) предположили, что научение через наблюдение — частный случай оперантной дискриминации, которая включает соответствие моделируемому стимулу. В одном исследовании Миллер и Доллард (1941) показали, что при положительном подкреплении имитации у детей, она воспроизводилась относительно чаще, чем у тех, чью имитацию не подкрепляли дополнительно. Аналогичные процессы наблюдали у крыс и других животных (Хейк, Дональдсон и Хайтен, 1983).

Бандура (1969, 1977, 1986) отметил, что оперантное объяснение может быть ограничено — не все случаи из повседневной жизни соответствуют такой последовательности. Например, маленький ребенок смотрит «Улицу Сезам» по телевизору, где лягушка Кермит поет песню. Досмотрев передачу ребенок идет помогать родителям на кухню. На следующий день он поет эту песню, его исполнение приближено к исполнению куклы — он может не помнить каждое слово, но основная мелодия сохраняется. Ребенок никогда раньше не исполнял эту последовательность и никто ее не подкреплял, а еще имитация была отложенной, она возникла в отсутствие модели — Кермита не было рядом, когда ребенок подражал ему.

Хотя Бандура возражал против оперантного объяснения, Дональд Баэр предложил анализ имитации, который решает проблемы оперантной парадигмы (Баэр и Шерман, 1964; Баэр, Петерсон и Шерман, 1967) — это генерализованная имитация на основе оперантных принципов дискриминации и генерализации.

Процедуры генерализованной имитации начинаются с подкрепления соответствия или сопоставления между моделируемым поведением и имитационным оперантом. Подкрепление происходит, когда наблюдатель выполняет то же действие, что и модель. Если ребенка хвалить за подражание бессмысленной речи куклы, то имитация учащается.

Схема показывает процедуры дискриминации и включает несколько моделируемых стимулов (SDn) и оперантов (Rn). Кивок головы куклы — это дискриминативный стимул для кивка головой у ребенка и контекст, в котором угасает произнесение бессмысленных слов или движений ртом. Когда кукла открывает и закрывает рот — это дискриминативный стимул для подобного поведения ребенка и гашение альтернативных активностей.

Процедуры дискриминации для шейпинга генерализованной имитации. После обучения нескольким имитационным оперантам происходит тест на генерализацию без подкрепления.
Процедуры дискриминации для шейпинга генерализованной имитации. После обучения нескольким имитационным оперантам происходит тест на генерализацию без подкрепления.

Баэр и Шерман (1964) показали, что стимул новой модели создает возможность для новой имитации без подкрепления. Если кукла нажимает на рычаг, ребенок имитирует это без подкрепления. Генерализованная имитация объясняет появление имитации у детей, даже если поведение не подкрепляли.

Контекст может подразумевать задержку между предъявлением дискриминативного стимула и имитацией. Например, голубь клюет соответствующую образцу кнопку, но подкрепление зависит от задержки имитации на несколько секунд. Задержка может быть увеличена с помощью последовательных аппроксимаций, тогда поведение голубя будет точным даже через 20 секунд после исчезновения образца.

Аналогично эволюционирует имитация у детей. Взрослые подкрепляют имитацию начиная с ранних лет, но по мере взросления задержки в подкреплении становятся больше. Задержки между моделируемым поведением и имитацией могут возникать из-за особенностей социального контекста — никто не засмеется, если повторить шутку, но повторенная в другом месте и в нужное время шутка сработает.

Баэр и Шерман (1964) предположили, что сходство становится условным подкреплением. Когда ребенка учат имитации, подкрепление происходит только в контексте соответствия между поведением модели и ученика. Поскольку подкрепление коррелирует со сходством, имитация становится условным подкреплением (Эрьявец и соавторы, 2009).

Гевирц (1971) предложил альтернативное объяснение — нет необходимости считать сходство условным подкреплением. Он отметил, что нельзя разделять сходство и имитацию, которую оно объясняет. Для объяснения генерализованной имитации достаточно учитывать прерывистое подкрепление.

Эксперименты с генерализованной имитацией у младенцев

Эксперименты с генерализованной имитацией проводились с детьми (Эрьявец и соавторы, 2009). Большинства детей имеют обширную историю подкрепления имитации до участия в эксперименте. Более подходящий способ анализировать определяющие генерализованную имитацию факторы — использовать младенцев с нормальным развитием, но с ограниченной историей имитации.

В нескольких исследованиях было обнаружено, что младенцы в возрасте от девяти до восемнадцати месяцев уже справляются с тестами на генерализованную имитацию для объектно-ориентированных действий, вокализации и символических жестов (Поулсон и Киммиссис, 1998; Поулсон, Киммиссис, Рив, Андреатос и Рив, 1991; Поулсон, Кипариссос, Андреатос, Киммиссис и Парнес, 2002). Однако следующий исследования не обнаружили генерализованной имитации у младенцев в возрасте от года до двух лет (Хорн и Эрьявец, 2007; Эрьявец и соавторы, 2009).

Главное различие в этих исследованиях — Тестирование на целевое поведение имитации до начала моделирования и обучения соответствию. Исследования, которые используют подражания, которых нет в истории детей не обнаруживают генерализованную имитацию. После обучения соответствию, новые подражания новым моделям не происходит. Возможно, что им не хватает истории для сопоставления поведения моделируемым действиям. Но даже с дополнительной тренировкой успешного прохождения теста не происходило. (Хорн и Эрьявец, 2007). Эрьявец (2009) увеличил количество примеров для досрочного научения, чтобы установить сходство в качестве условного подкрепления (Баэр и Дегучи, 1985). Соответствие модели воспроизводилось у детей при прерывистом подкреплении — оперантной имитации — но они все также не проходили тесты на генерализованную имитацию.

Лабораторного контекста недостаточно для появления генерализованной имитации у детей — необходимо научение с использованием множества различных топографий, что невозможно в лабораторных исследованиях с двенадцатью примерами. По словам Дональда Баэра потребовалось несколько сотен примеров решенных соответствий и их подкрепления, чтобы установить генерализованную имитацию у Мариллы, ребенка с задержкой в развитии и без истории имитации. Появление генерализованной имитации требует наименования или маркировки моделируемого поведения.

Обучение генерализованной имитации

За двенадцать лет у Мариллы была ограниченная история шейпинга, которая включала хрипящие звуки, выполнение простых команд вроде «сядь», одевание и питание, поход в туалет, поворот ручки или открытие двери. Сотрудники школы Файркрест помогали Марилле, но были убеждены, что она «cлишком глупа, чтобы чему-то научиться». Баэр использовал оперантные принципы, чтобы научить Мариллу генерализованной имитации.

За час до обеда Мариллу привели в комнату, где стояли стол и стулья. Тренировка началась, когда c поднятой руки и фразы «сделай это» как дискриминативного стимула, который на тот момент не контролировал появление имитации у Мариллы. Следующий шаг включал себя физическую подсказку — Марилле помогли поднять руку в контексте дискриминативного стимула — и подкрепления — она получила ложку обеда и словесную похвалу. После нескольких дополнительных попыток Марилле требовалось все меньше помощи, и подкрепление появлялось в корреляции с самостоятельно поднятой рукой. Иногда она поднимала руку во время моделируемого поведения — эти случаи оставались без подкрепления. Таким образом Марилла стала поднимать руку, когда говорили «сделай это» и поднимали руку — происходила прямая имитация.

Другие имитационные операнты, например, постукивание левой рукой по столу и телу, были сформированы дифференциальным подкреплением. После семи успешно сформированных примеров, ей сказали «сделай это» и постучали по подлокотнику кресла — Марилла немедленно повторила, хотя конкретно это действие ранее никогда не подкрепляли. Это был первый случай генерализованной имитации.

С пополнением истории подкрепления имитации, новых подражаний становилось все больше. Некоторые были важны в повседневной жизни, например, каракули на бумаге, упорядочивание геометрических форм, залезание под стол и отрыжка. После ста двадцати примеров подкрепленной имитации девочка сразу имитировала новые примеры моделируемого поведения.

Чтобы показать важность подкрепления для новой имитации, контекст изменили. Когда Марилла в контексте модели делала что-либо, кроме имитации, подкрепление происходило по тридцатисекундному интервалу. Дифференциальное подкрепление другого поведения (DRO) снижает имитацию и подкрепляет поведение, которое несовместимо с ней. Менее чем за двадцать сессий частота подкрепленных и новых подражаний снизилась до нуля.

Затем подкрепление имитации восстановили. Мариллу обучали цепочкам имитации. Например, последовательности из подъема руки и вставания с места. Постепенно цепочку увеличили, пока Марилла не начала имитировать последовательности из семи реакций. Многие последовательностей включали новые подражания, которые ранее никогда не подкрепляли.

На заключительном этапе Баэр добавил вокальное поведение. Теперь модель включала в себя фразу «Сделай это», вставание со стула, перемещение на середину комнату и вздох «Ах». На моменте вокализации, этому, Марилла только сделала движение ртом, но ее мимика уже была первым шагом к успеху. С каждым повторением она продвигалась дальше и в конце завершила последовательность четким «Ах».

При стабильной имитации звуки стали объединять в слова — примерно через двадцать часов вокальной имитации Марилла смогла имитировать такие слова, как «Привет», «Хорошо», «Марилла» и названия знакомых предметов. Когда генерализованная имитация двигательных и вокальных реакций была сформирована, к эксперименту присоединились другие люди. Теперь любой мог работать с Мариллой, а с увеличением имитации, обучение сложным навыкам происходило быстрее.

Исследование Баэра показывает, что сложное поведение человека контролируется простыми принципами. Те же самые принципы объясняют развитие наблюдательного обучения в повседневной жизни.

Эксперимент с куклой Бобо

Альберт Бандура (1965) разработал эксперимент, чтобы показать сложную форму научения через наблюдение, а не генерализованную имитацию. В эксперименте по имитации агрессивного поведения участвовали дети. Каждый ребенок смотрел короткометражный фильм, в котором взрослый демонстрировал четыре формы агрессивного поведения в отношении надувной куклы Бобо (Бандура, Росс и Росс, 1963).

Каждое агрессивное действие сопровождалось вокализацией. Сидя на кукле Бобо, взрослый ударял ее кулаком в лицо и говорил: «Бах, прямо в нос, бум, бум». В другой последовательности взрослый ударял куклу молотком со словами «Лежать». Он пинал куклу Бобо со словами «Улетай» и бросал резиновые мячи в куклу со словами «Бах».

Одна группа детей увидела, как агрессивную модель награждал другой взрослый, который давал газировку, закуску и конфеты со словами «Сильный чемпион». Другая — видели, как агрессивная модель столкнулась с негативными последствиями: ее отругали и отшлепали за «приставание к кукле», и сделали предупреждение больше не вести себя так. Третья группа увидела смоделированную агрессию без каких-либо последствий со стороны третьих лиц.

Пирс и Чини: Генерализованная имитация и научение через наблюдение, image #3

После фильма детей отводили в комнату с игрушками и куклой Бобо. Им предлагали поиграть и оставляли в покое. Исследователи наблюдали за происходящим через одностороннее стекло и фиксировали случаи имитационной агрессии к кукле Бобо — появлялась высокая частота агрессии и мальчики были более агрессивны, чем девочки. Дети, которые видели наказание агрессии модели, меньше имитировали, чем те, кто видел подкрепление агрессии. Имитация у видевших подкрепление агрессии детей не отличалась от группы, не наблюдавших каких-либо сиюминутных социальных последствий. Простое наблюдение за моделируемой агрессией оказало такое же влияние на имитацию, как и наблюдение за подкреплением насилия.

Социальная когнитивная интерпретация научения через наблюдения у детей

Бихевиоральная интерпретация комплексного научения через наблюдение заключается в том, что она основана на процессах генерализованной имитации. Генерализованная имитация приносит новые случаи имитации. С оперантной точки зрения, имитация происходит в ситуациях, в которых она ранее подкреплялась.

Даг видел, как его брат Барри налетает на банку с печеньем перед ужином, за чем его ловит мама и отправляет в комнату. Позже Даг сам пробует украсть печенье — его тоже ловят и отправляют в комнату. На основе такой истории обусловливания, дети демонстрируют дифференциированную имитацию, которая основана на смоделированных последствиях. Даг избегает поведения, за которое Барри наказали, и имитирует подкрепленные действия брата. Такая история обусловливания объясняет результаты Бандуры о комплексном научении через наблюдение.

Различные результаты в исследовании с куклой Бобо также могут быть обусловлены историческим контекстом. Большинству детей знакомы обещания награды за выполнение каких-либо действий. Родители говорят «Мама и папа будут гордиться тобой, если ты запомнишь алфавит» и подкрепляют чтение азбуки — так происходит шейпинг запоминания событий. Такая история могла стоять за поведением детей, когда Бандура предлагал им вспомнить увиденное на записи, что индуцировало высокую частоту агрессивного поведения.

Правила, научение через наблюдение и самоэффективность

В диалоге с Ричардом Эвансом (1989) Альберт Бандура заявил:

Я развивал понятие моделирования как широкого явления, которое выполняет несколько функций. Эта концептуализация моделирования связана с извлечением наблюдателями правил и структуры поведения, а не с конкретными примерами, которые они наблюдают. Например, при изучении языка дети извлекают правила использования грамматики, а не имитируют отдельные предложения. С усвоением структуры и правил, они используют эти знания для создания новых моделей поведения, которые выходят за рамки того, что они видели или слышали. С усвоением языковых правил, они создают предложения, которые никогда не слышали. Моделирование — это сложный и абстрактный процесс, а не простой процесс имитации отдельной реакции (Эванс, 1989, стр. 5).

С бихевиоральной точки зрения «извлечение правил» — это вербальное оперантное поведение, которое описывает контекст (Скиннер, 1957, 1969). Скиннер и Бандура сходятся во мнении о важности правил для человеческого поведения, но они различаются в интерпретации.

Бандура говорит о правилах как о когнитивных событиях, которые используют для объяснения поведения, а Скиннер (1969) рассматривает правила как вербальные описания контекста. Для Скиннера следование правилам — это поведение под контролем вербальных дискриминативных стимулов. Правила, советы, максимы или законы являются дискриминативными стимулами, которые влияют на поведение. Вербальные дискриминативные стимулы влияют на обучение через наблюдение — эксперименты Бандуры по моделированию включают генерализованную имитацию, описания контекста и поведение под контролем правил. Поведенческие аналитики изучают каждый процесс по отдельности, чтобы понять, как они сочетаются в сложных формах человеческого поведения и научении через наблюдение.

Один из видов правил или описания контекста включает в себя утверждения о себе, например: «Я компетентный человек, который может справиться с ситуацией». Это самоописание противопоставляют утверждениям: «Я некомпетентный человек, который не в состоянии справиться ситуацией». Бандура (1997) называет такие реакции убеждениями о самоэффективности и доказывает, что эти когниции влияют на поведение (Бандура и Локк, 2003).

С точки зрения анализа поведения, утверждения о самоэффективности, как класс вербальных стимулов, влияет на последующее поведение. Например, с перспективой выступления перед большой аудиторией, Джон думает, что у него нет успешных разговорных навыков, и оценивает свои шансы на организованную, интересную и понятную презентацию в сорок процентов.

Впоследствии он плохо выступает с докладом. Утверждение Джона о самоэффективности описывает скромную историю участия в выступления. Как правило, вербальный стимул устанавливает соответствие в качестве подкрепления. Для большинства людей утверждение и следование правилам приводит к генерализованному социальному подкреплению со стороны вербального сообщества. На основе социальной обусловленности соответствия, утверждения о самоэффективности люди предсказывают поведение друг друга в возможных будущих ситуациях.

Текст: Вероника Пачина и Тимур Курицын
Оформление: Вероника Пачина
Оригинал: Pierce, W. D., & Cheney, C. D. (2017). Behavior analysis and learning: A biobehavioral approach. Routledge.

237 views·1 share