Стивен Хайес и соавторы: Следование правилам и нечувствительность к последствиям
Перевод статьи «Rule-governed Behavior and Sensitivity to Changing Consequences of Responding» Стивена Хайеса, Аарона Дж. Браунштейна, Роберта Д. Зеттла, Ирвина Розенфарба и Замира Корна из майского выпуска рецензируемого журнала Jounal of the Experimental Analysis of Behavior за 1986 год. Эта публикация легла в основу одного из подходов третьей волны когнитивно-поведенческой терапии, терапии принятия и ответственности. Записывайтесь к Ивану или Артему на профессиональную психотерапию с использованием терапии принятия и ответственности, поведенческой активации и функционально-аналитической терапии через личные сообщения сообщества или t.me/nsakela!
Оперантное поведение у людей значительно отличается от поведения других видов. Во многих ситуациях поведение человека относительно нечувствительно к изменениям в запрограммированных последствиях реакций (Ader & Tatum, 1961; Harzem, Lowe, & Bagshaw, 1978; Matthews, Shimoff, Catania, & Sagvolden, 1977; Shimoff, Catania, & Matthews, 1981); иногда люди демонстрирует такие паттерны реакций на режимы подкрепления, которые систематически отличаются от реакции у других животных (Leander, Lippman, & Meyer, 1968; Lowe, Harzem, & Hughes, 1978; Weiner, 1964, 1969); а иногда люди демонстрируют бо́льшее разнообразие между друг другом, чем животные (Lippman & Meyer, 1967; Lowe, 1979). Некоторые из этих различий могут быть обусловлены влиянием вербального поведения (например, см. Baron & Galizio, 1983; Harzem et al., 1978; Lowe, 1983; Skinner, 1969).
Эта «языковая гипотеза» основана на нескольких фактах. Во-первых, до овладения языком человеческие младенцы в контексте простых режимов подкрепления ведут себя так же, как и другие животные (Lowe, Beasty, & Bentall, 1983). На поведение человека значительно влияют вербальные инструкции (см. обзор Baron & Galizio, 1983). При этом поведение людей при решении сложных задач с минимальными инструкциями схоже с поведением других животных (например, Lowe, Harzem, & Bagshaw, 1978; Lowe et al., 1978). По сравнению с прочим поведением, активности управляемые инструкциями менее чувствительны к последствиям (Matthews et al., 1977; Shimoff et al., 1981). Инструкции, касающиеся режимов подкреплений, могут вызывать порождать поведение, схожее с реакциями других животных (Baron & Galizio, 1983), но если условия меняются, люди всё равно реагируют согласно инструкции (Hayes, Brownstein, Haas, & Greenway, в печати).
Есть несколько объяснений того, почему вербальные стимулы ослабляют контроль последствий над поведением («эффект нечувствительности»). Марк Галицио предположил (Galizio, 1979), что вербальные стимулы порождают такие паттерны реагирования, которые исключают эффективное взаимодействие с изменениями в последствиях. Однако нечувствительность наблюдалась даже в случаях, когда контакт был установлен (Shimoff et al., 1981).
Согласно версии Байрон Э. Мэттьюса и соавторов (Matthews et al., 1977), инструкции обычно даются другими людьми в случаях, когда требуется быть нечувствительным, поэтому «нечувствительность является определяющим свойством контроля инструкций» (Shimoff et al., 1981, p. 207). Третий вариант — невосприимчивость к одному набору условий может быть обусловлена дополнительными условиями при помощи контроля инструкций. Согласно этой точке зрения, «эффект нечувствительности» — это не ослабление контроля над последствиями, а следствие конкурирующих режимов подкрепления, таких как социальные последствия за соблюдением правил (Hayes, Rosenfarb, Wulfert, Munt, Korn, & Zettle, 1985; Hayes & Wolf, 1984; Rosenfarb & Hayes, 1984; Zettle & Hayes, 1982).
Один из методов для оценки чувствительности к изменениям в запрограммированных последствиях реакций — развитии стабильного реагирования на режим подкрепление перед последующим изменением режима (например, Galizio, 1979; Shimoff et al., 1981). В другом случае использовалось несколько режимов (например, у Baron, Kaufman, & Stauber, 1969). Алан Бэрон и Марк Галицио (1983) отмечают несколько преимуществ процедуры с несколькими режимами, главным из которых является прямое и непрерывное измерение чувствительности к чередованию режимов подкрепления.
В настоящих экспериментах использовалось переключение нескольких режимов; были выбраны такие режимы, в которых значительно различается требование к частоте реакций для получений подкреплений. Инструкции, связанные с темпом, давались в отношении одного или обоих режимов (компонентов). Таким образом, инструкции в рамках одной и той же процедуры могли приводить к разным контактам с условиями.
Первый эксперимент
Дизайн
Нажатие кнопки подкреплялось очками, повышающими шанса получить денежный приз, согласно множественному режиму подкрепления — с фиксированным соотношением/дифференцированным подкреплением низкой частоты реакции (FR/DRL). Испытуемым давали инструкцию реагировать или медленно, или быстро, или одновременно медленно и быстро, или вообще не давали инструкций относительно частоты реагирования. Это позволяет оценить чувствительность к изменениям частоте подкреплений, которая должна повысить или понизить частоту реагирования, в зависимости от наличия или отсутствия соответствующих инструкций.
Испытуемыми стали 17 студентов колледжа (как мужчин, так и женщин). Они получили зачёт по вводному курсу психологии за участие в эксперименте. Экспериментальное устройство (рис. 1) состояло из коробки с 25 маленькими белыми лампочками, установленных на поверхность с наклонной передней частью (устройство сверху). Под ней находится ещё одна коробка с двумя маленькими лампочками и счётчик на левой части передней панели, два квадратных огонька в верхней части панели и три кнопки в нижней части. Небольшая коробка справа наверху углу с лампочками, обозначенными «Быстрее» (“Go Fast”) и «Медленее» (“Go Slow”), использовалась только в Эксперименте 2 и мы опишем её ниже.
Эксперимент проводился в небольшой комнате (1.8 м. на 2.7 м.), где находились стул, стол, экспериментальное устройство, наушники и плёночный магнитофон. Электромеханическое оборудование для записи и контроля располагалось в соседней комнате.
Процедура
Испытуемых распределили случайным образом на четыре группы по четыре–пять испытуемых: Минимальные инструкции, «Медленнее», «Быстрее» и Точные инструкции. Испытуемые работали индивидуально в течение трёх 32-минутных сессий с 5-минутными перерывами. В начале первой сессии всем испытуемым давали следующие печатные инструкции:
«Пожалуйста, прочитайте эти инструкции вместе со мной, когда я буду произносить их вслух. Это эксперимент по обучению, а не психологический тест. Нас интересуют некоторые аспекты процесса обучения, характерные для всех людей.
Во время сеанса вы будете находиться в этой кабине одни. Не снимайте наушники.
Когда начнется сеанс, загорится белая лампочка с надписью «Готов». В конце сеанса она погаснет. Сегодня будет три сеанса с небольшими перерывами между ними.
Время от времени над индикатором готовности будет загораться маленькая круглая красная лампочка. Когда она загорится, нажатие на среднюю кнопку добавит к счётчику 1 очко. Посмотрите, сколько очков вы сможете набрать. В конце эксперимента испытуемый, набравший больше всего очков за один сеанс, получит $20. Испытуемый на втором месте по очками получит $10. На третьем месте — $5. У вас будет по три сеанса, и каждый из них учитывается отдельно.
Для включения маленькой красной лампочки используются кнопки и лампочки. Красная лампочка загорится, когда загорится белая лампочка в правом нижнем углу световой панели».
Группа с минимальными инструкциями не получала дополнительных инструкций относительно частоты реакций.
Инструкция группы «Медленнее»:
«Лучше всего нажимать на кнопки с промежутком в несколько секунд».
Группе «Быстрее» сказали:
«Лучше всего нажимать на кнопку быстро».
Группе с точными инструкциями:
«Следите за индикаторами над кнопками. Когда горит один из них, быстрые нажатия на кнопки работают лучше всего. Когда горит другой, лучше всего работают нажатия с промежутком в несколько секунд».
Наконец, всем группам было сказано:
«Если у вас есть вопросы, задавайте их сейчас, потому что во время сессии экспериментатор не сможет отвечать на них».
Если испытуемые задавали вопросы, на них отвечали, повторяя соответствующую часть инструкции. Потом экспериментатор выходил из комнаты и начинал сеанс.
Во время пилотного тестирования представленная задача оказалась достаточно сложной, чтобы активно вовлечь испытуемых. В начале сессии в левом верхнем углу световой матрицы зажигался белый свет. Перемещение света в правый нижний угол зависело от нажатия на левую и правую кнопки. Нажатия перемещали свет между лампочками в соответствии со множественным режимом FR18/DRL 6 сек. Во время DRL первое нажатие кнопки через 6 секунд зажигало другую лампочку. При нажатии на левую кнопку свет перемещался вниз на одну строку, при нажатии на правую кнопку свет перемещался вправо на один столбец. Во время FR, если 18-е нажатие приходилось на левую кнопку, свет перемещался вниз, если на правую — вправо. Если горела права крайняя лампочка, то нажатие на правую вновку приводило ко сбросу и возврату света в левый верхний угол. Если свет находился в нижнем ряду, нажатие на левую кнопку также приводило к сбросу. Так, например, в режиме DRL любая комбинация из четырёх движений света, производимых нажатиями на левую кнопку, и четырех — на правую, приводила к тому, что индикатор загорается в правом нижнем углу и под стойкой загорается маленькая красная сигнальная лампочка. Однако, если любой из кнопок производил пять световых движений, свет сбрасывался и переводился в начальное положение и очки не начислялись.
Компоненты режимов DRL и FR предъявлялись каждые 2 минуты в случайной последовательности, во всех сессиях предъявлялась одна и та же последовательность. Каждый режим действовал в течение восьми 2-минутных интервалов в каждой сессии. Во время действия DRL над кнопками горела большая квадратная красная лампочка. Во время действия FR над кнопками горела большая квадратная оранжевая лампочка.
Во время сеанса испытуемые надевали наушники с музыкой, которая маскировала посторонние звуки. Если в начале первого сеанса испытуемые не демонстрировали реакций в течение 2 минут, сеанс останавливался и инструкции повторялась ещё раз. Повторные инструкции требовались не более чем одному испытуемому в каждой группе.
После сессий 1 и 2 у испытуемых был небольшой перерыв. Когда эксперимент продолжался, им говорили:
«Сейчас мы начнем следующую сессию. Инструкции те же, что и в первый раз. Если вы не помните инструкций, пожалуйста, обратитесь к своему листу с инструкциями».
Результаты и обсуждение
В центре внимания эксперимента было влияние инструкций, связанных с темпом, на различные режимы подкрепления, которые независимо друг от друга подкрепляли сильно различающиеся частоты реагирования, поэтому представляет интерес общая частота реагирования (на левую и правую кнопки вместе взятые) для каждого 2-минутного компонента множественного режима подкрепления. Эти данные представлены для каждой группы испытуемых на рисунках 2–5.
В группе с минимальными инструкциями (рис. 2) к третьей сессии все испытуемые реагировали с разной частотой по двум режимам, но ни один не получил более двух баллов по обоим режимам. Испытуемые 1, 2 и 3 получили баллы в основном в компоненте FR, а испытуемый 4 — в компоненте DRL (табл. 1). Показатели частоты реакций в заключительной сессии сильно различались для разных испытуемых и компонентов множественного режима. Однако для всех испытуемых показатели реакций были несколько выше в компоненте FT. Только у испытуемого 2 наблюдались значительные различия в показателях реакций по двум режимам (см. рис. 2).
В группе «Медленнее» (рис. 3) три испытуемых (5, 6 и 8) реагировали с разной частотой во время действия двух режимов. Четверо из пяти испытуемых заработали баллы в основном в компоненте DRL. Только испытуемый 7 заработал баллы в основном в компоненте FR. Во время заключительной сессии три из четырёх испытуемых в группе минимальных инструкций заработали баллы в основном в компоненте FR, и все испытуемые реагировали с большей частотой в компоненте FR; напротив, четыре из пяти испытуемых в группе «Медленнее» заработали баллы в основном в компоненте DRL, и двое из пяти испытуемых реагировали чаще в компоненте FR. У всех испытуемых, получивших инструкцию «Медленнее», частота реакций в компоненте FR была ниже, чем у трёх из четырёх испытуемых, получивших минимальные инструкции.
К концу третьей сессии у всех испытуемых в группы «Быстрее» сформировались чёткие паттерны реагирования и их частота реакций была выше в компоненте FR. Двое испытуемых заработали очки только в компоненте FR, а двое других — в обоих компонентах. Примечательно, что ни один из испытуемых в группе с минимальными инструкциями не получил больше двух баллов в обоих компонентах.
В группе с точными инструкциями (рис. 5 и табл. 1) все четыре испытуемых почти сразу показали большую разницу в частоте реакций в разных режимах с более высокими показателями по компоненту FR. К третьей сессии все испытуемые набрали не менее 15 баллов в обоих компонентах FR/DRL.
В предыдущих исследованиях наблюдалась относительно низкая чувствительность к изменению последствий реагирования, когда инструкции приводили высокой (например, Baron et al., 1969; Harzem et al., 1978; Matthews et al., 1977) или низкой (Shimoff et al., 1981) частоте реагирования. Использование множественного режима в нашем эксперименте позволило сравнивать чувствительность к последствиям, в зависимости от «быстрых» и «медленных» инструкций. Реакции в условии «Медленее» были особенно нечувствительны к изменениям в режиме подкрепления. А в группе «Быстрее» два из четырёх испытуемых значительно эффективнее реагировали в компоненте DRL, и это единственные испытуемые в Эксперименте 1, которые продемонстрировали однозначный контроль со стороны изменений режима подкреплений.
Результаты эксперименты говорят о том, что реагирование в соответствии в режимом подкрепления было совместным продуктом текущих последствий реагирования и обучающего контроля инструкций. Не считая инструкций, у испытуемых не было опыта взаимодействия с обоими типами запрограммированных последствий FR/DRL. Единый паттерн реакций сохранялся в обоих компонентах. Один из способов описания влияния инструкций заключается в том, что они определяли диапазон поведения, контролируя, был ли достигнут контакт с запрограммированными условиями. Для испытуемых из группы «Медленее» следование инструкции приводило ко множественному режиму DRL/EXT (гашение). Если частота реакций в компоненте, не связанном с DRL, была низкой (согласно инструкции), было мало движений лампочек (и очков), и активность в этом компоненте гасла или оставалась низкой. Если испытуемые «Быстрее» следовали правилу, они, по сути, находились в множественном режиме FR/EXT. По мере снижения частоты реакций в компоненте, не относящемся к FR, движения света (и точек) замедлялись в соответствии с компонентном DRL.
Этот анализ правдоподобен, но он лишь частично описывает результаты. Инструкции не просто изменили контакт с запрограммированными последствиями. Поведение некоторых испытуемых (например, испытуемого 7) вступало в контакт с последствиями, которые противоречили правилу, указанному в инструкции и правило продолжало контролировать поведение. Возможно, инструкции продолжали влиять на реакцию из-за того, что в прошлом испытуемые уже сталкивались с последствиями, если отвечали так, как было предписано. У людей обширные истории подкрепления выполнения инструкций других людей, когда они просто выполняли инструкции, независимо от последствий следующего из вербального правила поведения. Реакция, контролируемая такой историей, может быть слабо подвержена влиянию последствий, запрограммированных в нашем коротком эксперименте, поскольку она была вызвана соответствующей историей. Несколько исследований, проведенных в нашей лаборатории (Hayes, Brownstein, Devany, Kohlenberg, & Shelby, 1985; Hayes & Wolf, 1984; Rosenfarb & Hayes, 1984; Zettle & Hayes, 1983), показали, что различные терапевтические вмешательства работают только тогда, когда возможны социально опосредованные последствия соблюдения правил.
В Эксперименте 2 мы попытались сравнить обучающие эффекты, обусловленные двумя источниками контроля: (1) изменениями в диапазоне поведения, позволяющего контактировать с запрограммированными последствиями, и (2) историей последствий, предоставляемых вербальным сообществом в зависимости от соблюдения правил. Чтобы разделить источники контроля, экспериментальная стратегия заключалась в том, чтобы вводить инструкции, а затем отменять их. Когда инструкция отменяется, история последствий, связанных с выполнением правил, должна быть менее значимой. Таким образом, реакция, контролируемая этой историей, должна измениться. Однако обучающие эффекты, вызванные изменением связи между поведением и подкреплениями, должны сохраняться и после отмены инструкций, пока сами подкреплениями могут влиять. Полностью «отменить» инструкцию невозможно. В эксперименте 2, однако, это было частично достигнуто путем сопряжения конкретных инструкций с конкретными сигналами. Затем эти сигналы можно было подавать или отменять и отслеживать влияние на поведение.
Второй эксперимент
Дизайн
Испытуемыми стали 25 студентов бакалавриата (мужчины и женщины), отобранных тем же способом, что и в Эксперименте 1. Использовались те же обстановка и оборудование, что и в эксперименте 1, за исключением того, что сразу справа от коробки со световой матрицей (см. рис. 1) находилась коробочка с двумя большими круглыми лампочками: нижняя лампочка была красной и подписана «Медленнее»; верхняя лампочка была зеленой и подписана «Быстрее».
Процедура
Испытуемым давали те же общие инструкции, что и в Эксперименте 1. Дополнительно всем испытуемым было сказано:
«Лучше всего нажимать на кнопки быстро, когда горит зеленая лампочка с надписью „Быстрее“, и медленно, с промежутком в несколько секунд между нажатиями, когда горит красная лампочка с надписью „Медленнее“».
Все испытуемые подвергались воздействию того же множественного режима, что и в Эксперименте 1 — DRL 6 сек./FR18.
В Эксперименте 2 создавались шесть условий, в зависимости от того, как загорались лампочки «Быстрее» и «Медленнее». Парам групп поочередно давали только сигнал «Медленно», только сигнал «Быстрее», и чередовали «Быстрее» с «Медленнее» в течение 1-минутных периодов, то есть в каждом компоненте множественного режима подкрепления каждая сигнальная лампочка была включена половину времени. В одной из групп пары сигнал подавался все три сессии, а в другой — только в первой сессии, после чего сигнал не подавался. Испытуемые распределялись по условиям случайным образом.
Результаты и обсуждение
Результаты по шести группам представлены на рисунках 6–11. Наиболее важными являются сравнения между предъявлением инструкций в течение одной сессии и его предъявлением в течение трёх занятий. Если различий не видно, то эффекты, первоначально обусловленные правилом, очевидно, сохраняются за счёт подкреплений очками. Если же наблюдаются значительные различия, то могут быть задействованы дополнительные последствия, проявляющиеся только при действии правил. Были найдены доказательства для обоих гипотез.
«Медленные» условия. Испытуемые (23–26), которым подавался сигнал «Медленнее» в течение трёх сеансов, продемонстрировали две модели реагирования (рис. 6 и табл. 2). Испытуемые 23 и 24 начали с очень низкой частоты и быстро установили контакт с компонентом DRL. Как показано в Таблице 2, в компоненте FR не было заработано ни одного балла, и, как и испытуемый 6 в Эксперименте 1, оба испытуемых вскоре совсем перестали реагировать во время компонента FR. Испытуемые 25 и 26 продемонстрировали постепенное увеличение частоты реакций, за которым последовало чёткое дифференцированное реагирование в двух компонентах.
Результаты испытуемых в условии сигнала «Медленнее» в течение одной сессии (31–34) были похожи на результаты испытуемых в условии «Медленнее» в течение трёх сессиями (рис. 7 и табл. 2). Испытуемые 31 и 32 демонстрировали низкую частоту реакций на протяжении всего времени, в то время как испытуемый 33 перешёл к высокой частоте реакций в середине третьей сессии во время действия компонента FR. Только испытуемый 34 продемонстрировал изменения во второй сессии после отмены правила. Этот испытуемый, как и испытуемый 26 из группы трёх сессий, показал вначале умеренную частоту реакций в первой сессии, которая была достаточно высокой, чтобы она подкреплялась в компоненте FR.
Испытуемые в обеих группах «Медленнее» демонстрировали растущую дифференцированную частоту реакций в течение сессий. Контроль инструкций был достаточно сильным, особенно если учесть, что и инструкции, и световые сигналы подсказывали, что есть только два варианта темпа активности (как в условии с точными правилами и в противоположность условию «Медленнее» в Эксперименте 1). Три испытуемых с наибольшим количеством реакций в сессии 1 (25, 26 и 34) показали дифференцированные реакции в зависимости от режимов подкреплений к сессии 3. Ни один из трёх самых медленных испытуемых в сессии 1 (23, 24 и 31) такой дифференциации не демонстрировал. Таким образом, если инструкция «Медленнее» приводила к очень низкой частоте, нечувствительность сохранялась даже после отмены инструкций. В тех случаях, когда инструкция не приводила к низкой частоте, чувствительность к режиму появлялась даже при сохранении инструкции. Только испытуемый 34 продемонстрировал признаки того, что удаление светового сигнала привело к усилению контроля со стороны запрограммированных последствий, и это согласуется с результатами испытуемых группы «Медленее» в течение трёх сессий.
«Быстрые» условия. Все испытуемые, кроме испытуемого 30, в условии с сигналом «Быстрее» в течение трёх сессий показали сильно отличающуюся частоту реагирования в режимах FR и DRL (см. рис. 8). У испытуемых 27 и 29 разная частота реагирования сохранялась до конца первой сессии. Только испытуемый 30 показал высокую частоту реакций по обоим режимам во всех трёх сессиях.
Испытуемые в условиях, в которых работал сигнал «Быстрее» только в течение первой сессии, показали чатоту реакций (рис. 9), очень похожую на частоту реакций у испытуемых в условиях «Быстрее» в течение трёх сессий. Трое из четырёх испытуемых (36, 37 и 38) продемонстрировали влияние режимов к концу первой сессии. Другой испытуемый (35) набрал очень мало очков (всего четыре за все сеансы) и отвечал с одинаково высокой частотой во время обоих компонентов во время всех трёх сеансов.
Устранение светового сигнала не привело к усилению контроля со стороны режимов запрограммированных последствий. Как и в группе «Быстрее» в Эксперименте 1 и в группе «Быстрее» в течение трёх сессий в этом эксперименте, чувствительность к меняющимся режимам проявлялась во время присутствия инструкции.
«Быстрые/медленные» условия. При чередовании сигналов «Быстрее» и «Медленнее» во всех трёх сессиях был получен согласованный паттерн реакций (рис. 10). Частота реакций всех испытуемых, за исключением 22, в конце третьей сессии была под контролем сигналов. То есть они реагировали быстро на сигнал «Быстрее» и медленно на «Медленнее», независимо от компонента множественного режима FR/DRL. Большинство баллов, полученных всеми испытуемыми в этом условии, набиралось, когда сигналы соответствовали режиму.
Частота реакции испытуемых, которые подвергались воздействию чередующихся сигналов «Быстрее/медленнее» в течение только одной сессии, отличались от показателей предыдущей группы (см. рис. 11). В реакциях всех четырёх испытуемых наблюдался контроль со стороны сигнального света в течение первой сессии. Когда сигналы были убраны, поведение испытуемых сразу же перешло под контроль множественного режима. Например, все они показали частоту реагирования в компоненте DRL течение первых 2 минут после выключения подсказывающих сигналов, которая близка к показателям, наблюдавшимся в конце третьего сеанса. Анализ временных паттернов, в которых испытуемые получали баллы в первой сессии, показывает, что, за редким исключением, баллы были получены, когда обучающие огни совпадали с компонентами режима FR/DRL. Таким образом, контроль, осуществляемый сигнальными лампочками, обеспечивал контакт с обоими компонентами режима. Только после того, как сигнальные огни были убраны, появились различия в частоте реакций, соответствующие компонентам режима.
В итоге, когда инструкция обеспечивала лишь частичный контакт с подреплениями, как в условиях «Медленнее» или «Быстрее», удаление световых сигналов не усиливало контроль, осуществляемый запрограммированными условиями получения очков (подкрепления). Однако, когда инструкция обеспечивала контакт с обоими компонентами расписания, контроль со стороны подкреплений был «замаскирован» световым сигналом. Получение очков брало под поведение под контроль только после прекращения подачи сигналов.
Заключение
Наши эксперименты показывают, что (а) инструкции влияют на диапазон поведения, доступный для установления контакта с запрограммированными последствиями, и (б) инструкции могут отменять или изменять контроль со стороны запрограммированных последствий. Нажатие кнопки в данном случае одновременно участвовало в трёх наборах отношений: нажатие для получения очков и два типа следования правилам. Фактическая частота и паттерн нажатия кнопки были результатом взаимодействия между этими наборами отношений.
Можно выделить по крайней мере два набора последствий, которые могут создавать функционально различные классы поведения управляемого правилами (возможны и дополнительные классы; см. Hayes, в печати; Zettle & Hayes, 1982). В первом случае правила соблюдаются благодаря прошлому соответствию между правилом и естественными последствиями, как социальными, так и несоциальными. Этот тип следования правилам называется трекингом (для обозначения следования по вербально установленному пути), а функционирующее таким образом правило — треком (Zettle & Hayes, 1982). Например, если следование правилу «Путь в Бостон лежит по трассе 1» повышает вероятность того, что слушатель попадет в Бостон, и если попадание в Бостон является подкрепляющим событием, то попадание в Бостон при следовании этому правилу повышает вероятность того, что слушатель будет следовать аналогичным инструкциям от подобных лиц, устанавливающих правила, в будущем. В данном случае отслеживание, возможно, изменило поведение, доступное для установления контакта с подкреплениями.
Поведенческие эффекты производятся контактом с последствиями, а не запрограммированными последствиями (Anger, 1956; Herrnstein, 1970; Skinner, 1938). Когда инструкции определяют начальную форму поведения, они могут определять и фактические условия подкрепления. В результате поведение может отличаться от того, что наблюдалось бы при тех же запрограммированных условиях в отсутствие инструкций. Однако настоящие результаты показывают эффекты, которые нельзя объяснить только на основе этого анализа. Необходимо изучить, каким образом инструкции могут устанавливать дополнительные условия, которые затем конкурируют с запрограммированными условиями получения очков.
Второй тип следования правилам можно назвать послушностью. При послушности правило соблюдается благодаря прошлой истории социально опосредованного подкрепления следования правилам. Подкрепление послушности требует, чтобы члены вербального сообщества понимали, какое правило было сообщено и какое поведение соответствует этому правилу. Подкрепление послушности произвольно в том смысле, что к подкреплению приводит именно соответствие между правилом и поведением, а не само по себе конечное поведение.
Наиболее отчетливо послушность проявилась у испытуемых в двух условиях чередования сигналов «Быстрее/Медленнее» в Эксперименте 2. В условии чередования «Быстрее/Медленнее» в течение одного сеанса применимость правила от момента к моменту устранялась путем прекращения использования сигналов. Таким образом, соответствие между правилом и поведением больше не могло быть подкреплено. У испытуемых, несомненно, долгая история отношений с подобными ситуациями. Когда правило переставало действовать как подкрепление, испытуемые сразу же демонстрировали поведение, типичное для режима. В наших экспериментах социальное подкрепление за послушность не предъявлялось, но послушность — это класс следования правилам, который может быть вызван всякий раз, когда предшествующая история социально опосредованных подкреплений для следования правилам, независимо от того, присутствуют они в настоящий момент или нет.
Таким образом, топографически одно и то же поведение может быть примером трёх различных оперантов: послушности, трекинга и только условного поведения, непосредственно контролируемого начислением очков. Во многих случаях все три класса реакций присутствуют в разной степени. Например, мы полагаем, что правила в той или иной степени функционировали в качестве оперантов для всех испытуемых в Эксперименте 2, а не только для тех, кто входил в группы «Быстрее/Медленнее».
Различие между податливостью и отслеживанием согласуется с некоторыми литературными данными из социальной психологии (например, Deutsch & Gerard, 1955), показывающими, что инструкции часто теряют свою эффективность, когда у аудитории нет доступа к правилу. Известно, что в поведенческой терапии копинг-утверждения о себе (например, «Я не справлюсь», «Это ужасно») эффективны для модификации избегания, когда эти утверждения произносятся вслух терапевтом (Meichenbaum, 1972). Однако, если клиентам становится ясно, что даже их терапевт не может дать точные инструкции по совладанию с ситуацией, тогда эффект исчезает (Hayes & Wolf, 1984; Rosenfarb & Hayes, 1984; Zettle & Hayes, 1983). Аналогичные эффекты удалось выявить при постановке целей и процедурах самоподкрепления (Hayes et al., 1985) и даже при моделировании (Rosenfarb & Hayes, 1984). Похоже, что люди очень чувствительны к стимулам, которые сопровождают социальные последствия поведения в соответствии с публично представленными антецедентами. Это говорит о том, что в исследованиях оперантного поведения людей мы должны быть очень внимательны к возможным социальным аспектам вербальных манипуляций. Например, различные эффекты от правил, сформированных последствиями, и от правил, предложенных экспериментатором (Catania, Matthews, & Shimoff, 1982), могут быть обусловлены не последствиями самих правил, а социальными последствиями озвученных другим правил.
Послушность легко отличить от поведения, сформированного последствиями, из-за соответствия между правилом и соответствующим поведением, а трекинг отличается от прямого контроля последствиями, поскольку контролирующим поведение антецедентом является вербальный стимул. Исследования классов эквивалентности (например, Sidman, Rauzin, Lazar, Cunningham, Tailby, & Carrigan, 1982; Sidman & Tailby, 1982) показывают, что люди реагируют на символические отношения особым образом, и поэтому могут существовать важные различия между контролем, осуществляемым символическими стимулами по сравнению с другими стимулами. Недавние данные говорят, что стимулы, участвующие в классах эквивалентности, могут приобретать дискриминативные или условные подкрепляющие эффекты без прямого обучения (Hayes et al., 1985). Возможно, стоит думать о «правилах» как о дискриминативных или мотивационных стимулах, которые осуществляют этот контроль отчасти благодаря своему участию в классах эквивалентности, установленных вербальным сообществом. Они могут «уточнять» условия получения подкреплений. Из-за повсеместного присутствия символических стимулов, возможно, поведение управляемое только последствиями редко встречается у владеющих речью людей.
Множественные режимы FR/DRL — один из самых экстремальных методов изучения влияния инструкций, поскольку в таком контексте к получению подкрепления приводят два очень разных паттерна реакций. У этого метода есть заметные преимущества: можно использовать инструкции, которые влияют на один из компонентов, таким образом, обеспечивая непрерывную оценку влияния инструкций. Поскольку паттерны реакций настолько различны, поведение испытуемого может столкнуться с неточностью определённых инструкций — условием, которое, как было сказано, требуется для отказа от контроля инструкций (Kaufman, Baron, & Kopp, 1966).
Для отказа от контроля при помощи инструкций в нашем исследовании требовалась неточность, контакт с неточностью, ослабление послушности и длительного периода неэффективного реагирования под контролем правил. Когда правила были точными (например, в группе точных правил в Эксперименте 1), им следовали постоянно, как и следовало ожидать. Все остальные условия в наших экспериментах были в той или иной степени неточными. Испытуемые, которые сталкивались с явной неточностью правил, скорее всего, отказывались от контроля со стороны правил.
Например, испытуемые, которые реагировали быстро, когда им давали инструкцию «Медленнее», контактировали с неточностью правил, когда подкрепление происходило в компоненте FR; таким образом, они впоследствии с большей вероятностью демонстрировали реакцию, чувствительную к запрограммированным последствиям. Результаты Эксперимента 2 также показывают, что одного контакта с неточностью правил недостаточно для ослабления послушности. Контакт должен был происходить в течение длительного времени. В Эксперименте 2 испытуемые во всех группах могли получать очковые подкрепления примерно в половине случаев, если следовали правилам. Однако в группах «Медленнее» и «Быстрее», где были более длительные периоды (2 мин.), в течение которых реакция согласно правилам была неэффективной, послушность ослабевала сильнее, чем в группах «Быстрее/Медленнее», где периоды получения очков благодаря следованию правилу не превышали 1 мин. Неспособность различать неточность инструкций не может объяснить послушность испытуемых группы «Быстрее/Медленнее» по отношению к этим инструкциям, поскольку их показатели сразу же изменились, когда инструкции закончились.
Изучение влияния правил на слушателя может открыть новые пути к изучению вербального поведения в целом. Сила вербального контроля предполагает, что вербальные стимулы не должны намеренно использоваться без учёта долгосрочных последствий (см. обсуждение этого вопроса в Catania, 1984). Повсеместное распространение вербальных стимулов, по-видимому, позволяет правилам оказывать значительное влияние на поведение человека.
ССЫЛКИ
- Ader, R., & Tatum, R. (1961). Free-operant avoidance conditioning in human subjects. Journal of the Experimental Analysis of Behavior, 4, 275-276.
- Anger, D. (1956). The dependence of interresponse times upon the relative reinforcement of different interresponse times. Journal of Experimental Psychology, 52, 145-161.
- Baron, A., & Galizio, M. (1983). Instructional control of human operant behavior. Psychological Record, 33, 495-520.
- Baron, A., Kaufman, A., & Stauber, K. A. (1969). Effects of instructions and reinforcement-feedback on human operant behavior maintained by fixed-interval reinforcement. Journal of the Experimental Analysis of Behavior, 12, 701-712.
- Catania, A. C. (1984). Learning (2nd ed.). Englewood Cliffs, NJ: Prentice-Hall.
- Catania, A. C., Matthews, B. A., & Shimoff, E. (1982). Instructed versus shaped human verbal behavior: Interactions with nonverbal responding. Journal of the Experimental Analysis of Behavior, 38, 233-248.
- Deutsch, M., & Gerard, H. B. (1955). A study of normative and informational social influences upon individual judgment. Journal of Abnormal and Social Psychology, 51, 629-636.
- Galizio, M. (1979). Contingency-shaped and rule-governed behavior: Instructional control of human loss avoidance. Journal of the Experimental Analysis of Behavior, 31, 53-70.
- Harzem, P., Lowe, C. F., & Bagshaw, M. (1978). Verbal control in human operant behavior. Psychological Record, 28, 405-423.
- Hayes, S. C. (Ed.). (in press). Rule-governed behavior: Cognition, contingencies, and instructional control. New York: Plenum Press.
- Hayes, S. C., Brownstein, A. J., Devany, J. M., Kohlenberg, B., & Shelby, J. (1985, November). Conditioned reinforcement and discriminative control: Acquisition through equivalence classes. Paper presented at the meeting of the Southeastern Association for Behavior Analysis, Charleston, SC.
- Hayes, S. C., Brownstein, A. J., Haas, J. R., & Greenway, D. E. (in press). Rules, multiple schedules, and extinction: Distinguishing differential responding from schedule sensitivity when rules are present. Journal of the Experimental Analysis of Behavior.
- Hayes, S. C., Rosenfarb, I., Wulfert, E., Munt, E. D., Korn, Z., & Zettle, R. D. (1985). Self-reinforcement effects: An artifact of social standard setting? Journal of Applied Behavior Analysis, 18, 201-214.
- Hayes, S. C., & Wolf, M. R. (1984). Cues, consequences and therapeutic talk: Effects of social context and coping statements on pain. Behaviour Research and Therapy, 22, 385-392.
- Herrnstein, R. J. (1970). On the law of effect. Journal of the Experimental Analysis of Behavior, 13, 243-266. Kaufman, A., Baron, A., & Kopp, R. E. (1966). Some effects of instructions on human operant behavior. Psychonomic Monograph Supplements, 1, 243-250.
- Leander, J. D., Lippman, L. G., & Meyer, M. E. (1968). Fixed interval performance as related to subjects' verbalization of the reinforcement contingency. Psychological Record, 18, 469-474.
- Lippman, L. G., & Meyer, M. E. (1967). Fixed interval performance as related to instructions and to subjects' verbalizations of the contingency. Psychonomic Science, 8, 135-136.
- Lowe, C. F. (1979). Determinants of human operant behaviour. In M. D. Zeiler & P. Harzem (Eds.), Advances in analysis of behaviour: Vol. 1. Reinforcement and the organization of behaviour (pp. 159-192). Chichester, England: Wiley.
- Lowe, C. F. (1983). Radical behaviorism and human psychology. In G. C. L. Davey (Ed.), Animal models of human behavior (pp. 71-93). Chichester, England: Wiley.
- Lowe, C. F., Beasty, A., & Bentall, R. P. (1983). The role of verbal behavior in human learning: Infant performance on fixed-interval schedules. Journal of the Experimental Analysis of Behavior, 39, 157-164.
- Lowe, C. F., Harzem, P., & Bagshaw, M. (1978). Species differences in temporal control of behavior. II: Human performance. Journal of the Experimental Analysis of Behavior, 29, 351-361.
- Lowe, C. F., Harzem, P., & Hughes, S. (1978). Determinants of operant behaviour in humans: Some differences from animals. Quarterly Journal ofExperimental Psychology, 30, 373-386.
- Matthews, B. A., Shimoff, E., Catania, A. C., & Sagvolden, T. (1977). Uninstructed human responding: Sensitivity to ratio and interval contingencies. Journal of the Experimental Analysis of Behavior, 27, 453-467.
- Meichenbaum, D. H. (1972). Cognitive modification of test anxious college students. Journal of Consulting and Clinical Psychology, 39, 370-380.
- Rosenfarb, I., & Hayes, S. C. (1984). Social standard setting: The Achilles heel of informational accounts of therapeutic change. Behavior Therapy, 15, 515-528.
- Shimoff, E., Catania, A. C., & Matthews, B. A. (1981). Uninstructed human responding: Responsivity of low-rate performance to schedule contingencies. Journal of the Experimental Analysis of Behavior, 36, 207-220.
- Sidman, M., Rauzin, R., Lazar, R., Cunningham, S., Tailby, W., & Carrigan, P. (1982). A search for symmetry in the conditional discriminations of rhesus monkeys, baboons, and children. Journal of the Experimental Analysis of Behavior, 37, 23-44.
- Sidman, M., & Tailby, W. (1982). Conditional discrimination vs. matching to sample: An expansion of the testing paradigm. Journal of the Experimental Analysis of Behavior, 37, 5-22.
- Skinner, B. F. (1938). The behavior of organisms. New York: Appleton-Century-Crofts.
- Skinner, B. F. (1969). Contingencies of reinforcement: A theoretical analysis. New York: Appleton-CenturyCrofts.
- Weiner, H. (1964). Conditioning history and human fixed-interval performance. Journal of the Experimental Analysis of Behavior, 7, 383-385.
- Weiner, H. (1969). Controlling human fixed-interval performance. Journal of the Experimental Analysis of Behavior, 12, 349-373.
- Zettle, R. D., & Hayes, S. C. (1982). Rule-governed behavior: A potential theoretical framework for cognitive-behavioral therapy. In P. C. Kendall (Ed.), Advances in cognitive-behavioral research and therapy (Vol. 1, pp. 73-118). New York: Academic Press.
- Zettle, R. D., & Hayes, S. C. (1983). Effects of social context on the impact of coping self-statements. Psychological Reports, 52, 391-401.
Переводил Артем Ефремов, редактировал Иван Чистяков, иллюстрации Вероники Романовой. Подписывайтесь на не.психологию, чтобы не пропустить новые материалы. Записывайтесь к Ивану или Артему на профессиональную психотерапию с использованием терапии принятия и ответственности, поведенческой активации и функционально-аналитической терапии через личные сообщения сообщества или t.me/nsakela!
