Пирс и Чини: Режимы наказания

Пирс и Чини: Режимы наказания, image #1

Наказанием называют снижение частоты активности вследствие ее корреляции с определенными событиями. Наказывающим является любое событие, что снижает частоту оперантной активности. Мюррей Сидман приводил альтернативное объяснения наказания.

Многие другие контекстуальные операции снижают частоту активности: насыщение, угасание, поведенческий контраст, изнеможение, ограничение, предварительное обязательство, более насыщенные альтернативные режимы подкрепления. Наказание — это когда корреляция определенного события и поведения снижает его частоту. Если шок появляется в корреляции с нажатием рычага, то относительная частота нажатий будет падать. Такая корреляция и ее влияние на поведение называются «положительным наказанием».

Положительное наказание

Положительное наказание происходит, когда событие появляется в корреляции с оперантом и сопровождается снижением его относительной частоты. Вторая ячейка на рисунке показывает корреляцию положительного наказания. Например, родитель шлепает ребенка за то, что он выбегает на улицу, и ребенок перестает это делать. В техническом смысле шлепки работают как наказание, только если снижают относительную частоту выбегания на улицу — повседневные разговоры о наказании сосредотачиваются на его внешнем виде и не учитывают изменение относительной частоты активности.

Например, крики и оскорбления в споре с другим человеком, который выражает политическую позицию будут положительным наказанием только в том случае, если другой человек прекратит говорить о политике. На практике крики и оскорбления могут работать как положительные подкрепления — появляясь в корреляции с разговорами о политике, относительная частота этих разговоров может увеличиваться — что часто и происходит. Положительное наказание — снижение относительной частоты оперантного поведения через корреляцию с определенным событием. Наказание всегда работает согласно такому функциональному определению.

«Сверхкоррекция» как положительное наказание

В прикладном анализе поведения сверхкоррекция — это процедура положительного наказания, которая использует «возмещение» для снижения относительной частоты деструктивного или агрессивного поведения. Человеку необходимо «восстановить нарушенную ситуацию до значительно лучшего состояния» (Фокс и Азрин, 1972, стр. 15).

Например, пациент психиатрического отделения, который разбрасывает мебель в гостиной и пугает или пристает к другим, должен с избытком — вернуть мебель на свои места и принести извинения. Сверхкоррекция может включать требовать от нарушителя интенсивной практики правильного поведения. Фокс и Азрин (1973) работали со самостимулирующим поведением четырех детей с аутизмом с помощью практики сверхкоррекции. По команде или с помощью физической подсказки от детей требовали совершать серию движений головй и руками, похожие на самостимуляцию. Эта процедура помогла снизить относительную частоту самостимуляции во всех четырех случаях.

Фокс и Азрин считали сверхкоррекцию «образовательной» процедурой, однако литература по теме явно показывает, что эта процедура влияет на поведение по типу наказания электрошоком (Макензи-Китинг & МакДональд, 1990). Механика сверхкоррекции в создании подчинения с правилами и командам авторитета — родителей, учителей или персонала. Неподчинение влечет за собой дополнительное наказание в виде физических ограничений или устранения из ситуации.

Сверхкоррекция включает в себя дифференциальное подкрепление альтернативного поведения или угасания, благодаря которым она эффективна как набор процедур. До настоящего поведенческие аналитики так и не взялись всерьез за компонентный анализ сверхкоррекции. Однако, изменяемое наказанием проблемное поведение поддерживается через корреляцию с подкреплением, относительная частота которого снижается, когда снижается относительная частота наказываемого поведения. Таким образом снижается относительная частота подкрепления в жизни человека — использование наказание во вмешательствах ухудшает жизнь. Одна из возможных стратегий использования наказания, в том числе сверхкоррекции, заключается в одновременном поиске альтернативных активностей с высокой относительной частотой подкрепления (Каутела, 1984).

Отрицательное наказание

Отрицательное наказание происходит, когда постоянно присутствующее событие исчезает в корреляции с активностью, и эта корреляция снижает относительную частоту активности. В экспериментальном примере у голодной птицы есть длительный доступ к пище, но если она клюет кнопку, то теряет возможность есть. Ребенок может сесть и начать смотреть телевизор в любой момент, но если он начинает носиться, то родители выключают телевизор, или водитель получает штраф за превышение скорости и вынужден отдать заработанные ранее деньги — корреляция положительного подкрепления исчезает в корреляции с наказываемой активности.

Отрицательное наказание путают с угасанием. Угасание происходит, когда ранее подкрепляемая активность перестает производить подкрепление. Голубь клюет кнопку для получения еды, но если запланировано угасание, то клевание перестает активировать раздатчик. Ребенку разрешают смотреть телевизор после выполнения домашнего задания, но если телевизор может сломаться, и тогда выполнение домашних заданий исчезнет вместе с просмотром.

Пример постоянного подкрепления — семейный обед. Обед включает в себя разговор с сестрой, передачу еды за столом или включение музыки. Облизывание тарелки, приводит к тому, что отец прогоняет из-за стола — происходит отрицательное наказание. Принуждение покинуть стол снижает частоту облизывай тарелки во время следующего семейного обеда.

Отрицательное наказание происходит, когда поведение перестает производить сиюминутное подкрепление. Если поведение происходит, то подкрепление ненадолго исчезает, после чего восстанавливается.

Таймаут

Принуждение выйти из-за стола — это таймаут положительного подкрепления (Ferster и Appel, 1961), который предполагает, что процедура снижает частоту облизывай тарелки. Во время таймаута нет доступа к положительному подкреплению и для нежелательного поведения нет времени в принципе.

В школе таймаут может предполагать исключение (Cooper, Heron и Heward, 2007). Во время таймаута без исключения ученика физически не отстраняют. Таймаут без исключения происходит, когда учитель планово игнорирует поведение, исключает положительное подкрепление или вручает стикер таймаута, который можно обменять на период таймаута. Таймаут с исключением предполагает пребывание человека в специальной комнате, использование разделенного пространства или нахождение в школьном коридоре.

Для эффективного таймаута, учитель должен убедиться, что занятия в классе подкрепляют поведение ученика; определить, какое поведение будет создавать таймаут; решить, какой метод использовать.

  • Необходимо указать продолжительность таймаута;
  • установить критерии исключения
  • получить разрешение на использование таймаута от директора школы и родителей;
  • как и во всех поведенческих вмешательствах, учитель должен вести точный отчет для оценки эффективности процедуры.

Штраф

Штраф — это отрицательное наказание, в котором забирают условные подкрепления и относительная частота поведения снижается. Контекст штрафов связан с потерей денег или привилегий за непослушание. В лаборатории штраф воплощается в подкреплении жетонами, которые затем забирают после появления определенной активности.

В эксперименте Вайнера (1962) действия людей производили световые сигналы с режимами VI или FI. Каждое действие помогало набирать жетоны — максимум сотню. Штрафные действия вычитали балл из счетчика.

Относительная частота активности начинала снижаться. Исследования с голубями, где световой сигнал функционировал как жетон, который можно было обменять на 2,5 секунды доступа к пище. Аналогично, относительная частота активности птиц угасала в контесте штрафов (Пьетрас и Хакенберг, 2005).

Относительность наказания

Принцип Примака (1959, 1962) говорит, что сопряженность высокочастотного поведения с низкочастотным поведением — это подкрепление; оно относительно, а не абсолютно. Примак (1971) переложил этот принцип на относительность наказания.

Крыса бегает в колесе и пьет воду из поилки. Механизм колеса активирует тормоз и блокирует вращение, а двигатель вращает колесо с определенной скоростью, и заставляет крысу бежать.

В контексте задержек и свободного доступа к воде, бег воспроизводится с относительной высокой частотой. Лишение крысы воды в контексте бега увеличивает относительную частоту питья. Вынужденный бег — последствие питья воды. Все зависит от относительной частоты бега и питья.

Когда бег воспроизводится относительно чаще, чем питье воды, тогда бег подкрепляет питье. И наоборот если питье воспроизводиться относительно чаще, то подкрепляет бег.

Анализ Примака показывает, что наказание так же относительно, а не абсолютно, как и подкрепление. Даже электрический шок, который рассматривают как наказание, может выглядеть как подкрепление в зависимости от контекста. Например, когда режим с фиксированным интервалом накладывается на режим подкрепления с фиксированной пропорцией или на режим подкрепления стимуляцией мозга (Хит, 1963; Сидман, Брэди, Борен, Конрад и Шульман, 1955).

Как сделать наказание более эффективным

Зачастую наказание снижает относительную частоту активности лишь временно — наказываемые активности поддерживаются определенным режимом подкрепления. При наказании возникает сложный режим — наказания накладываются на базовый уровень положительного подкрепления.

Внезапное введение наказания

Азрин, Хольц и Хек (1963) обнаружили, что птицы продолжают клевать кнопки даже при активных ударах электрическим током в 130 вольт, сопряженных с клевками. Этот эффект появлялся, когда начинали с 60 вольт и постепенно увеличивали напряжение. Однако голуби, внезапно получавшие разряд средней интенсивности в 80 вольт переставали клевать (Азрин, 1959; Миллер, 1960).

Майк купил новую стереосистему, и к нему пришли в гости друг Джо с его двухлетней дочерью. Ребенок, поев арахисового масла, идет к новому оборудованию. Майк нервно смотрит на друга, который говорит: «Эмили, не трогай — это новый проигрыватель Майка».

Но дочка все равно трогает ручки музыкальной системы Майка за 900 долларов. Джо говорит: «Пожалуйста, прекрати!». Эмили пачкает пальцами систему, поэтому Джо сердито смотрит на нее и громко говорит: «Я сказал, прекрати!». Эмили продолжает и ей угрожают: «Если ты не остановишься, папа тебя отшлепает!». Но она продолжает трогать стереосистему. В отчаянии Джо легонько шлепает Эмили, но она все еще не обращает внимания.

В такой ситуации наказание вводят с низкой интенсивностью и постепенно увеличивают. Лабораторные исследования показывают, что так выглядит формула создания «мазохизма». Лучшим решением проблемы со стереосистемой было бы вытереть руки ребенка.

Интенсивность наказания

Наказание необходимо вводить с умеренной интенсивностью. Положительное наказание с низкой интенсивностью может не повлиять на поведение (Аппел и Петерсон, 1965; Азрин, 1960). Несколько экспериментов показали, что интенсивное наказание может действовать долгосрочно (Аппел, 1961; Стормс, Борочи и Броен, 1962) — поведение не восстанавливается в течение некоторого времени, даже если потенциальной угрозы нет. Это происходит потому, что наказание пресекает контакт организма с существовавшим раннее контекстом.

Если после отмены наказания остается прошлый режим подкрепления, тогда поведение восстанавливается до прежнего уровня. Эти наблюдения привели Скиннера к предположению, что наказание имеет лишь временный эффект.

Сиюминутность наказания

Наказание эффективно снижает относительную частоту активности, когда оно происходит близко по времени к поведению (Азрин, 1956; Коэн, 1968). Этот эффект легко упустить, поскольку наказание индуцирует эмоциональное поведение, которое конкурирует с другими активностями. Если ребенка наказали за невоспитанность, то он сидит тихо, плачет или отводит взгляд от других. На бытовом языке говорят, что ребенок дуется; на техническом — произошла индукция конкурирующей активности. Несопряженное наказание будет индуцировать эмоциональные активности, но частота целевой активности останется прежней.

Эстес (1944) применял наказание с одной группой крыс сразу после нажатия рычага, а с другой группой наказание было отложенным. Обе группы стали меньше нажимать на рычаг. Спустя одиннадцать лет этот эксперимент повторили Хант и Брэди (1955) и предположили, что положительное наказание снижает оперантные реакции, поскольку индуцирует конкурирующее поведение.

Исследования Азрин (1956) показали, что после первого часа воздействия положительного наказания сиюминутное или отложенное наказание имеет большое значение. Активности, которые были наказаны после временной задержки, восстанавливались, но при сиюминутном наказании исчезали.

Режимы наказания

Положительное наказание наиболее эффективно, когда следует сразу за действием и происходит постоянно (Циммерман и Ферстер, 1963), а не периодически (Филби и Аппель, 1966).

Азрин, Хольц и Хек (1963) обучали голубей клевать кнопку в соответствии с трехминутным режимом подкрепления пищей. После установления базовой линии, шок предъявляли после ста, двухсот, трехсот, пятисот и тысячи нажатий клавиш. Частота клевков снижалась, даже когда наказание происходило после тысячи реакций.

Увеличение количества наказаний снижало количество клевков в час. По мере увеличения пропорции наказанных клевков их частота начинала снижаться. Постоянное наказание (FR1) было наиболее эффективным. Эффект аналогичен увеличению интенсивности наказания.

Паттерны частоты активности на различных режимах наказания (FR, FI, VI и VR) зеркально отражают паттерны на аналогичных режимах подкрепления. Например, график наказания FI, который наложен на график подкрепления VI, где голубь клюет кнопку, приводит к обратному «гребешку». То есть каждое наказание сопровождает высокая частота клевания, которая постепенно снижается с приближением следующего наказания (Азрин, 1956).

Текст: Вероника Пачина и Тимур Курицын
Оформление: Вероника Пачина
Оригинал: Pierce, W. D., & Cheney, C. D. (2017). Behavior analysis and learning: A biobehavioral approach. Routledge.

208 views·9 shares