
行動心理学において、強化とは、特定の先行刺激が存在する場合に、生物の将来の行動の可能性を高める結果を指します。[ 1 ]例えば、ネズミは、ライトが点灯するたびにレバーを押して餌をもらうように訓練することができます。この例では、ライトが先行刺激、レバーを押すことがオペラント行動、餌が強化子です。同様に、教師の質問に答えたときに注目と賞賛を受けた生徒は、授業中に今後質問に答える可能性が高くなります。教師の質問が先行刺激、生徒の反応が行動、賞賛と注目が強化子です。罰は強化の逆であり、反応が起こる可能性を低下させるあらゆる行動を指します。オペラント条件付けの用語では、罰は痛み、恐怖、または身体的な行動を伴う必要はありません。短い口頭での不承認の表明でさえ、一種の罰です。[ 2 ]
主観的な「欲しい」や「好き」といった欲求行動につながる結果は、報酬または正の強化として機能します。[ 3 ]また、望ましくない刺激を取り除く負の強化もあります。負の強化の例としては、頭痛を和らげるためにアスピリンを服用することが挙げられます。
強化は、オペラント条件付けと行動修正の重要な要素です。この概念は、子育て、コーチング、セラピー、自己啓発、教育、経営など、さまざまな実践的な分野で応用されています。
行動科学において、正と負という用語は、厳密な専門用語として用いられる場合、条件づけを行う者が行う行動の性質を指し、反応するオペラントによるその行動とその結果の評価を指すものではない。正の行動とは、快か不快かを問わず、環境に何らかの要素を加える行動であり、負の行動とは、環境から快か不快かを問わず、何らかの要素を取り除く、あるいは差し控える行動である。
一方、厳密な意味での強化とは、報酬に基づく条件付けのみを指し、不快な要因の導入や快い要因の除去または差し控えは罰と呼ばれ、厳密な意味で用いられる場合は強化とは対照的な意味を持つ。
したがって、正の強化とは快い要素の追加を指し、正の罰(タイプI罰と呼ばれることもある)とは不快な要素の追加を指し、[ 7 ]負の強化とは不快な要素の除去または差し控えを指し、負の罰(タイプII罰)とは快い要素の除去または差し控えを指します。[ 7 ]
この用法は、4つの用語の組み合わせの非専門的な用法、特に「負の強化」という用語の場合と矛盾しています。非専門的な用法では、強化は報酬と罰の両方を含むものと解釈され、負は反応するオペラントがその要因を不快だと認識することを指すと解釈されるため、負の強化という用語が専門用語としてよく使われることはありません。対照的に、専門用語では、マーティン・セリグマンの犬が電気ショックを避けることを学習する実験のように、不快な要因が存在するか、または存在するであろう状況を作り出すことによって、特定の行動を促すことを「負の強化」という用語で説明します。
B・F・スキナーは、強化と行動主義の多くの理論的構成要素を明確にした、著名で影響力のある研究者でした。スキナーは、何が楽しいか、何が価値があるかといった主観的な基準ではなく、反応の強さ(反応率)の変化に基づいて強化子を定義しました。したがって、楽しい、あるいは心地よいとみなされる活動、食べ物、または物品は、必ずしも強化子であるとは限りません(それらは先行する反応の増加をもたらさないため)。刺激、状況、活動は、潜在的な強化子の直前の行動が将来同様の状況で増加する場合にのみ、強化子の定義に当てはまります。たとえば、クッキーをねだったときにクッキーをもらう子供の場合です。「クッキーを求める行動」の頻度が増加すれば、クッキーは「クッキーを求める行動」を強化していると言えます。しかし、「クッキーを求める行動」が増加しない場合、クッキーは強化子とはみなされません。
刺激が強化因子であるかどうかを判断する唯一の基準は、その潜在的な強化因子を与えた後の行動の確率の変化である。他の理論では、人が特定の行動によって特定の結果が生じると予想していたかどうかといった追加的な要因に焦点を当てる場合もあるが、行動理論では、強化は反応の確率の増加によって定義される。
強化の研究は、再現可能な膨大な実験結果を生み出してきた。強化は、特別支援教育、応用行動分析、行動の実験分析における中心的な概念および手順であり、特に依存症、中毒、強迫といった医学および精神薬理学モデルにおける中核概念でもある。
強化に関する実験室研究は、通常、パズルボックスから猫が脱出する実験で知られるエドワード・ソーンダイクの研究に遡る。 [ 8 ]他の多くの研究者もこの研究を引き継ぎ、特にBFスキナーは、 1938年に『生物の行動』でこのテーマに関する画期的な研究を発表し、その後の多くの出版物でこの研究を詳しく論じた。[ 9 ]特にスキナーは、行動形成において正の強化は罰よりも優れていると主張した。[ 10 ]罰は強化とは正反対のように見えるかもしれないが、スキナーは両者は大きく異なると主張し、正の強化は永続的な行動修正(長期的)をもたらすのに対し、罰は行動を一時的に(短期的)しか変えず、多くの有害な副作用があると述べた。
その後、多くの研究者が強化に関する理解を深め、スキナーの結論の一部に異議を唱えました。例えば、アズリンとホルツは罰を「その行動の将来の確率を低下させる行動の結果」と定義し[ 11 ] 、いくつかの研究では、正の強化と罰は行動の修正において同等の効果があることが示されています。正の強化、負の強化、罰の効果に関する研究は、これらの概念が学習理論の基礎であり、その理論の多くの実践的な応用にも適用されるため、今日でも続けられています。
オペラント条件づけという用語は、スキナーが自身の実験パラダイムにおいて生物が環境に自由に作用できることを示すために導入したものである。このパラダイムでは、実験者は望ましい反応を誘発することはできない。実験者は反応が起こるのを待ち(生物から反応が発せられるのを待ち)、その後、潜在的な強化子を与える。古典的条件づけパラダイムでは、実験者は反射を誘発する刺激である無条件刺激(UCS)を提示し、それに中性刺激である条件刺激(CS)を対提示(先行)することで、望ましい反応を誘発(引き起こす)する。
強化はオペラント条件づけにおける基本的な用語です。オペラント条件づけにおける罰の側面については、「罰(心理学)」を参照してください。
正の強化とは、望ましい出来事や刺激が行動の結果として提示され、同様の環境でその行動が現れる可能性が高まる場合に起こります。[ 12 ]: 253 例えば、本を読むことが楽しい場合、その楽しさを経験することで、楽しい本を読むという行動が正に強化されます。正の強化を受けた人(つまり、本を読むのが楽しい人)は、もっと楽しむためにさらに多くの本を読むでしょう。
高確率指示(HPI)療法は、正の強化の考え方に基づいた行動主義的な治療法である。
負の強化は、嫌悪的な状況や刺激を回避または逃避する行動の頻度を増加させます。[ 12 ]: 252-253つまり、すでに不快なことが起こっており、その行動は、その人が不快な状況を回避または逃避するのに役立ちます。快い刺激を加える正の強化とは対照的に、負の強化では、不快な状況や刺激の除去に焦点が当てられます。たとえば、誰かが不幸を感じている場合、嫌悪的な状況(たとえば、不幸な感情)から逃れるために、行動(たとえば、本を読むこと)を行うかもしれません。[ 12 ]: 253 その回避行動または逃避行動が不快な状況や刺激を除去することに成功すると、その行動が強化されます。
行動が再び起こらないようにするために、人に不快なことをするのは罰であり、負の強化ではありません。[ 12 ]: 252主な違いは、強化は常に行動の可能性を高める(例:退屈しているときにチャンネルサーフィンをすると一時的に退屈が和らぐので、退屈しているときにチャンネルサーフィンをする回数が増える)のに対し、罰はそれを減少させる(例:二日酔いは不快な刺激なので、人々はその不快な刺激につながる行動を避けることを学ぶ)ということです。
消去は、特定の行動が無視される(つまり、何の報いも受けずに終わる)ときに起こります。行動は、継続的に強化されないと、時間とともに消滅します。意図的な消去では、対象となる行動はまず急増し(以前に強化された期待される効果を生み出そうとして)、その後、時間とともに減少します。強化も消去も、対象者の行動に影響を与えるために意図的である必要はありません。たとえば、子供が本を読むのが楽しいから読んでいる場合、親が読書を無視するという決定をしても、子供が読書から得ている肯定的な強化(つまり、楽しさ)は失われません。しかし、子供が親の注意を引くために行動している場合、親がその行動を無視するという決定をすると、その行動は消滅し、子供は親の注意を引くために別の行動を見つけるでしょう。
強化子は行動を増加させる働きをし、罰子は行動を減少させる働きをします。したがって、正の強化子は被験者が獲得しようと努力する刺激であり、負の強化子は被験者が取り除こうと努力したり、終わらせようと努力する刺激です。[ 13 ]下の表は、強化と罰に関連して刺激(快または嫌悪)を追加および削除することを示しています。
一次強化子(無条件強化子とも呼ばれる)は、強化子として機能するために他の刺激と対にする必要がなく、進化と種の生存における役割を通じてこの機能を獲得した可能性が高い刺激である。 [ 15 ]一次強化子の例としては、食物、水、セックスなどがある。特定の薬物など、一部の一次強化子は、他の一次強化子の効果を模倣する可能性がある。これらの一次強化子は生涯を通じて個人間でかなり安定しているが、異なる一次強化子の強化価は、複数の要因(遺伝、経験など)によって異なる。したがって、ある人はある種の食物を好むが、別の人はそれを避けるかもしれない。あるいは、ある人は食物をたくさん食べるが、別の人はほとんど食べないかもしれない。つまり、食物はどちらの個人にとっても一次強化子であるが、強化子としての食物の価値は個人によって異なる。
二次強化子(条件付け強化子とも呼ばれる)とは、強化子として機能する刺激と対提示された後に、強化子としての機能を獲得した刺激または状況のことである。この刺激は、一次強化子である場合もあれば、別の条件付け強化子(例えばお金)である場合もある。
人間の例で一次強化子と二次強化子を区別しようとする場合、「原始人テスト」を用いると良いでしょう。刺激が原始人が自然に好むもの(例えばキャンディー)であれば、それは一次強化子です。一方、原始人が反応しないもの(例えば1ドル札)であれば、それは二次強化子です。一次強化子と同様に、生物は二次強化子に対しても満足感や欠乏感を経験することができます。
チャールズ・ファースターは、1967年の論文「恣意的強化と自然強化」の中で、強化を、行動そのものの自然な結果としてオペラント行動の頻度を増加させる事象と、トークンエコノミーのように、人間の介入を必要とすることで頻度に影響を与える事象(例えば、被験者が特定の行動に対してセラピストから報酬を受け取る場合)に分類することを提案した。
1970年、ベアとウルフは「行動トラップ」の概念を提唱した。[ 19 ]行動トラップは、トラップに入るには単純な反応しか必要としないが、一度トラップに入ると、一般的な行動変化を引き起こすために抵抗することはできない。行動トラップを用いることで、その行動が自然に強化される機会を与え、行動のレパートリーを増やすことができる。行動トラップには4つの特徴がある。
このように、人工的な強化は、汎用性の高いスキルを構築または発展させるために使用でき、最終的には、行動を維持または増加させるために自然発生的な強化へと移行することができる。別の例としては、特定の行動が一定の基準を満たせば、一般的にその行動から生じる社会的な状況が挙げられる。
行動は必ずしも毎回強化されるとは限らず、強化のパターンはオペラント反応の学習速度、特定の時点での反応頻度、そして強化が停止した後の反応の継続期間に大きく影響します。強化を制御する最も単純なルールは、すべての反応が強化される連続強化と、すべての反応が強化されない消去です。これらの両極端の中間に位置する、より複雑な強化スケジュールは、反応の後に強化子が続く方法とタイミングを決定するルールを規定します。
特定の強化スケジュールは、特定の反応パターンを確実に誘発し、これらの規則は多くの異なる種に当てはまります。強化の一貫性と予測可能性の変動は、さまざまなスケジュールがどのように機能するかに重要な影響を与えます。BFスキナーは、ハトを用いて、多くの単純なスケジュールと複雑なスケジュールを詳細に研究しました。

単純なスケジュールでは、特定の反応に対して特定の種類の強化子をいつ与えるかを決定する単一のルールが存在します。
単純なスケジュールは、多くの差別的強化法[ 21 ]で利用されています。
複合スケジュールは、同じ行動に対して同じ強化子を用いて、2つ以上の異なる単純スケジュールを何らかの方法で組み合わせたものです。多くの可能性が存在しますが、最もよく使われるものとしては以下のようなものがあります。

心理学用語の「強化スケジュールの重ね合わせ」とは、2つ以上の単純な強化スケジュールが同時に作用する報酬構造を指します。強化子は、正の強化子、負の強化子、またはその両方である可能性があります。例として、仕事で長い一日を終えて帰宅した人が挙げられます。玄関のドアを開けるという行動は、配偶者からの大きなキスと、熱心に飛び跳ねる飼い犬によるズボンの破れという形で報酬を得ます。強化スケジュールの重ね合わせの別の例としては、実験用のケージの中でボタンをつつくハトが挙げられます。ハトがボタンをつつくと、20回つつくごとに餌の入ったホッパーが出て、200回つつくごとに水が飲めるようになります。
重ね合わせ強化スケジュールは、BF スキナーとその同僚による単純強化スケジュールに関する初期の研究から発展した複合スケジュールの一種です (Skinner and Ferster, 1957)。彼らは、強化子をスケジュールに従って与えることができること、さらに生物は異なるスケジュールの下で異なる行動をとることを実証しました。食物や水などの強化子が何らかの行動の結果として毎回与えられるのではなく、強化子は行動が複数回発生した後に与えられることがあります。たとえば、ハトは餌が出てくる前にボタン スイッチを 10 回つつく必要があるかもしれません。これは「比率スケジュール」と呼ばれます。また、強化子は目標行動の後に一定時間経過した後に与えられることもあります。たとえば、最後のレバー押しから 2 分経過した後に最初の反応が起こった直後に餌のペレットを与えられるラットが挙げられます。これは「間隔スケジュール」と呼ばれます。
さらに、比率スケジュールでは、個体による一定または変動する行動回数に応じて強化を与えることができます。同様に、間隔スケジュールでは、個体による単一の反応から一定または変動する時間間隔に応じて強化を与えることができます。個々の行動は、強化スケジュールの作成方法に応じて異なる反応率を生み出す傾向があります。その後、多くの研究室で、強化子のスケジュール設定が行動に及ぼす影響について多くの研究が行われました。
生物が同時に 2 つ以上の単純な強化スケジュールの中から選択する機会を与えられる場合、その強化構造は「同時強化スケジュール」と呼ばれます。Brechner (1974、1977) は、人間が漁業資源を乱獲したり、熱帯雨林を伐採したりするような社会的罠の実験室アナロジーを作成するために、重ね合わせ強化スケジュールの概念を導入しました。Brechner は、単純な強化スケジュールが互いに重ね合わされる状況を作り出しました。言い換えれば、生物による単一の反応または一連の反応が複数の結果につながるということです。同時強化スケジュールは「または」スケジュール、重ね合わせ強化スケジュールは「かつ」スケジュールと考えることができます。Brechner と Linder (1981) および Brechner (1987) は、重ね合わせスケジュールと社会的罠のアナロジーがシステムを通してエネルギーが流れる方法を分析するためにどのように使用できるかを説明するために、この概念を拡張しました。
強化スケジュールの重ね合わせは、社会的罠を生み出す以外にも、現実世界で多くの応用例があります。単純な強化スケジュールを重ね合わせることで、さまざまな人間の個人的および社会的な状況を作り出すことができます。たとえば、人間はタバコとアルコールの両方に同時に依存している可能性があります。2つ以上の同時スケジュールを重ね合わせることで、さらに複雑な状況を作り出したり、シミュレートしたりできます。たとえば、高校3年生は、スタンフォード大学かUCLAに進学するかを選択でき、同時に陸軍か空軍に入隊するかを選択でき、さらに同時にインターネット企業かソフトウェア企業に就職するかを選択できる可能性があります。これは、3つの同時強化スケジュールが重ね合わされた強化構造です。
強化スケジュールを重ね合わせることで、クルト・レヴィン(1935)が提唱した3つの古典的な葛藤状況(接近-接近葛藤、接近-回避葛藤、回避-回避葛藤)を作り出すことができ、また、レヴィンの力場分析によって分析された他のレヴィン的状況を操作化することもできる。強化スケジュールを重ね合わせる分析ツールとして用いた他の例としては、家賃統制の偶発性(Brechner、2003)や、ロサンゼルス郡の雨水排水システムにおける有害廃棄物投棄問題(Brechner、2010)への応用が挙げられる。
オペラント条件づけにおいて、同時強化スケジュールとは、動物被験者または人間参加者が同時に利用できる強化スケジュールのことで、被験者または参加者はどちらのスケジュールにも反応することができます。例えば、二者択一強制選択課題では、スキナー箱の中のハトに2つのつつきキーが提示されます。どちらのキーでもつつくことができ、どちらのキーをつつくと食物による強化が得られる可能性があります。2つのキーをつつくための強化スケジュールは異なっていても構いません。それらは独立している場合もあれば、一方のキーでの行動がもう一方のキーでの強化の可能性に影響を与えるように連動している場合もあります。
2つのスケジュールに対する反応は、物理的に区別される必要はありません。1958年にファインドレーによって導入された、同時スケジュールの別の配置方法では、両方のスケジュールが1つのキーまたはその他の応答装置に配置され、被験者は2つ目のキーでスケジュールを切り替えることができます。このような「ファインドレー同時」手続きでは、刺激(例えば、メインキーの色)によって、どのスケジュールが有効であるかが示されます。
同時並行スケジュールでは、キー操作が頻繁に切り替わってしまうことがよくあります。これを防ぐために、「切り替え遅延」が一般的に導入されます。被験者がスケジュールを切り替えた後、それぞれのスケジュールは短時間非アクティブ化されます。
同時スケジュールが両方とも可変間隔である場合、 2 つのスケジュールにおける相対的な反応率とそれらがもたらす相対的な強化率の間には、マッチング法則として知られる定量的関係が見られます。これは、1961 年にRJ Herrnsteinによって初めて観察されました。マッチング法則は、特定の反応選択肢に対する反応の相対的な率が、その反応に対する強化の相対的な率に等しい(行動率 = 強化率)という、道具的行動に関する規則です。動物や人間は、スケジュールにおいて選択を好む傾向があります。[ 25 ]
シェイピングとは、望ましい道具的反応への段階的な近似を強化することである。例えば、ラットにレバーを押すように訓練する場合、最初はレバーの方に向くだけで強化される。次に、レバーの方に向くことと、レバーに向かって一歩踏み出すことだけが強化される。最終的には、レバーを押すことでラットは強化される。ある行動をうまく達成すると、次の行動のシェイピングプロセスが始まる。訓練が進むにつれて、反応は望ましい行動に徐々に近づき、その後の行動はそれぞれ最終的な行動により近いものとなる。[ 26 ]
シェーピングの介入は、多くのトレーニング場面で使用され、自閉症やその他の発達障害のある人にも使用されます。シェーピングを機能的コミュニケーション訓練(FCT)[ 27 ]などの他のエビデンスに基づいた実践と組み合わせると、人間の行動に肯定的な結果をもたらすことができます。シェーピングは通常、継続的な強化を使用しますが、反応は後に断続的な強化スケジュールに移行できます。
シェイピングは食物拒否にも使用されます。[ 28 ]食物拒否とは、個人が食品に対して部分的または完全な嫌悪感を持っている状態です。これは、好き嫌いが激しい程度から、個人の健康に影響を与えるほど深刻なものまであります。シェイピングは、食物受容において高い成功率を収めています。[ 29 ]
連鎖とは、個々の行動を連続的に連結させることで、それぞれの行動の結果が前の行動に対する強化因子であると同時に、次の行動に対する先行刺激となるようにするものです。連鎖を教える方法は数多くあり、順方向連鎖(連鎖の最初の行動から始める)、逆方向連鎖(最後の行動から始める)、全タスク連鎖(連鎖の各行動を同時に教える)などがあります。人々の朝のルーティンは典型的な連鎖であり、一連の行動(シャワーを浴びる、体を拭く、服を着るなど)がよく身についた習慣として順番に行われます。
自閉症やその他の関連障害を持つ人に見られる問題行動は、連鎖強化スケジュールを用いた研究でうまく管理され、維持されてきた。[ 30 ]機能的コミュニケーション訓練は、適切な望ましい機能的コミュニケーション反応を効果的に促進するために、連鎖強化スケジュールをよく用いる介入である。[ 31 ]
強化の数学的モデルを構築する研究が行われてきました。このモデルは、強化の数学的原理の略であるMPRとして知られています。ピーター・キリーンは、ハトに関する研究でこの分野における重要な発見をしました。[ 32 ]
強化と罰は人間の社会的な相互作用において普遍的に見られ、オペラント条件付けの原理は数多くの応用例が提案され、実施されてきた。以下にいくつかの例を挙げる。
正の強化と負の強化は、中毒と薬物依存の発達と維持において中心的な役割を果たします。依存性薬物は本質的に報酬を与えるものであり、つまり、薬物使用の主要な正の強化因子として機能します。脳の報酬系は、薬物にインセンティブ顕著性(つまり、「欲しい」または「望ましい」)を割り当てます[ 33 ] [ 34 ] [ 35 ]。そのため、中毒が発達すると、薬物の剥奪は渇望につながります。さらに、薬物使用に関連する刺激 (例えば、注射器の視覚や使用場所 )は、薬物によって誘発される強い強化と関連付けられるようになります[ 33 ] [ 34 ] [ 35 ]。これらの以前は中立的だった刺激は、いくつかの特性を獲得します。それらの出現は渇望を誘発する可能性があり、継続使用の条件付けられた正の強化因子になる可能性があります。[ 33 ] [ 34 ] [ 35 ]したがって、薬物中毒者がこれらの薬物の手がかりのいずれかに遭遇すると、関連する薬物への渇望が再び現れる可能性があります。たとえば、薬物対策機関は以前、薬物使用の危険性を示すために、薬物関連器具の画像が描かれたポスターを使用していました。しかし、ポスターに描かれた刺激を見たときに再発を引き起こすインセンティブ顕著性の影響により、そのようなポスターはもはや使用されていません。
薬物依存者においては、薬物離脱症状中に生じる身体的依存(例:震えや発汗)および/または精神的依存(例:快感消失、落ち着きのなさ、易怒性、不安)の症状を軽減または「逃れる」ために薬物を自己投与すると、負の強化が生じる。[ 33 ]
動物の訓練士やペットの飼い主は、これらの概念が命名され研究されるずっと前からオペラント条件付けの原理と実践を適用しており、動物の訓練は今でもオペラント制御の最も明確で説得力のある例の 1 つを提供しています。この記事で説明されている概念と手順のうち、最も顕著なもののいくつかは次のとおりです。即時強化の利用可能性 (たとえば、常に手元にある犬のおいしいおやつ)。偶発性、強化が望ましい行動の後に行われ、他の行動の後に行われないことを保証すること。二次強化の使用、たとえば望ましい反応の直後にクリッカーを鳴らすこと。シェーピング、たとえば犬が徐々に高くジャンプするようにすること。間欠的強化、おやつを与える頻度を減らして、飽和することなく持続的な行動を誘発すること。連鎖、複雑な行動を徐々に組み合わせること。[ 36 ]
適切な子どもの行動に対して肯定的な強化を与えることは、親の養育トレーニングの主要な焦点です。通常、親は、社会的報酬(褒め言葉、笑顔、抱擁など)と具体的な報酬(子どもと共同で作成したインセンティブ システムの一部として、シールやより大きな報酬へのポイントなど)を通じて適切な行動に報酬を与えることを学びます。[ 37 ]さらに、親は、最初の焦点として単純な行動を選択し、子どもがより大きな目標に到達するために達成する小さなステップごとに報酬を与えることを学びます(この概念は「逐次近似」と呼ばれます)。[ 37 ] [ 38 ]また、進捗チャートなどの間接的な報酬を使用することもあります。教室で肯定的な強化を与えることは、生徒の成功に有益です。生徒に肯定的な強化を適用する際には、その生徒のニーズに合わせて個別化することが重要です。このようにして、生徒はなぜ褒められているのかを理解し、それを受け入れ、最終的には肯定的な強化によって得られた行動を継続することを学びます。例えば、ご褒美や休み時間の延長といった方法は、一部の生徒にはより効果的かもしれないが、他の生徒は、褒め言葉を示すシールやチェックマークをもらうことで、規則の執行を受け入れるかもしれない。
心理学者と経済学者の両方が、オペラント条件付けの概念と研究結果を市場における人間の行動に適用することに関心を持つようになった。その一例として、購入される商品の量によって指標化される消費者需要の分析が挙げられる。経済学では、価格が消費に及ぼす影響の度合いを「需要の価格弾力性」と呼ぶ。特定の商品の弾力性は他の商品よりも高い。例えば、特定の食品の価格の変化は購入量に大きな影響を与える可能性があるが、ガソリンやその他の必需品は価格の変化による影響が少ない可能性がある。オペラント分析の観点から、このような影響は消費者の動機と強化子としての商品の相対的価値という観点から解釈できる。[ 39 ]
この記事で既に述べたように、変動比率スケジュールでは、予測不可能な数の反応の後に強化が与えられます。このスケジュールは通常、迅速かつ持続的な反応を生み出します。スロットマシンは変動比率スケジュールで払い出しを行い、ギャンブラーにまさにこのような持続的なレバー引き行動を引き起こします。マシンは投入額よりも払い出し額が少なくなるようにプログラムされているため、スロットマシンを継続的に使用する人は、長期的には必ず負けます。スロットマシン、ひいては変動比率強化は、ギャンブル依存症の根本的な要因としてしばしば非難されてきました。[ 40 ]
人間における行動強化の手段としての賞賛の概念は、BF スキナーのオペラント条件付けモデルに根ざしている。この観点から、賞賛は正の強化の手段として捉えられており、観察された行動を条件的に賞賛することによって、その行動が発生する可能性が高くなる。[ 41 ] 何百もの研究が、賞賛が肯定的な行動を促進する上で効果的であることを示しており、特に教師や親が子供に賞賛を用いることで行動や学業成績の向上を促進するという研究[ 42 ] [ 43 ]だけでなく、仕事のパフォーマンスに関する研究[ 44 ]でも効果が実証されている。賞賛はまた、代理強化によって、賞賛されていない周囲の人々(賞賛を受けた人のクラスメートなど)の肯定的な行動を強化することも実証されている。[ 45 ]賞賛は、その形式、内容、および伝達方法によって、行動を変える上で多かれ少なかれ効果的である可能性がある。褒め言葉が肯定的な行動変化をもたらすためには、肯定的な行動に依存していること(つまり、目標とする行動が実行された後にのみ与えられること)、強化されるべき行動の詳細を明示していること、そして誠実かつ信頼できる形で伝えられていることが必要である。[ 46 ]
褒め言葉が肯定的な強化戦略として効果的であることを認識して、数多くの行動療法や認知行動療法の介入では、プロトコルに褒め言葉の使用が組み込まれています。[ 47 ] [ 48 ]褒め言葉の戦略的な使用は、教室管理[ 47 ]と子育てトレーニング介入[ 43 ]の両方においてエビデンスに基づいた実践として認識されていますが、介入研究では、褒め言葉は戦略的な注意や行動報酬などの戦略を含む、より大きな肯定的な強化のカテゴリーにしばしば含まれます。
トラウマ的絆は、報酬と罰の断続的な強化によって変化しにくい強力な感情的絆が形成される、虐待の継続的なサイクルの結果として生じる。 [ 49 ] [ 50 ]
別の情報源は、次のことを示唆している [ 51 ] 「トラウマ的絆に必要な条件は、一方が他方を支配し、虐待のレベルが慢性的に急上昇し、その後沈静化することである。この関係は、支配的な人物による寛容で思いやりのある、さらには愛情深い行動の期間と、断続的な激しい虐待のエピソードによって特徴づけられる。優位性を維持するために、加害者は被害者の行動を操作し、被害者の選択肢を制限することで、力の不均衡を永続させる。支配と服従のバランスに対するいかなる脅威も、激しい脅迫から激しい暴力の爆発に至るまで、エスカレートする罰のサイクルで対処される可能性がある。」加害者は被害者を他の支援源から孤立させるため、発覚や介入の可能性が低くなり、被害者が対抗的な自己言及的フィードバックを受け取る能力が損なわれ、一方的な依存感が強まります 。このような虐待的な関係によるトラウマ的影響には、被害者の正確な自己評価能力の低下が含まれ、自己不十分感や支配的な人物への従属的な依存感につながる可能性があります。被害者はまた、たとえ自身が攻撃の被害者であったとしても、攻撃行為を行った人物との感情的および行動的な関係によって、さまざまな不快な社会的および法的結果に直面する可能性があります。
ほとんどのビデオゲームは、何らかの強迫ループを中心に設計されており、変動レートスケジュールを通じて一種の正の強化を追加することでプレイヤーにゲームをプレイし続けさせますが、これはビデオゲーム中毒につながる可能性もあります。[ 52 ]
2010年代のビデオゲームの収益化のトレンドの一環として、一部のゲームでは、レアリティ別にランダムに選ばれたゲーム内アイテムを提供する「ルートボックス」が報酬として、または現実の資金で購入できる形で提供されました。この方法は、変動レートスケジュールに従うため、スロットマシンやその他のギャンブル機器が報酬を分配する方法と同じ方法に関連付けられています。ルートボックスはギャンブルの一種であるという一般的な認識がありますが、この行為はごく一部の国でのみギャンブルとして分類され、それ以外は合法です。しかし、これらのアイテムをオンラインギャンブルの仮想通貨として使用したり、現実の資金と交換したりする方法により、スキンギャンブル市場が生まれ、法的評価を受けています。[ 53 ]
行動強化の標準的な定義は、強化によって反応の強さが増加すると主張しているように見え、強化を反応の強さを増加させるもの(つまり、反応の強さは反応の強さを増加させるものによって増加する)と定義しているため、循環的であると批判されてきた。しかし、強化の正しい用法[ 54 ]は、何かが強化子であるのは、それが行動に及ぼす影響によるものであり、その逆ではないということである。特定の刺激が強化子であるから行動を強化すると言い、なぜその刺激が行動にそのような影響を及ぼしているのかを説明しないと、循環的になる。FD シェフィールドの「反応に依存する消費行動」など、他の定義も提案されているが、これらは心理学では広く使用されていない。[ 55 ]
強化子の役割についての理解は、「強化」効果から「シグナル」効果へとますます移行しつつある。[ 56 ]つまり、強化子は強化につながる可能性のある行動をシグナルすることで反応を増加させるという見方である。ほとんどの実際的な応用では、特定の強化子の効果は、強化子がシグナルであるか強化であるかに関係なく同じであるが、このアプローチは、間欠強化スケジュール(固定間隔スカラップ)での反応パターンや結果の差異効果など、多くの行動現象を説明するのに役立つ。[ 57 ]
行動分析の観点から言えば、罰とは、反応の後に、同様の状況で同様の反応が起こる確率が低下するような出来事(つまり刺激の変化)が起こるあらゆる状況を指します。この定義には、痛み、恐怖、不快感などは含まれません。例えば、ある人が車を2台分のスペースを占領して駐車し、通行人が「それは思いやりがない」とコメントしたとします。その後、駐車時に2台分のスペースを占領する確率が低下した場合、罰が生じたと合理的に推測できます。
オペラント条件付けにおける報酬は正の強化子である。
... オペラント行動は報酬の良い定義を与えている。個人がもっと求めてくるものはすべて正の強化子であり、したがって報酬である。良い定義を与えているとはいえ、正の強化は報酬機能の 1 つにすぎない。
... 報酬は魅力的である。報酬は動機付けとなり、努力を促す。
... 報酬は接近行動、食欲行動または準備行動とも呼ばれる行動、および消費行動を誘発する。
…したがって、私たちに接近し、消費させる可能性のある刺激、対象、出来事、活動、状況はすべて、定義上報酬である。
…内在的報酬とは、それ自体が快感であり、外在的報酬を得る手段ではなく、それ自体を目的として行われる活動である。
…内在的報酬は、ピアノの完成、演奏、楽しみのように、学習、接近、快感を誘発するため、それ自体が真の報酬である。内在的報酬は、より高次の報酬を条件付ける役割を果たすことはあるが、無条件報酬との対比を必要としないため、条件付けられた高次の報酬ではない。
数多くの心理社会的要因が重要であるにもかかわらず、薬物依存症の中核には生物学的プロセスが関わっています。乱用薬物への繰り返し曝露によって脆弱な脳に変化が生じ、それが薬物の強迫的な探索と摂取、そして薬物使用の制御喪失を引き起こし、依存症の状態を定義づけます。
... 多数の文献が、D1型[側坐核]ニューロンにおけるこのようなΔFosB誘導が、動物の薬物および自然報酬に対する感受性を高め、おそらく正の強化のプロセスを通じて薬物の自己投与を促進することを示している
... ΔFosBのもう1つの標的はcFosである。ΔFosBは薬物への反復曝露によって蓄積され、c-Fosを抑制し、慢性薬物投与状態でΔFosBが選択的に誘導される分子スイッチに寄与する。41
。
...
さらに、集団全体で依存症に対する遺伝的リスクの範囲が広いにもかかわらず、長期間にわたって十分な量の薬物に曝露されると、遺伝的負荷が比較的低い人が依存症になる可能性があるという証拠が増えている。
健康問題、障害、仕事、学校、または家庭での主要な責任の不履行など、臨床的および機能的に重大な障害を引き起こすアルコールまたはその他の薬物の反復使用を指します。重症度に応じて、この障害は軽度、中等度、または重度に分類されます。
依存症:薬物使用障害の最も重篤で慢性的な段階を示す用語であり、薬物の使用をやめたいという願望があるにもかかわらず、強迫的に薬物を摂取してしまうなど、自己制御能力が著しく失われている状態を指す。DSM-5では、依存症という用語は重度の薬物使用障害の分類と同義である。
報酬物質への繰り返しの曝露が二次強化イベントの連鎖を引き起こし、それによって薬物使用に関連する手がかりや状況自体が強化となり、選択された物質の継続的な使用と乱用につながる可能性があるということです。...
依存
症プロセス(特に再発)に非常に関連のある強化の重要な側面は、二次強化です(Stewart、1992)。二次強化子(多くの場合、条件付け強化子とも考えられています)は、人間の強化プロセスの大部分を推進していると考えられます。薬物依存症の場合、薬物使用と密接かつ繰り返し関連付けられる手がかりや状況自体が強化因子となることが多い
。ロビンソンとベリッジの依存症のインセンティブ感作理論の基本的な部分は、一次強化因子自体に加えて、そのような二次強化プロセスのインセンティブ価値または魅力的な性質が、薬物依存症の発達と連携して、時間の経過とともに持続し、感作される可能性があると仮定している(ロビンソンとベリッジ、1993)。
負
の強化は、進行中の(おそらく嫌悪的な)刺激を終了させる行動反応の強化に関連する特別な状態である。この場合、負の強化因子を、そのような「逃避」反応を強化する動機付け刺激として定義することができる。歴史的に、薬物依存症に関連して、この現象は、離脱状態における動機付けニーズを満たすために乱用薬物が自己投与されるという点で、人間において一貫して観察されてきた(ウィクラー、1952)。
パブロフの条件付け条件刺激 (CS+) にインセンティブ顕著性が付与されると、その条件付け条件刺激 (UCS) に対する「欲求」が引き起こされるだけでなく、多くの場合、その手がかり自体が非常に魅力的になり、非合理的な程度にさえなります。この手がかりの魅力は、インセンティブ顕著性のもう 1 つの特徴です。 CSは、見ないわけにはいかなくなる(Wiers & Stacy, 2006; Hickey et al., 2010a; Piech et al., 2010; Anderson et al., 2011)。CSは、UCSと同様の誘因特性さえ帯びる。魅力的なCSは、行動的に動機づけられた接近行動を誘発することが多く、時には個人がCSをUCSのように「消費」しようとすることさえある(例えば、食べる、飲む、吸う、セックスをする、薬物として摂取する)。CSを「欲する」ことで、以前は中立的だった刺激が道具的条件付け強化子に変わり、個人は手がかりを得るために努力するようになる(ただし、条件付け強化には別の心理的メカニズムも存在する)。
生み出す感作または過剰反応性のドーパミンシステムによって生成される過剰なインセンティブ顕著性に部分的に起因していると考えられている (Robinson および Berridge、1993)。しかし、なぜあるターゲットが他のすべてのターゲットよりも「欲しくなる」のかは、完全には解明されていない。中毒者やアゴニスト刺激を受けた患者では、インセンティブ顕著性のドーパミン刺激の繰り返しが、依存性薬物の摂取や特定の強迫行為など、個々の特定の追求に結び付けられるようになる。パブロフの条件付けによる報酬状況では、報酬の手がかりの中には、個人によって異なる方法で、強力な動機付けの磁石として、他の手がかりよりも「欲しい」ものとなるものがある(Robinson et al., 2014b; Saunders and Robinson, 2013)。
…しかし、快楽効果は時間とともに変化する可能性がある。薬物を繰り返し摂取すると、感受性の高い人では中脳辺縁系ドーパミン作動性感作が起こり、「欲求」が増幅される可能性がある(Leyton and Vezina, 2013; Lodge and Grace, 2011; Wolf and Ferrario, 2010)。これは、継続的な薬物刺激によってオピオイド快楽メカニズムがダウンレギュレーションされ、「好き」耐性が生じた場合でも同様である。インセンティブ感作は、薬物を再び摂取したいというキューによって引き起こされる「欲求」を選択的に増幅することで依存症を引き起こし、薬物の快楽が減ったとしても強力な動機付けとなる(Robinson and Berridge, 1993)。
{{cite book}}ISBN /日付の不一致(ヘルプ){{cite book}}ISBN /日付の不一致(ヘルプ){{cite book}}ISBN /日付の不一致(ヘルプ)