定義
オペラント条件づけとは、有機体が環境に「働きかけ(operate)」て示す自発的な行動、すなわちオペラント行動が、その後に伴う結果によって増えたり減ったりする学習過程をいう。スキナーは、心のなかの過程を推測するよりも、観察可能な行動と環境の関係を精密に分析すべきだという徹底的行動主義の立場をとった。
この理論は、教育心理学の学習理論の単元、行動修正、応用行動分析(ABA)、社会福祉援助技術論の行動主義モデル、組織の報酬設計など、さまざまな分野で基本理論として扱われる。
主要概念
古典的条件づけとの違い
パブロフの古典的条件づけは、ベルの音と餌のように刺激と刺激を連合させ、唾液分泌のようなレスポンデント(不随意的)行動を学習する過程である。これに対してオペラント条件づけは、行動とその結果を連合させ、レバー押しのような自発的行動を学習する過程である点が異なる。
効果の法則
スキナーの理論は、ソーンダイクの効果の法則(law of effect)、すなわち満足をもたらす結果が伴う反応は強まり、不快な結果が伴う反応は弱まるという原理を、実験的に精緻化したものである。ソーンダイクは、猫が問題箱から抜け出すまでの時間が試行を重ねるほど短くなることを観察した。
弁別刺激と三項随伴性
行動は真空のなかで起こるわけではない。スキナーは先行刺激(弁別刺激)– 行動 – 結果の関係、すなわち三項随伴性(three-term contingency)によって行動を分析した。ランプが点いているときにだけレバーを押すと餌が出るなら、ラットはランプが点いているときにだけレバーを押すようになる。
段階と構成要素
強化と罰の四つの類型
| 刺激を提示 | 刺激を除去 | |
|---|---|---|
| 行動が増加 | 正の強化:ほめ言葉、小遣い、シール | 負の強化:宿題を終えると小言が止む |
| 行動が減少 | 正の罰:叱責、罰点の付与 | 負の罰:ゲーム時間の取り上げ、タイムアウト |
「負の強化」を罰と取り違えることが多いが、負の強化は不快な刺激を取り除くことで行動を増加させるものである。
強化スケジュール
- 固定比率(FR):決まった回数ごとに強化する(例:10個生産するごとの出来高給)。
- 変動比率(VR):平均回数を中心に不規則に強化する。反応率が高く、消去に最も強い(例:宝くじ、スロットマシン)。
- 固定間隔(FI):決まった時間が経過した後の最初の反応を強化する。強化の直前に反応が集中する(例:定期試験直前の勉強)。
- 変動間隔(VI):不規則な時間間隔で強化する(例:予告なしの小テスト)。
シェイピングと消去
目標行動に近い行動を段階的に強化して新しい行動をつくっていくことをシェイピング(shaping、逐次接近法)という。強化が中止されると行動がしだいに減る消去が起こり、消去の初期には行動が一時的に急増する消去バーストがみられることもある。
提唱者と理論的背景
スキナー(1904–1990)はハーバード大学で心理学の博士号を取得し、『有機体の行動(The Behavior of Organisms)』(1938)でオペラント条件づけの研究を体系化した。ラットやハトがレバーやキーを押して餌を得る実験装置(一般に「スキナー箱」と呼ばれるオペラント箱)と、反応を自動的に記録する累積記録器を考案し、行動を定量的に分析した。ファースターとの共著『強化スケジュール(Schedules of Reinforcement)』(1957)は、強化の仕方による反応パターンをまとめた代表的な研究である。
彼は学習の原理を教育に応用し、小さなステップに分けて即時にフィードバックを与えるプログラム学習とティーチング・マシンを提案した(1954)。これは今日のeラーニングにおける即時フィードバックや完全習得学習の設計にも影響を与えた。人間の無意識を重視した精神分析と対比される心理学の「第二勢力」として紹介される。
批判と限界
- 認知過程の無視:チョムスキー(Chomsky, 1959)はスキナーの『言語行動』を批評し、言語の獲得は強化だけでは説明できないと主張した。これは認知革命のきっかけの一つとなった。
- 観察学習の説明不足:直接強化を受けなくても他者を見て学ぶ現象は、バンデューラの社会的学習理論が補った。
- 内発的動機づけの低下:デシら(Deci, Koestner & Ryan, 1999)のメタ分析は、興味のある課題に対して予期された物質的報酬が内発的動機づけを低下させうることを報告した。小さな報酬のほうが大きな態度変化を生むという認知的不協和理論の結果ともあわせて比較される。
- 倫理的懸念:人間の行動を統制と操作の対象とみなす点や、罰の使用の副作用(恐怖、回避、攻撃性)などが批判される。
レポートでの活用例
学級経営・行動修正計画
授業中に離席の多い児童の事例であれば、ベースラインの測定 → 標的行動の定義 → トークンによる強化とシェイピング → 強化スケジュールを連続強化から間欠強化へ移行 → 維持・般化の評価という順序で行動修正計画を書くことができる。学習者の認知発達の水準はピアジェの理論で、教師の段階的な支援はヴィゴツキーの足場かけで補うと、多面的な分析になる。
CampusDown 資料室(韓国語)には、この理論を実際に適用したレポートもあります。たとえば 「파블로프와 스키너의 행동주의 이론: 고전적 조건화와 조작적 조건형성, 사회복지실천의 행동수정 기법」, 「행동주의 이론의 사회복지 현장에의 적용: 파블로프의 고전적 조건 형성과 스키너의 조작적 조건 형성을 중심으로」 などの資料を見ると、理論を事例にどう結びつけるかがつかめます。ほかの資料は「스키너」レポート検索で探してみてください。
社会福祉実践の行動主義モデル
子どもの問題行動や自立スキルの訓練の事例で、ABC記録(先行事象‐行動‐結果)を作成し強化の戦略を設計する課題がよく出される。罰よりも正の強化を優先し、クライエントの自己決定権を尊重する倫理的配慮もあわせて書くと、よい評価を得やすい。
参考文献
- Skinner, B. F. (1938). The Behavior of Organisms: An Experimental Analysis. New York: Appleton-Century.
- Skinner, B. F. (1953). Science and Human Behavior. New York: Macmillan.
- Skinner, B. F. (1954). The science of learning and the art of teaching. Harvard Educational Review, 24(2), 86–97.
- Ferster, C. B., & Skinner, B. F. (1957). Schedules of Reinforcement. New York: Appleton-Century-Crofts.
- Thorndike, E. L. (1911). Animal Intelligence: Experimental Studies. New York: Macmillan.
- Chomsky, N. (1959). A review of B. F. Skinner's Verbal Behavior. Language, 35(1), 26–58.
- Deci, E. L., Koestner, R., & Ryan, R. M. (1999). A meta-analytic review of experiments examining the effects of extrinsic rewards on intrinsic motivation. Psychological Bulletin, 125(6), 627–668.