정의
조작적 조건형성은 유기체가 환경에 '작용(operate)'하여 나타내는 자발적 행동, 곧 조작 행동이 그 뒤에 따르는 결과에 따라 증가하거나 감소하는 학습 과정을 말한다. 스키너는 마음속 과정을 추측하기보다 관찰 가능한 행동과 환경의 관계를 정밀하게 분석해야 한다는 급진적 행동주의 입장을 취했다.
이 이론은 교육심리학의 학습이론 단원, 행동수정, 응용행동분석(ABA), 사회복지실천기술론의 행동주의 모델, 조직의 보상 설계 등 다양한 분야에서 기본 이론으로 다루어진다.
핵심 개념
고전적 조건형성과의 차이
파블로프의 고전적 조건형성은 종소리와 먹이처럼 자극과 자극을 연합해 침 분비 같은 반응적(불수의적) 행동을 학습하는 과정이다. 반면 조작적 조건형성은 행동과 그 결과를 연합해 레버 누르기 같은 자발적 행동을 학습하는 과정이라는 점이 다르다.
효과의 법칙
스키너의 이론은 손다이크의 효과의 법칙(law of effect), 곧 만족스러운 결과가 따르는 반응은 강해지고 불쾌한 결과가 따르는 반응은 약해진다는 원리를 실험적으로 정교화한 것이다. 손다이크는 고양이가 문제 상자에서 빠져나오는 시간이 시행을 거듭할수록 줄어드는 것을 관찰했다.
변별자극과 3항 유관
행동은 진공 속에서 일어나지 않는다. 스키너는 선행자극(변별자극) – 행동 – 결과의 관계, 곧 3항 유관(three-term contingency)으로 행동을 분석했다. 불이 켜졌을 때만 레버를 누르면 먹이가 나오면, 쥐는 불이 켜졌을 때만 레버를 누르게 된다.
단계와 구성요소
강화와 처벌의 네 가지 유형
| 자극을 제시 | 자극을 제거 | |
|---|---|---|
| 행동 증가 | 정적 강화: 칭찬, 용돈, 스티커 | 부적 강화: 숙제를 끝내면 잔소리가 멈춤 |
| 행동 감소 | 정적 처벌: 꾸중, 벌점 부과 | 부적 처벌: 게임 시간 박탈, 타임아웃 |
'부적 강화'를 처벌로 착각하는 경우가 많지만, 부적 강화는 불쾌한 자극을 없애 행동을 증가시키는 것이다.
강화계획
- 고정비율(FR): 정해진 횟수마다 강화. (예: 10개 생산마다 성과급)
- 변동비율(VR): 평균 횟수를 중심으로 불규칙하게 강화. 반응률이 높고 소거에 가장 강하다. (예: 복권, 슬롯머신)
- 고정간격(FI): 정해진 시간이 지난 뒤 첫 반응에 강화. 강화 직전에 반응이 몰린다. (예: 정기 시험 직전 공부)
- 변동간격(VI): 불규칙한 시간 간격으로 강화. (예: 예고 없는 쪽지시험)
행동조성과 소거
목표 행동에 가까운 행동을 단계적으로 강화해 새로운 행동을 만들어 가는 것을 행동조성(shaping, 점진적 접근법)이라 한다. 강화가 중단되면 행동이 점차 줄어드는 소거가 일어나며, 소거 초기에는 행동이 일시적으로 급증하는 소거 폭발이 나타나기도 한다.
학자와 이론적 배경
스키너(1904–1990)는 하버드 대학교에서 심리학 박사학위를 받고 『유기체의 행동(The Behavior of Organisms)』(1938)으로 조작적 조건형성 연구를 체계화했다. 쥐와 비둘기가 레버나 버튼을 눌러 먹이를 얻는 실험 장치(흔히 '스키너 상자'라 불리는 조작적 조건형성 상자)와 반응을 자동 기록하는 누적 기록기를 고안해 행동을 정량적으로 분석했다. 퍼스터와 함께 쓴 『강화계획(Schedules of Reinforcement)』(1957)은 강화 방식에 따른 반응 패턴을 정리한 대표 연구다.
그는 학습 원리를 교육에 적용해 작은 단계로 나누어 즉시 피드백을 주는 프로그램 학습과 티칭 머신을 제안했다(1954). 이는 오늘날 이러닝의 즉각적 피드백, 완전학습 설계에도 영향을 주었다. 인간의 무의식을 중시한 정신분석과 대비되는 심리학의 '제2세력'으로 소개된다.
비판과 한계
- 인지 과정의 무시: 촘스키(Chomsky, 1959)는 스키너의 『언어 행동』을 비평하며 언어 습득을 강화만으로 설명할 수 없다고 주장했고, 이는 인지혁명의 계기 가운데 하나가 되었다.
- 관찰학습의 설명 부족: 직접 강화를 받지 않고도 다른 사람을 보고 배우는 현상은 반두라의 사회학습이론이 보완했다.
- 내재적 동기의 약화: 데시 등(Deci, Koestner & Ryan, 1999)의 메타분석은 흥미 있는 과제에 대한 기대된 물질적 보상이 내재적 동기를 떨어뜨릴 수 있음을 보고했다. 작은 보상이 더 큰 태도 변화를 낳는다는 인지부조화 이론의 결과와도 함께 비교된다.
- 윤리적 우려: 인간 행동을 통제와 조작의 대상으로 본다는 점, 처벌 사용의 부작용(공포, 회피, 공격성) 등이 비판된다.
레포트 적용 예시
학급경영·행동수정 계획
수업 중 자리 이탈이 잦은 학생 사례라면 기초선 측정 → 목표 행동 정의 → 토큰 강화와 행동조성 → 강화계획을 연속에서 간헐로 전환 → 유지·일반화 평가 순서로 행동수정 계획을 쓸 수 있다. 학습자의 인지 발달 수준은 피아제 이론으로, 교사의 단계적 지원은 비고츠키의 비계설정으로 보완하면 다면적인 분석이 된다.
캠퍼스다운 자료실에는 이 이론을 실제로 적용해 쓴 레포트도 있어요. 예를 들어 「파블로프와 스키너의 행동주의 이론: 고전적 조건화와 조작적 조건형성, 사회복지실천의 행동수정 기법」, 「행동주의 이론의 사회복지 현장에의 적용: 파블로프의 고전적 조건 형성과 스키너의 조작적 조건 형성을 중심으로」 같은 자료를 보면 이론을 사례에 어떻게 연결하는지 감을 잡을 수 있어요. 더 많은 자료는 '스키너' 레포트 검색에서 찾아보세요.
사회복지실천의 행동주의 모델
아동 문제행동이나 자립 기술 훈련 사례에서 ABC 기록(선행사건-행동-결과)을 작성하고 강화 전략을 설계하는 과제가 자주 나온다. 처벌보다 정적 강화를 우선하고, 클라이언트의 자기결정권을 존중하는 윤리적 고려를 함께 쓰면 좋은 평가를 받을 수 있다.
참고문헌
- Skinner, B. F. (1938). The Behavior of Organisms: An Experimental Analysis. New York: Appleton-Century.
- Skinner, B. F. (1953). Science and Human Behavior. New York: Macmillan.
- Skinner, B. F. (1954). The science of learning and the art of teaching. Harvard Educational Review, 24(2), 86–97.
- Ferster, C. B., & Skinner, B. F. (1957). Schedules of Reinforcement. New York: Appleton-Century-Crofts.
- Thorndike, E. L. (1911). Animal Intelligence: Experimental Studies. New York: Macmillan.
- Chomsky, N. (1959). A review of B. F. Skinner's Verbal Behavior. Language, 35(1), 26–58.
- Deci, E. L., Koestner, R., & Ryan, R. M. (1999). A meta-analytic review of experiments examining the effects of extrinsic rewards on intrinsic motivation. Psychological Bulletin, 125(6), 627–668.