勉強や運動を続けたいのに、三日で止まってしまう。子どもや部下を褒めているのに、望んだ行動が増えない。反対に、通知を一度確認しただけなのに、何度もスマートフォンへ手が伸びる。こうした「行動のあとに何が起きたか」と次の行動の関係を理解する鍵が、心理学の強化です。
強化は「褒めること」や「ご褒美を渡すこと」だけではありません。本人にとって良さそうなものを与えても、行動が増えなければ、専門用語としての強化とは呼べません。まず言葉の意味を正確に整理し、日常で無理なく使う方法と限界を見ていきます。
心理学の「強化」とは
強化(reinforcement)とは、ある行動のあとに起きた結果によって、その行動が将来増えやすくなることです。行動と結果の結びつきを通じて学習する仕組みは、オペラント条件づけ(operant conditioning)と呼ばれます。
B. F. Skinnerは、行動がその後の結果によって変化する仕組みを実験的に研究し、1938年の著書『The Behavior of Organisms』でオペラント行動の枠組みを示しました。現在では当時の説明だけで人間行動のすべてを扱うことはできませんが、「結果が次の行動を選びやすくする」という基礎は、学習研究と行動分析の重要な考え方です(Skinner, 1938)。
この考え方には、Thorndikeが示した効果の法則が先行しています。行動のあとに満足をもたらす結果が続くと、その状況で同じ行動が起こりやすくなるという考えです(Thorndike, 1911)。
「ご褒美」と「強化子」は同じではない
ご褒美は、与える側が「喜ぶだろう」と考えたものです。強化子は、実際に行動を増やした結果です。たとえば褒め言葉をかけても、相手が注目を負担に感じて行動が減ったなら、その場では強化子として働いていません。
何が強化子になるかは、人、場面、時期で変わります。コーヒー、達成記録、休憩、感謝の言葉などが役立つ人もいれば、役立たない人もいます。意図ではなく、後の行動を観察して判断する点が重要です。
正の強化と負の強化の違い
ここでいう「正・負」は、良い・悪いではなく、何かを加えるか、取り除くかを表します。「強化」は行動が増えること、「罰」は行動が減ることです。Rice UniversityのOpenStaxも、この四つを同じ基準で整理しています(Spielman, Jenkins, & Lovett, 2020)。
| 結果 | 何が起きるか | 行動の変化 | 例 |
|---|---|---|---|
| 正の強化 | 望ましい刺激を加える | 増える | 報告後に具体的な感謝を伝え、報告が増える |
| 負の強化 | 不快な刺激を取り除く | 増える | シートベルトを締めると警告音が止まり、締める行動が増える |
| 正の罰 | 不快な刺激を加える | 減る | 行動後に叱責され、その行動が減る |
| 負の罰 | 望ましい刺激を取り除く | 減る | 規則違反後に利用時間を失い、違反が減る |
負の強化は「罰」ではない
もっとも混同されやすいのが負の強化です。負の強化でも、結果として行動は増えます。不快なものから逃れる行動や、不快な出来事を避ける行動が繰り返されやすくなる仕組みです。
たとえば、人前で話す予定を断ると不安が一時的に下がり、次も断りやすくなることがあります。本人の意志が弱いからではなく、回避の直後に苦しさが軽くなるため、その行動が強化されうるのです。ただし、不安や回避の原因は一つではなく、この説明だけで診断はできません。
なぜ行動は続いたり、止まったりするのか
行動と結果の時間が近い
行動の直後に結果が起こるほど、「この行動の結果だ」と学習しやすくなります。新しい習慣では、一か月後の大きな成果だけを待つより、終えた直後にチェックをつける、進んだ量を見る、短い休憩をとるなど、小さく近い結果を用意するほうが関係を理解しやすくなります。
何をすればよいかが観察できる
「もっと頑張る」は幅が広すぎます。「机に座って資料を一ページ開く」「帰宅したら腕立て伏せを一回する」のように、始まりと終わりを確認できる行動にすると、何を強化しているかが明確になります。
行動開始の合図を決めたい場合は、実行意図(If-Thenプランニング)の解説も役立ちます。実行意図は「いつ・どこで何をするか」を決める方法、強化は「行動のあとに何が起きるか」を扱う考え方です。
最初は小さな近似行動から始める
完成した行動だけを待たず、目標に近づく小さな行動を順に強化する方法をシェイピングといいます。いきなり30分の運動を求めるのではなく、運動着を出す、外へ出る、5分歩くという近い行動を積み上げます。
これは基準を永遠に低くする方法ではありません。できるようになった段階で、次の小さな基準へ移します。自己効力感の解説で扱った「達成可能な課題から経験を積む」という視点とも接点がありますが、強化と自己効力感は別の概念です。
毎回の強化と、ときどきの強化
行動がまだ定着していない段階では、行動のたびに結果を伴わせる連続強化が学習を助けます。行動が定着したあとには、毎回ではなく一部の行動だけが強化される間欠強化でも維持される場合があります。
ただし、間欠強化は生活改善の便利な技法としてだけ働くわけではありません。SNSの反応やギャンブルの当たりのように、いつ結果が得られるか分からない仕組みが、確認や賭けをやめにくくすることがあります。強化スケジュールによって反応の形や消去への抵抗が異なることは、古典的な実験研究から整理されてきました。日常へ当てはめる際には、実験室と複雑な生活場面の違いも考える必要があります。
行動を続けやすくする6つの実践例
以下は、研究で一つのパッケージとして検証された治療手順ではなく、強化の考え方を日常のセルフマネジメントへ置き換えた編集上の実践例です。
1. 増やしたい行動を一つだけ決める
「健康になる」ではなく「夕食後に5分歩く」、「勉強する」ではなく「問題集を一問解く」と書きます。一度に多くを変えようとすると、どの結果がどの行動に効いたか分かりにくくなります。
2. 直後に受け取れる小さな結果を選ぶ
カレンダーに印をつける、好きな飲み物をゆっくり飲む、進捗を一行記録するなど、負担の少ないものを選びます。大きな買い物や食べ物だけを報酬にする必要はありません。
3. 行動した事実を具体的に認める
「自分は偉い人間だ」と評価するより、「疲れていたが5分歩いた」「一問だけでも開いた」と、実際の行動を言葉にします。行動を具体的に捉えると、次に再現しやすくなります。
4. 一週間後に本当に増えたかを見る
楽しそうな方法でも、対象の行動が増えていなければ見直します。強化子が弱い、結果が遅い、目標が大きすぎる、体調や時間帯が合わないなど、複数の可能性があります。
5. 外からの報酬を少しずつ薄くする
行動が安定したら、毎回のご褒美を減らし、技能の上達、体調の変化、仕事が楽になった実感など、行動に自然に伴う結果へ注意を移します。長く続ける考え方は、継続の名言集でも別の角度から扱っています。
6. 続かないときは人格ではなく条件を調べる
「意志が弱い」と結論づける前に、行動が大きすぎないか、結果が遠すぎないか、疲労や痛みを無視していないかを確認します。小さな行動から現実を変える視点は、努力の名言集ともつながります。
報酬を使えば、やる気は必ず高まるのか
外的報酬の効果は単純ではありません。Deci、Koestner、Ryanは128研究をまとめ、予告された有形報酬が、報酬のない自由時間にその活動を選ぶ行動や自己報告の興味を低下させる条件がある一方、肯定的な言語フィードバックでは異なる結果がみられたと報告しました(Deci, Koestner, & Ryan, 1999)。
一方、Cerasoli、Nicklin、Fordが学校・仕事・身体活動の研究を統合したメタ分析では、内発的動機づけと外的インセンティブは必ずしも敵対せず、内発的動機づけは成果の質、インセンティブは成果の量とより強く関係していました。分析には183の標本、212,468人が含まれますが、研究の多くは変数間の関連を扱うため、すべてを因果関係として読むことはできません(Cerasoli, Nicklin, & Ford, 2014)。
つまり「ご褒美は悪い」「報酬さえあれば続く」のどちらも広げすぎです。すでに楽しんでいる活動を細かく管理する報酬と、始めにくい行動を支える小さな手がかりでは、意味が違います。本人の選択感、課題の種類、報酬を与える条件を合わせて考える必要があります。
人に使うときの注意点
強化は、他人を思いどおりに動かすための操作術ではありません。家庭、学校、職場で使う場合は、相手の尊厳と選択肢を守り、何を目指すかを共有する必要があります。
- 本人にとって意味のある目標かを確かめる
- できなかったことより、できた具体的行動を認める
- 報酬を脅しや服従の条件にしない
- 安全、休息、賃金など当然の権利を報酬扱いしない
- 効果がない、苦痛がある、依存的になる場合は中止する
子どもの強い問題行動、発達上の課題、自傷、摂食、依存などに関わる行動を、家庭だけで試行錯誤するのは危険な場合があります。医療・心理・教育の専門家による評価と支援を利用してください。
哲学の「習慣」と心理学の「強化」
アリストテレスは、行為の反復が技能や性格の形成に関わると論じました。これは人生の方向を考える哲学的な議論です。一方、心理学の強化は、特定の状況で行動と結果を観察する概念です。
両者は「繰り返す行為が人を形づくる」という点で接点がありますが、哲学上の徳を強化実験で証明したわけではありません。どの行動を増やす価値があるかは、心理学用語だけでは決められません。
まとめ
強化とは、行動のあとの結果によって、その行動が将来増えやすくなることです。正の強化は何かを加えて行動を増やし、負の強化は不快なものを取り除いて行動を増やします。負の強化は罰ではありません。
日常では、増やしたい行動を具体的かつ小さくし、直後の結果を整え、本当に行動が増えたかを観察します。ただし、人の行動は報酬だけで決まるわけではありません。体調、価値観、技能、環境、内発的動機づけも含めて考えることが大切です。
参考文献
- Cerasoli, C. P., Nicklin, J. M., & Ford, M. T. (2014). Intrinsic motivation and extrinsic incentives jointly predict performance: A 40-year meta-analysis. Psychological Bulletin, 140(4), 980–1008. https://doi.org/10.1037/a0035661
- Deci, E. L., Koestner, R., & Ryan, R. M. (1999). A meta-analytic review of experiments examining the effects of extrinsic rewards on intrinsic motivation. Psychological Bulletin, 125(6), 627–668. https://doi.org/10.1037/0033-2909.125.6.627
- Skinner, B. F. (1938). The Behavior of Organisms: An Experimental Analysis. New York: Appleton-Century. B. F. Skinner Foundation公開版
- Spielman, R. M., Jenkins, W. J., & Lovett, M. D. (2020). Operant Conditioning. In Psychology 2e. OpenStax, Rice University. https://openstax.org/books/psychology-2e/pages/6-3-operant-conditioning
- Thorndike, E. L. (1911). Animal Intelligence: Experimental Studies. New York: Macmillan. York University公開版
