提出した原稿が、赤字だらけで返ってくる。
「導入が弱い」
「もっと具体的に」
「ここは読者目線で」
「全体的に、もう一段深く」
書いた側は、たくさん指摘してもらったと分かっている。直すべき場所も多い。それでも、次の原稿をどう変えればいいかは、はっきりしない。
一方、返した側には手応えがある。時間をかけ、気づいたことを漏らさず伝えた。指摘が具体的で、遠慮もしていない。これだけ材料があれば、次は良くなるはずだと思う。
しかし、次の原稿にも似た赤字が入る。
ここで起きている問題は、本人に成長意欲がないことでも、伝え方が優しくないことでもないかもしれない。
コメントは増えたが、次の試行に生じる差が設計されていない。
フィードバックの価値は、伝えた情報量では測れない。受け手が次に何を変え、その結果から何を学べるかで決まる。
この記事では、その変化を「試行差分」と呼ぶ。
良いフィードバックとは、相手を正確に評価する言葉ではない。次の一回を、前の一回とは違う実験にする情報である。
フィードバックは、平均では効く。それでも逆効果が起こる
フィードバックについて語るとき、二つの極端な理解がある。
一つは、「率直に伝えれば、人は必ず伸びる」。もう一つは、「批判すると傷つくから、肯定したほうがいい」。
研究が示してきたのは、もっと複雑な姿だ。
Avraham KlugerとAngelo DeNisiは1996年、フィードバック介入がパフォーマンスへ与える影響をメタ分析した。607の効果量、23,663観測を統合すると、平均効果はプラスだった。しかし、3分の1を超える介入では、フィードバック後にパフォーマンスが低下していた。
「平均で効く」と「与えれば効く」は、同じではない。
さらに2020年、Benedikt Wisniewski、Klaus Zierer、John Hattieは、教育場面の435研究、994効果量、6万1,000人超を対象にメタ分析を行った。外れ値を除いた平均効果量はd=0.48で、全体としては学習を助ける中程度の効果が示された。一方、除外前の効果量の17%はマイナスで、研究間のばらつきも非常に大きかった。
同じ「フィードバック」という名前でも、中身は同じ介入ではなかった。
正解か不正解かだけを返す。理由と改善方法まで示す。褒める。罰する。文章で返す。口頭で返す。課題の途中で返す。終わってから返す。
これらを一つの平均値にまとめれば、「フィードバックは有効」という結論は出せる。しかし、それだけでは、明日どんな言葉を渡すべきかは分からない。
2020年の分析では、情報量の多いフィードバック群の効果が大きく、単純な強化や罰の群は小さかった。ただし、これは条件を無作為にそろえた直接対決ではない。課題や対象者が異なる研究群の比較であり、「情報を増やせば必ずこの差が出る」と読むことはできない。
加えて、収録研究の出版年中央値は1985年で、新しい15年間の研究は効果量全体の15%だった。出版された研究に偏りがある可能性も、著者ら自身が報告している。
数字は、フィードバックの重要性を示す。同時に、万能な処方箋がないことも示している。
問題は、ポジティブかネガティブかだけではない
フィードバックの議論は、しばしば言葉の温度へ向かう。
厳しく言うべきか。優しく言うべきか。まず褒めるべきか。率直さを優先すべきか。
もちろん、人間関係や受け止めやすさは重要だ。しかし、KlugerとDeNisiが提示したFeedback Intervention Theoryの中心は、別の場所にある。
フィードバックは、受け手の注意の向き先を変える。
研究では、注意が向かう水準を大きく三つに整理している。
• 課題をどう理解し、どの方法を学ぶか
• 目標との差を埋めるため、どれだけ努力や調整をするか
• 自分が有能か、評価されているか、どう見られているか
注意が課題や学習方法へ向くと、次の行動を変える材料になりやすい。注意が自己評価へ上がるほど、目の前の課題から離れやすい。メタ分析では、自己へ注意を向けやすい手がかりが、効果を弱める傾向と結びついていた。
ここから分かるのは、「ネガティブな言葉は禁止」ということではない。
「あなたは雑だ」はネガティブで、自己へ向く。
「今回、表の3項目で単位がそろっていない」はネガティブな情報を含むが、課題へ向く。
「あなたは天才だ」はポジティブだが、自己へ向く。
「冒頭で結論を先に置いたため、比較軸がすぐ分かった」はポジティブで、再現できる行動へ向く。
つまり、正負だけでは不十分である。
その言葉が、受け手の注意をどこへ運ぶか。
ここを見ないと、「優しいが使えないフィードバック」と「厳しいが具体的なフィードバック」を同じ箱に入れてしまう。
四つの水準——何について話しているのか
John HattieとHelen Timperleyは2007年のレビューで、フィードバックの焦点を四つの水準に整理した。
水準 主な問い 例
課題 何が合っていて、何が違うか 「この比較では母数が異なる」
プロセス どの考え方・方法を変えるか 「結論から逆算して、必要な根拠だけを残す」
自己調整 自分で確認・修正するには何を見るか 「提出前に、各主張へ原典があるか自分で照合する」
自己 自分はどんな人か 「頭がいい」「センスがない」
課題レベルの情報は、その一回を直すのに役立つ。ただし、別の課題へ自動的に転移するとは限らない。
プロセスレベルは、複数の場面で使える方法を扱う。自己調整レベルは、やがて他者の指摘がなくても誤りを見つけられる状態を目指す。
自己レベルの言葉は、関係づくりや感情面で意味を持つことがある。しかし、何を再現し、何を変えるかという情報としては弱い。
だから、褒めてはいけないのではない。
称賛と学習情報の役割を分ける。
「助かった」「粘り強く取り組んだことを評価している」と伝えたうえで、「特に、三つの案を同じ基準で比較した点を次も残してほしい」と行動へ接続する。
関係を支える言葉を消す必要はない。ただ、それだけで次の試行が変わると期待しない。
フィードバックは、評価・診断・次の試行の三層に分ける
現場でフィードバックが使えなくなるのは、三つの役割が一文に押し込まれるからだ。
「今回の企画は弱い。顧客理解が浅いから、もっと本質を考えて」
この文には、評価も、原因の推測も、改善要求も入っている。しかし、どれも検証できる形になっていない。
FORWARD BASISでは、フィードバックを三層に分けて考える。
1. 評価——基準に対して、今どこにいるか
評価は判定である。
目標を満たしたのか。どの基準が不足しているのか。優先順位は何か。
ここで必要なのは、人格へのラベルではなく、共有した基準との距離だ。
「弱い」ではなく、「企画の採用基準5項目のうち、顧客の未解決課題を示す証拠がない」。
評価だけでは、まだ直し方は分からない。しかし、どこを直すべきかは限定できる。
2. 診断——なぜ、その差が生じたと考えるか
診断は仮説である。
「顧客理解が浅い」と断定する代わりに、観察できた事実と解釈を分ける。
観察:「インタビュー3件の引用はあるが、全て既存機能への感想だった」
解釈:「機能の評価を聞く質問が中心で、機能を使う前の困りごとを取れていない可能性がある」
診断を仮説として扱えば、受け手は反証できる。別の情報があるなら出せる。与える側の思い込みを、相手の欠点として固定せずに済む。
3. 次の試行——次回、何を一つ変えて確かめるか
改善要求を、行動と観測へ変える。
「もっと顧客を理解する」ではなく、「次の2件では、解決策を見せる前に、直近で困った具体的場面を時系列で聞く。その結果、同じ障害が複数件に現れるか確認する」。
これで、次の仕事は単なるやり直しではなくなる。
変更点があり、結果を観測できる試行になる。
評価は現在地を示す。診断は原因候補を示す。次の試行は学習を発生させる。
三つを分ければ、受け手は「自分が否定された」という一つの大きな塊ではなく、検討可能な情報として扱いやすくなる。
高情報量と、大量のコメントは違う
2020年のメタ分析では、何を間違えたかだけでなく、なぜ起き、次にどう避けるかまで含む高情報量のフィードバックが大きな効果と関連していた。
ここで誤解しやすい。
高情報量とは、指摘項目が多いことではない。
20個の赤字が、すべて「違う」「弱い」「分かりにくい」なら、情報は多く見えても、試行差分は小さい。一つの指摘でも、「基準」「観察」「原因仮説」「次の行動」がつながっていれば、次の仕事を変えられる。
Valerie Shuteが2008年に発表した形成的フィードバックのレビューでも、詳しい情報を扱いやすい単位で示すこと、明確で具体的にすること、必要以上に複雑にしないことが提案されている。
たくさん伝えるほど親切、とは限らない。
受け手が同時に変えられることには限りがある。すべての欠点を一度に渡すと、優先順位を決める仕事が受け手へ戻される。結果として、簡単な表記修正だけが直り、構造的な問題は残ることがある。
FORWARD BASISの実務提案は、一つの試行で、主要な変更を一つか二つに絞ることだ。この数は研究が保証した万能値ではない。次の結果から原因を学べるよう、変更点を識別可能にするための目安である。
すべての問題を記録してもよい。ただし、「今回は何を変えるか」と「後で扱う問題」を分ける。
成長は、欠点の完全な一覧から起きるのではない。
一つずつ異なる試行を重ね、何が結果を変えたかを理解することで起きる。
「すぐ返す」が常に正しいわけでもない
フィードバックは早いほどよい、と言われる。
確かに、難しい新しい課題で誤りを重ねているとき、早い修正は迷走を防げる。手続き的な技能では、その場の情報が効率的な場合もある。
一方、即座に答えを与え続けると、自分で誤りを検出する前に外部の情報へ依存する可能性がある。少し遅らせることで、自分の判断を見直し、転移や保持につながる場合もある。
Shuteのレビューでは、即時と遅延の研究結果は一貫していない。課題の難しさ、学習者の熟達度、短期の正答を求めるのか、別の場面へ応用する力を求めるのかによって、望ましいタイミングが変わりうると整理されている。
HattieとTimperleyも、フィードバックは「何も分かっていない状態」へ万能に効くわけではないと指摘する。前提知識がないなら、指摘を増やすより、まず教える必要がある。
ここから、タイミングを一つのルールにしない。
• 危険な誤りや、同じ誤解の反復を止める必要があるなら早く返す
• 本人が方法を試している最中なら、区切りまで待つ
• 自力での検出を育てたいなら、先に自己評価させる
• 次の実践が遠すぎるなら、使える機会まで接続して返す
フィードバックの最適な時刻は、返す側が空いた時刻ではない。
受け手が、その情報を次の判断へ使える時刻である。
上司の正解を当てるゲームにしない
フィードバックが繰り返されると、受け手は学習する。
ただし、学ぶ対象が本来の仕事とは限らない。
「この顧客に何が必要か」ではなく、「上司が好む資料は何か」。
「読者に伝わる文章は何か」ではなく、「編集者が直さない表現は何か」。
フィードバックが判断理由を示さず、完成形だけを指示すると、受け手は評価者への適応を進める。短期的には修正が速くなる。だが、状況が変わったとき、自分で判断できない。
これを防ぐには、正解だけでなく、使った基準を渡す。
「この見出しに変えて」だけで終えず、「本文で最も重要な対立がAとBなので、見出しにもその対立を置く」と伝える。
次回は受け手に、同じ基準で見出し候補を複数出してもらう。選んだ理由も聞く。
最終形をコピーさせるのではなく、判断過程を再現できるかを見る。
ここで目標は、フィードバックを永遠に上手に受ける人をつくることではない。
フィードバックがなくても、自分で差を検出し、次の試行を設計できる人をつくることである。
与える側も、正しいとは限らない
フィードバックの議論では、与える側が正解を知っている前提になりやすい。
しかし、評価者も一部しか見ていない。結果を見てから原因を推測し、自分の好みを品質基準だと誤認することがある。
「準備不足だった」と言われた発表者は、実際には十分準備していたかもしれない。問題は、持ち時間の変更や、聴衆の前提知識とのずれだった可能性もある。
だから、観察と解釈を分ける。
• 観察:何を見た・聞いたか
• 解釈:それが何を意味すると考えたか
• 確信度:他の説明がありうるか
• 確認:本人には何が起きていたか
フィードバックを会話にする目的は、優しくすることではない。
原因診断の精度を上げるためだ。
受け手へ「どう思う?」とだけ聞くと、立場の弱い人は評価者へ同意するかもしれない。代わりに、「この結果になったとき、どこで迷ったか」「別の説明はあるか」「次に変えるならどこか」と、判断可能な問いを置く。
与える側の仮説も、検証対象にする。
評価の場と、成長の場を同じ会話にしすぎない
組織のフィードバックには、もう一つ難しさがある。
同じ人が、成長を助ける役と、報酬・昇進・契約を判断する役を担うことだ。
「失敗を率直に話してほしい」と言われても、その情報が評価へ使われるなら、受け手が防御的になるのは不合理ではない。学習のために弱点を開示することと、査定で能力を証明することが、同時に要求されている。
完全に分離できない組織も多い。それでも、一つの面談の中で時間と目的を分けることはできる。
評価パート
• どの基準で、どの結果を評価するか
• 現時点の判断は何か
• その判断に異議を述べる手続きはあるか
開発パート
• 次に伸ばす能力は何か
• どの場面で試すか
• どんな支援が必要か
• 次回、何を観測するか
評価結果を曖昧にしたまま、「成長のため」と大量の助言を渡すと、受け手は全コメントを査定上の欠点として読む。
逆に、評価を明確にしたあとで、次の試行を共同設計すれば、少なくとも言葉の役割は分かれる。
これは、前掲研究が直接検証した制度ではなく、注意の向き先と試行設計の原理を組織へ移したFORWARD BASISの提案である。
次の一回を変える、五段階のフィードバック
実際の会話では、次の順序を使える。
1. 目標を確認する
「この仕事で、何を実現しようとしたか」
目標が共有されていなければ、評価者の期待を後出しすることになる。まず、成功条件を言葉にする。
2. 観察した事実を一つ示す
「冒頭3分で、背景説明に四つの論点が入っていた」
「分かりにくかった」より、相手が同じ場面を見直せる情報を渡す。
3. 基準との差を示す
「今回の目的は、会議の最初にA案かB案かを決めてもらうことだった。しかし、選択肢が提示されたのは8分後だった」
好みではなく、目的との関係をつくる。
4. 原因を仮説として扱う
「前提を丁寧に伝えようとして、判断に必要な情報と参考情報が同じ強さになった可能性がある。本人から見るとどうだったか」
断定せず、他の説明を確認する。
5. 次の試行を一つ決める
「次回は最初の1分で選択肢と推奨を示し、そのあと根拠を三つまで説明する。会議後、参加者が判断点を言い直せるか確かめる」
行動だけでなく、結果の見方まで決める。
この五段階を一文に縮めると、こうなる。
目的はXだった。Yという場面があり、基準との間にZの差がある。原因はAかもしれない。次はBを変え、Cで確かめよう。
型を守ることが目的ではない。評価、診断、試行が混ざって消えないようにするための足場である。
受け手にも、フィードバックを選ぶ権利がある
複数人から意見を集めると、内容が矛盾することがある。
「もっと短く」と「説明が足りない」。
「個性を出して」と「型に合わせて」。
すべてを採用すれば、作品や判断は平均化する。フィードバックを無条件に受け入れることは、学習ではない。
受け手は、三つを問い返してよい。
• どの目的・基準に対する指摘か
• 具体的に、どの場面からそう判断したか
• 次の一回で、何を変えると確かめられるか
答えが出ない意見にも、感情や違和感のシグナルとして価値はある。ただし、そのまま修正命令にしない。
複数人が同じ箇所で止まり、理由だけが異なるなら、問題箇所の存在は強い。逆に、一人の専門家が他の人には見えない構造を指摘する場合もある。多数決にも、肩書だけにも任せない。
誰の意見を採るかではなく、どの仮説を次の試行で確かめるかを決める。
この考え方にも限界がある
第一に、この記事の主要な近年メタ分析は教育場面を対象にしている。職場、創作、スポーツ、経営判断へ同じ効果量を移すことはできない。KlugerとDeNisiの分析は領域が広い一方、1996年の研究であり、含まれる研究はさらに古い。
第二に、課題・プロセス・自己調整・自己という区分は、現実の会話では重なる。「その方法を選べたのは良かった」という言葉は、方法への情報と称賛を同時に含む。機械的に分類するためではなく、注意の向き先を点検するためのモデルとして使うべきだ。
第三に、直接的な指示が必要な場面もある。初心者が基礎を知らないとき、問いだけ返しても学べない。品質基準を直ちに満たす必要がある仕事では、探索より修正を優先することもある。
第四に、すべてを一度の実験へ変換できるわけではない。信頼、倫理観、長期的な協働のように、短期の指標へ落とすと大切なものを失う領域もある。
第五に、フィードバックの問題に見えて、実際には練習機会がない場合がある。月に一度しか行わない仕事へ助言しても、次に試すまで忘れる。改善したいなら、助言だけでなく、低いコストで再試行できる環境が必要になる。
フィードバックを精密にするだけで、人が育つわけではない。
目標、基礎知識、練習、裁量、信頼。フィードバックは、その中の一つである。
言い終えた瞬間ではなく、次の試行で完成する
フィードバックを渡す側は、説明した時点で仕事が終わったと感じやすい。
しかし、受け手が次に何も変えられなければ、それは評価や感想で止まっている。
次の一回で、何が違うのか。
その違いは、なぜ結果を変えると考えたのか。
変えた結果を、何で確かめるのか。
ここまで決まって初めて、フィードバックは閉じた循環になる。
たくさん言う必要はない。
相手の人格を言い当てる必要もない。
前回と次回の間に、学べる差を一つつくる。
良いフィードバックが残すのは、評価者の言葉ではない。
受け手が自分で回せる、次の試行である。
Sources
原典 本文で用いた範囲 読む際の注意
Avraham N. Kluger, Angelo DeNisi, “The Effects of Feedback 607効果量のメタ分 古い研究を多く含む。理Interventions on Performance: A Historical Review, a Meta- 析、負の効果、注意 論への支持は部分的で、Analysis, and a Preliminary Feedback Intervention Theory,” の焦点を扱う理論 課題特性の理解には未解Psychological Bulletin 119(2), 1996. Full paper (PDF) / DOI 明点が残る
John Hattie, Helen Timperley, “The Power of Feedback,” Review 課題・プロセス・自 教育研究の概念整理。職of Educational Research 77(1), 2007. Full paper (PDF) / Publisher 己調整・自己の4水 場への適用は本記事の翻page / DOI 準、目標と現在地と 訳であり、効果を直接保次の行動 証しない
Valerie J. Shute, “Focus on Formative Feedback,” Review of 具体性、情報量、扱 文献レビューに基づく指Educational Research 78(1), 2008. Author/ETS research report いやすい単位、タイ 針であり、全条件に通用(PDF) / DOI ミング、学習者・課 する単一ルールではない題との相互作用
Benedikt Wisniewski, Klaus Zierer, John Hattie, “The Power of 435研究・994効果 教育場面のみ。研究年代Feedback Revisited: A Meta-Analysis of Educational Feedback 量の全体効果、負の の古さ、出版バイアス、Research,” Frontiers in Psychology 10, 2020. Full paper / DOI 効果、情報内容によ 高い異質性を著者らも報る差、異質性 告している
SOURCE / 原典
この記事の出典
本文の事実確認に使用した原典です。FORWARD BASIS独自の解釈・整理は本文内で区別しています。
- 論文Kluger & DeNisi — The Effects of Feedback Interventions on Performance (Psychological Bulletin, 1996)
- 論文Hattie & Timperley — The Power of Feedback (Review of Educational Research, 2007)
- 論文Shute — Focus on Formative Feedback (Review of Educational Research, 2008)
- 論文Wisniewski, Zierer & Hattie — The Power of Feedback Revisited (Frontiers in Psychology, 2020)