メインコンテンツへスキップ
コラム一覧に戻る
コラム

結果を見ない判断は、経験を積んでも静かにずれていく

2026年10月3日
最終更新: 2026年10月3日
14
結果を見ない判断は、経験を積んでも静かにずれていく

結果を見ない判断は、経験を積んでも静かにずれていく

採用面接を何百回も担当してきた人は、面接の判断が上手くなっているでしょうか。

直感的には、はいと答えたくなります。回数をこなせば上手くなる、というのは多くの技能で実際にそうです。ただ、面接の場合に上手くなるのは面接の進め方であって、合否の判断の精度ではないかもしれません。

採用した人がその後どう活躍したかは、ある程度見えます。一方で、不採用にした人がその後どこでどれだけ活躍したかは、ほぼ見えません。見えている側だけで「やはり自分の判断は当たっている」と確認し続けると、判断の基準は固定されます。固定された基準が最初からずれていた場合、そのずれは経験年数とともに強化されることになります。

この構造は、採用に限りません。融資審査、進路指導、企画の採否、取引先の選定。「選ばなかった側」の行方が見えない判断はすべて同じ形をしています。

30秒で要点

  • 判断が経験で改善するには3つが要る。判断の記録・結果の観測・両者の突き合わせ。欠けやすいのは2つめ
  • 選ばなかった側の結果は構造的に見えない(反実仮想が観測できない)。そのため信念は更新されないまま固定される
  • NBERのワーキングペーパー35701(査読前)は、教師の進路推薦を対象に、成績と興味を一定にしても社会経済的に不利な背景の生徒に学術トラックを推薦する確率が有意に低く、同時に体系的に不正確な信念が伴っていたと報告している
  • 効果が確認された手当ては、叱責や研修ではなく「自分の過去の推薦についての個別フィードバック+実際の成功実績という客観的な情報」の提示だった
  • 最小の手当ては、判断を予想とセットで記録すること。予想が残っていない判断は、後から突き合わせられない

経験が判断を改善するための3条件

まず、経験が技能を改善する仕組みを分解します。改善が起きるには、最低でも次の3つが必要です。

要素内容欠けたときに起きること
判断の記録そのとき何をどう判断したか、何を予想したかが残っている後から「そう思っていたことにする」が混入する
結果の観測その判断がどう転んだかが見える更新の材料がない
突き合わせ記録と結果を並べて照合する材料があっても信念は動かない

ゴルフのスイングやプログラミングが経験で上達するのは、この3つが自動的に揃うからです。打った球はすぐ飛ぶ方向が見え、書いたコードはすぐ動くか動かないかが分かる。記録を取らなくても、結果が即座に返ってくるため、突き合わせが無意識に行われます。

人や方針についての判断は、ここが決定的に違います。

結果が返ってくるまでが長い。 採用の成否が分かるのは半年後から数年後です。

結果が片側しか返ってこない。 選んだ側の結果は見えますが、選ばなかった側の結果は見えません。

判断の記録が残っていない。 面接の評価メモは残っても、「この人は3年後にこのポジションで成果を出す」という予想は、多くの場合どこにも書かれていません。

3つのうち2つが構造的に欠けている状態で、回数だけが積み上がっていきます。

見えない側があることが、なぜ精度を下げるのか

ここで一度立ち止まります。「片側しか見えない」ことは、本当に判断の精度を下げるのでしょうか。見えている側だけでも、当たり外れは分かるのではないか。

分かる部分はあります。採用した人が成果を出さなかった場合、それは判断の誤りとして観測できます。問題は、その逆の誤りが観測できないことです。

判断の誤りには2種類あります。

  • 選んだが、間違っていた(採用した人が活躍しなかった、融資先が返済できなかった)
  • 選ばなかったが、間違っていた(不採用にした人が他社で活躍した、融資を断った会社が成長した)

1つめは見えます。2つめは見えません。この「もし逆の判断をしていたらどうなっていたか」という、実際には起きなかった側の結果を反実仮想と呼びます。

見える誤りだけを材料に基準を更新すると、どう動くか。1つめの誤りを減らす方向——つまりより慎重になる方向——にだけ圧力がかかります。慎重にすれば1つめは減りますが、2つめは増えます。そして2つめが増えたことは観測されないため、「慎重にして正解だった」という結論だけが残ります。

これが「静かにずれていく」の中身です。ずれは失敗として現れません。むしろ、改善したという実感とともに進みます。

教師の進路推薦で測られたこと

この構造を実際のデータで扱った研究があります。NBER(米国全米経済研究所)が公開しているワーキングペーパー「Tracking Inequality: Teachers and the Allocation of Educational Opportunities」(Michela Carlana、Francesca Miserocchi、Eleonora Patacchini、Working Paper 35701、DOI 10.3386/w35701、2026年9月)です。

この論文の要旨は、次の一文から始まります。

Professionals routinely make consequential decisions for others without systematically observing how those decisions turn out.

「専門家は、他者にとって重大な帰結をもつ判断を日常的に下しているが、その判断がどう転んだかを体系的に観測してはいない」。本記事の問題設定そのものです。続いて、そうした判断が正確な予測を反映しているのか、それとも体系的に歪んだ信念を反映しているのかは、機会の平等にとって重要な意味を持つ、と書かれています。

研究は、教師による高校トラック(進路)推薦を対象に、全国規模の行政データ、ランダム化されたビネット実験(条件を変えた架空の事例を提示して判断を観察する手法)、信念の誘出、フィールド実験を組み合わせています。

成績と興味を一定にしても、推薦は変わった

報告されている結果を2つ挙げます。

1つめ。 生徒の学業成績と興味を一定に保っても、社会経済的に不利な背景の生徒に対しては、要求水準の高い学術トラックを推薦する確率が有意に低かった。

成績と興味を揃えても推薦が変わるというのが要点です。成績という観測可能な指標の差では説明されない差が残っている、ということになります。

2つめ。 この取り扱いの差には、体系的に不正確な信念が伴っていた。教師は、成績優秀でも不利な背景を持つ生徒が、学業的に要求水準の高い学校で失敗する確率を大幅に過大評価していた。

原文は "accompanied by"(伴っていた)です。不正確な信念が推薦差を引き起こしたという因果の向きは、要旨からは断定できません。本記事でも併存として扱います。

ただ、併存であっても構造としては読めます。失敗確率を過大に見積もっていれば、推薦を控えるのは合理的な行動です。そして控えた結果どうなったかは、教師には見えません。推薦しなかった生徒がその進路でどうなったかを、体系的に追う仕組みがないからです。

効果があったのは、叱責でも研修でもなかった

研究チームは次に介入を行いました。教師に対して提供したのは2つです。

  1. 自分の過去の推薦についての個人別フィードバック
  2. 不利な背景の生徒が実際にどれだけ成功したかという客観的な情報

この介入は、成績優秀層における推薦の社会経済的格差を大幅に縮小させました。

ここが、この研究から持ち帰る価値がある部分だと考えています。介入の中身は、注意喚起でも研修でも評価制度の変更でもありません。自分が何を判断したかの記録と、実際にどうなったかの結果を、並べて見せただけです。3条件のうち欠けていた「結果の観測」と「突き合わせ」を外から補った、という形になっています。

さらに報告されているのは、効果が、事前の推薦格差が最も大きく信念が最も不正確だった教師に割り当てられた男子生徒に集中していたこと。そして介入の影響を最も受けた成績優秀・不利な背景の男子生徒では、要求水準の高い学術トラックへの進学率が上昇し、短期の学業成績に検出可能な悪影響は見られなかったことです。

男子に集中した理由は要旨からは読み取れません。「女子には効果がない」という読み方はできないため、本記事ではその方向には踏み込みません。また悪影響が見られなかったのは短期の学業成績についてです。長期の帰結や介入効果の持続性は、要旨には書かれていません。

この研究をどこまで持ち帰れるか

確かなこと:ここまでに挙げた事実——要旨の冒頭文、研究の手法の組み合わせ、成績と興味を一定にしたときの推薦確率の差、不正確な信念の併存、介入の内容と推薦格差の縮小、効果の集中——は、本文中にリンクしたNBERの論文ページで直接確認できます。

まだ確かではないこと:これは査読前のワーキングペーパーです。NBERのページにも「ここで表明された見解は著者らのものであり、必ずしも全米経済研究所の見解を反映するものではない」と記載があります。本記事ではサンプル規模・効果量・信頼区間といった数値には触れていません。論文ページの要旨を読んだ範囲での記述であり、PDF本文は確認していないためです。

外挿できないこと:この研究の舞台はイタリアです。行政データはイタリア教育省とINVALSI(イタリアの教育評価機関)から提供され、研究はAEA RCT Registry(経済学分野のランダム化比較試験の登録簿)にAEARCTR-0010758として登録、ボッコーニ大学とハーバード大学の倫理審査を経て2022年から2024年に実施されています。イタリアの高校が早い段階で進路別に分かれる制度が前提にあります。日本の進路指導や、企業の採用選考・融資審査に推定結果をそのまま当てはめることはできません。

では何を持ち帰るのか。 数値ではなく構造です。「結果を観測していない判断は、記録と突き合わせを外から補うと変わりうる」という形は、制度が違っても検討する価値があります。変わる方向や大きさは、自分の現場で確かめるしかありません。

なぜ「自分の判断は当たっている」と感じやすいのか

ここまでの構造を知っても、自分の判断については「それでも当たっている」と感じると思います。私たちもそう感じます。この感覚が消えない理由は、記憶の問題というより検証の非対称性にあります。

当たった判断は、結果が返ってきた時点で「当たった」として記録されます。外れた判断のうち、選んだ側で外れたものも記録されます。しかし選ばなかった側で外れたものは、そもそも照合の機会がありません。

つまり手元に残る判断の記録は、検証可能な判断に偏ったサンプルです。そのサンプルで計算した的中率は、判断全体の的中率ではありません。にもかかわらず、感覚としてはそれが「自分の実績」になります。

経験年数が長いほど、このサンプルは大きくなります。大きなサンプルで計算した数字は、確信を強めます。だから経験は、精度ではなく確信を上げます。この2つが一致しているかどうかは、突き合わせをしないと分かりません。

ここには付け加えておくべきことがあります。この構造は、判断を仕事にしている人ほど強く働きます。提案の採否を日常的に決めている立場、どの方針を勧めるかを判断している立場。私たちコンサルタントもこの構造の内側にいます。外から指摘できる立場ではなく、同じ条件で判断している側です。だからこそ、記録と突き合わせを自分の運用に入れておく必要があると考えています。

判断を記録するときに何を書くか

では、どう手当てするか。判断軸は1行です。

判断そのものではなく、判断とセットの「予想」を残す。

記録に書く内容は3つです。

  1. 何を選んだか:選択そのもの
  2. 何を予想したか:選んだ結果どうなると思ったか。できれば検証可能な形で(「半年後にこの指標がこの水準になる」など)
  3. 選ばなかった側はどうなると思ったか:これが反実仮想に近づくための項目

3番目が難しく、そして効きます。「この候補者を採用しなかったが、他社では通用しないだろう」と書いておけば、後から風の噂で活躍を聞いたときに、それが突き合わせの材料になります。書いていなければ、「まあ、うちには合わなかっただけだ」で処理されます。

予想を書かずに判断だけを記録しても、突き合わせにはなりません。後から振り返るとき、人は結果を知った状態で「自分はこう思っていた」を再構成します。予想が文字で残っていない限り、この再構成を止める手段がありません。

結果が構造的に見えない判断は、どう扱うか

記録しても結果が見えない判断もあります。不採用にした候補者のその後、断った取引先の行方。これらは追跡の手段がありません。

この場合、突き合わせを諦めるのが正直な扱いだと考えています。そのうえで、その種類の判断について自分が持っている確信を、根拠ではなく未検証の信念として扱う。「経験からそう感じる」を結論の根拠に使わない、という線引きです。

これは判断を放棄することではありません。判断は下します。ただ、その判断の確信の強さを、検証の有無に応じて区別しておく。検証できている領域の確信と、検証できていない領域の確信を、同じ重さで扱わないということです。

不確実な状況で仮説と検証を回す考え方そのものは不確実性を前提に、仮説と検証を回し続けるということ、改善の仮説を記録として残す手順は「改善の正解探し」をやめるで扱っています。主観的な実感と実測がずれる例としては速くなった気がする、を疑うが近い構造です。

自分でも試せる、最小の検証

直近に下した判断を3件選び、次の3行を書いてください。

  1. 何を選んだか
  2. そのとき何を予想していたか(覚えている範囲で。思い出せなければ「予想を立てていなかった」と書く)
  3. 選ばなかった側はどうなると思っていたか

書いてみると、多くの場合2と3が埋まりません。思い出せないのではなく、判断の時点で言葉にしていなかったからです。それが分かるだけで、この記事の主張は手元で確認できたことになります。

次に下す判断では、この3行を判断の時点で書きます。そして結果が見えた時点で開く。1件あたり3分です。10件たまった頃に、自分の予想が体系的にどちらへずれているかが見えてきます。

判断に迷ったときに立ち返る問い

  • この判断について、結果を観測する手段はあるか。ないなら、その確信は未検証のまま置く
  • 選ばなかった側がどうなると予想しているかを、言葉にしたか
  • 手元の「的中した実績」は、検証可能な判断だけに偏ったサンプルではないか
  • 経験年数が上げているのは、精度か、それとも確信か
  • 判断のずれを直す手当てとして、注意や反省ではなく「記録と結果の突き合わせ」が設計に入っているか

判断の型そのものを匿名ケースで見ていく入口としては判断の構造 — 匿名ケースで見る意思決定の型があります。経験に基づく通説が実データで覆った例は「判断疲れ」に証拠はあるのか?でも扱いました。

自社の判断のうち、どれが検証できていてどれが検証できていないかを整理したい場合は、状況を言葉にするところから始めることができます。

状況を整理する(15分)

より深く学ぶ

参考資料・引用元

  • Michela Carlana, Francesca Miserocchi, Eleonora Patacchini, "Tracking Inequality: Teachers and the Allocation of Educational Opportunities", NBER Working Paper 35701, September 2026, DOI 10.3386/w35701. https://www.nber.org/papers/w35701

よくある質問(FAQ)

この記事の関連リンク

💡 判断軸として

First byte Method 完全ガイド

AI×心理学×統計学で判断の質を高める実践的手法