採用方法の予測妥当性:70年間の研究
なぜ「予測妥当性」だけが重要なのか
予測妥当性とは、評価スコアと後の職務上のパフォーマンスの間の相関を示す係数r(0~1)のことです。rが0.0であればコイン投げと同じ。0.5であれば本当に実用的。0.7であれば、ノイズの多い現実世界でも測定可能な上限に近い値です。
採用に関するほぼすべての議論 — 「テイクホーム課題を追加すべき?」「性格検査は本当に価値がある?」「履歴書スクリーニングは意味がない?」 — 妥当性の数値があれば、1つの質問に帰着します:この方法は本当に優秀な人材を見分けられるのか?
このポストは、その膨大な研究文献を短くまとめた、信頼できる解説です。
基本となった研究
数十年の間、標準的な参照文献はシュミットとハンターの1998年メタ分析「人事心理学における選択方法の妥当性と有用性」でした。この論文は約85年間の蓄積研究を統合し、各採用方法の予測力と、一般的認知能力テストを超えた相対的な寄与を順位付けしました。
2022年、サケット、チャン、ベリー、リーベンスが「人材採用における妥当性のメタ分析推定値を再検討する」という重要な論文を発表しました。この論文は、過去の研究が範囲制限の補正を過度に行い、上位の方法の値を誇大評価していたと指摘しました。彼らの再推定では、ほとんどの方法の値が下方修正されていますが、相対的な順位はほぼ変わっていません。
以下の数値は修正されたこれらの推定値を四捨五入したものです。相対的な順位として読んでください。確定的な真実ではなく。
誰もが知るべきチャート
| 採用方法 | 妥当性の目安(r) |
|---|---|
| ワークサンプルテスト | 0.33 |
| 構造化面接 | 0.42 |
| 認知能力検査 | 0.31 |
| 誠実性検査 | 0.31 |
| 職務知識テスト | 0.40 |
| 誠実性(性格検査) | 0.19 |
| 非構造化面接 | 0.19 |
| 学歴(年数) | 0.10 |
| 職務経歴(年数) | 0.09 |
| 推薦状・身元調査 | 0.13 |
| 筆跡鑑定 | 0.02 |
いくつかの重要な特徴が見えます:
- 構造化面接とワークサンプルが頂点にある。 両者は、防衛可能な採用フロー全体を支える中核的な柱です。
- 非構造化面接 — ほとんどのチームが標準にしているもの — は学歴や経歴とほぼ同等。 「会ってみたら良い印象だった」では、コイン投げと変わりません。
- 推薦状・身元調査は弱い。 明らかな不適格者の除外には有効ですが、優秀な人材を選ぶのには向きません。
ランキングから導かれる実務的な意味
ほとんどのチームが見落としている3つの重要な示唆:
1. 長さより構造
アンカーポイント付きの評価スケールを使った30分の構造化面接は、90分の「自分について教えてください」という自由形式の面接より優れています。面接の構造 — 同じ質問、同じ評価基準、同じ評価軸 — が、単純な時間投資より大きな効果を生みます。
2. ワークサンプルは追加できる最高のレバレッジポイント
ほとんどの採用フローは何らかの形式で面接を含みます。一方、適切に設計されたワークサンプルを含むフローは少なくなっています。ワークサンプルを追加することで、通常、妥当性が最も大きく向上します。加えて、実際の職務内容をそのまま評価するため、法的にも防衛しやすいという利点があります。
3. 認知検査は有効だが、均等性の課題がある
認知能力検査は、様々な職務においてパフォーマンスをよく予測します。ただし、ワークサンプルよりも属性による成績差(例えば人種や性別による差)が大きく出る傾向があります。このため、最新の採用ベストプラクティスでは、可能な限り実職務に基づいた評価方法を優先することが推奨されています。
「権威的な文献源」— さらに詳しく知りたい場合
一次文献を確認したい実務家向けに、必読の3つ:
- Schmidt, F. L., & Hunter, J. E. (1998). The validity and utility of selection methods in personnel psychology: Practical and theoretical implications of 85 years of research findings. Psychological Bulletin, 124(2), 262–274.
- Sackett, P. R., Zhang, C., Berry, C. M., & Lievens, F. (2022). Revisiting meta-analytic estimates of validity in personnel selection: Addressing systematic overcorrection for restriction of range. Journal of Applied Psychology, 107(11), 2040–2068.
- SIOP原則(産業・組織心理学会)— 検証と公正性に関する実務的ガイダンス。
2022年のサケット論文が最も新しい権威的な出典です。採用設計資料で数値を引用する際は、こちらを参照しましょう。
あなたの採用フローに求められることは
最短で防衛可能な推奨事項:
- ワークサンプルを追加する — 3時間以内に適切な実務的課題を設計できるポジションすべてに。
- すべての面接を構造化面接に統一する — 同じ質問、同じ評価基準、推薦前にスコアを決定。
- 非構造化な「雰囲気判定」ラウンドは社交的な側面として位置づける。 短めにして、最終判定への影響を抑える。
- 採用・不採用の判定から推薦状・身元調査を外す。 最後の総合的なチェック段階として使用。
これら1セットの変更により、典型的な採用フローの予測力はrで0.2台から0.5台へと大幅に向上します。1年間の採用成果に与える複合効果は非常に大きいものになります。
ClarityHireの位置づけ
ClarityHireは、正にこの優先順位に基づいて構築されています。デフォルトのスコアカードテンプレートは構造化されており、評価テンプレートも問題集ではなく実務的なワークサンプル形式です。完全性シグナルは、AI時代においても持ち帰り型の課題の信頼性を守ります。プロダクトの設計方針は研究結果に基づいており、その逆ではありません。
採用方法は妥当性で選びましょう。その他はすべてスタイルに過ぎません。