「面接映え」と「入社後の活躍」はなぜずれるのか…STAR面接とAIによる回答分析で評価を標準化する

「面接映え」と「入社後の活躍」はなぜずれるのか…STAR面接とAIによる回答分析で評価を標準化するの画像1

●この記事のポイント
面接で高評価だった人が入社後に伸び悩むのはなぜか。採用面接の評価の仕組みから原因を解説する。Sackettらの2022年の再分析では、構造化面接の予測妥当性は0.42で最も高く、非構造化面接は0.19にとどまった。記事では、STAR面接の深掘り質問とルーブリックの作り方、生成AIで面接ログを点検する手順を紹介する。あわせて、AIの評価の偏りやEU AI規則の2027年適用といった注意点も整理した。

 面接では評価が高かったのに、入社してみると思ったほど成果が出ない。採用に関わる人なら一度は経験する「ずれ」だ。原因を候補者個人に求める前に、面接という道具そのものの精度を疑ってみたい。人事測定研究の最新の知見と、生成AIを使った面接ログ分析の現実的な使い方から、評価を標準化するための手順を整理する。

●目次

「話がうまい」と「仕事ができる」は別の能力

 話しぶりに説得力がある。有名企業での実績を淀みなく語れる。こうした候補者に高い点がつくのは自然なことだ。ただ、面接官が見ているのは多くの場合「説明する力」であって、「同じ状況で同じ行動を再現できるか」ではない。この二つが混ざったまま評価が下される。

 加えて、人の判断には癖がある。一つの目立つ長所が全体の印象を引き上げる「ハロー効果」は、心理学者ソーンダイクが1920年に報告して以来、繰り返し確認されてきた。自分と経歴や話し方が似た相手を高く見る「類似性バイアス」もある。質問も評価基準も面接官任せの「非構造化面接」では、こうした癖を抑える仕組みがない。

「面接の失敗は、面接官の能力不足というより設計の問題です。同じ質問をしない、同じ物差しで採点しない。これでは、誰が面接しても結果がぶれます」(人事労務コンサルタント、社会保険労務士・松田美里氏)

数字が示す構造化面接の優位

 採用手法の予測精度を語るとき、長く引用されてきたのがシュミットとハンターの1998年のメタ分析だ。構造化面接の妥当性係数(入社後の業績との相関)を0.51、非構造化面接を0.38としていた。

 この数字は2022年に見直された。米ミネソタ大学のサケット教授らが学術誌「Journal of Applied Psychology」で、過去の分析が統計補正をかけすぎて数値を膨らませていたと指摘し、推定をやり直したのだ。

手法                  1998年推定       2022年改訂
構造化面接         0.51                 0.42
非構造化面接      0.38                 0.19

 改訂で全体の数値は下がった。それでも構造化面接は、一般知的能力テスト(0.31)を上回り、調べた手法の中で最も高い平均値となった。非構造化面接との差はむしろ開いている。

 注意点もある。構造化面接の数値はばらつきが大きく、80%信用区間は0.18〜0.66と幅広い。「構造化すれば必ず当たる」のではなく、設計と運用の質で精度が大きく変わる、と読むのが正確だ。

STARは「過去の行動」を取り出す型

 構造化面接の代表的な形式が、過去の具体的な経験を聞く行動面接だ。回答をS(状況)、T(課題・役割)、A(本人の行動)、R(結果)に分けて聞く「STAR」が現場では広く使われている。意気込みや仮定の話ではなく、実際に起きたことを材料にする点がポイントになる。