それぞれが実際に測っているもの
ワークサンプルは職務を写し取った短く現実的な課題です。難しい顧客への返信、ヒアリングのロールプレイ、用意されたメールのうちいちばん強いものを選ぶこと、データの突き合わせ。測っているのは仕事そのものです。この人は、その職務が求めるものを代表する部分を、基準に照らして採点できる形でこなせるのか、ということです。
面接が測っているのは別のもので、私たちがふだん認めているよりも狭いものです。よく構造化された面接は、動機、背景、伝える力、そして過去の場面について声に出して筋道を立てる様子を見るのに向いています。一方で非構造化の面接がおもに測っているのは、失うものが少ない場でその人がどれだけ気楽に仕事について語れるかです。だから自信、打ち解けやすさ、洗練に報いてしまい、その仕事ができないままでも通ってしまいやすいのです。
肝心な違いはこうです。ワークサンプルは行動を見せ、面接は行動についての会話を見せます。どちらも役に立ちえますが、それはそれぞれに本当に得意な仕事を頼んだ場合に限られます。
予測妥当性を正直に語る
どちらの手法がどれだけ優れているかを正確な数字で引きたくなりますし、アセスメント業界はそれを気軽にやります。私たちは数字を作りません。私たちが説明責任をもって言える正直な主張は方向についてのもので、数十年の採用研究に支えられています。実際の仕事を切り取って見るほうが、非構造化の面接よりも確かに入社後の成果を推し量れる傾向があり、構造はどの手法も良くする、というものです。
理屈は直感的です。ある人が課題をこなせることを最もよく示すのは、意味があるといえる程度に本物の仕事へ近い条件のもとで、その課題を代表する形でこなす姿を見ることです。非構造化の面接はそこから何段階も離れています。仕事を実演させるのではなく、記述させたり主張させたりするので、自信と打ち解けやすさが能力の代わりに立つ余地が大きく残ります。
これを正直に保つ但し書きが二つあります。ひとつは、うまくできていないワークサンプル、つまり曖昧だったり、代表的でなかったり、勘で採点されたりするものは、やはり見通しが立たないということです。強みは形式そのものではなく、現実味と評価ルーブリックの組み合わせから来ます。もうひとつは、よく構造化された面接、つまり同じ質問、同じ基準、手引きに照らした採点であれば、流れるままの雑談よりもはるかに多くを教えてくれるということです。意味のある比較は構造化か非構造化か、そしてワークサンプルか仕事についての会話かであって、たったひとつの魔法の係数ではありません。
偏りと公正さ
採用の偏りの多くは非構造化の面接に住んでいます。ひとつの強い回答から生まれる後光効果、自分に似た候補者へ引かれる傾向、そして候補者を本当に比べられなくしてしまう一貫性のない質問です。面接官が印象で採点するため、これらの働きは見えにくく、「相性」として片づけられやすくなります。
評価ルーブリックに照らして採点するワークサンプルは、その余地を狭めます。全員が同じ課題をこなし、同じ明示された記述で測られるので、「気に入った」は「顧客の状況を受け止め、正確さを保ち、次の一手をはっきり示した」に変わらざるをえません。それは比べやすく、説明もしやすくなります。とはいえ自動的に公正になるわけではありません。ワークサンプルも、代表的でなかったり、受けにくかったり、実生活に収まらないほど長かったりすれば、人を不利にしえます。公正さは、代表性のある課題、あらかじめ書かれた評価ルーブリック、無理のない時間設定、配慮、そして重さの釣り合った不正防止から生まれます。網をかけるような監視からでも、候補者を雇用主から雇用主へ追いかける隠れたスコアからでもありません。
- ワークサンプルは、確認の前に書いた評価ルーブリックで、水準ごとの具体的な記述に照らして採点する。
- 課題は代表性があり、受けやすく、長さの釣り合ったものに保つ。
- 面接も構造化する。同じ質問、同じ基準、手引きに照らした採点。
- 不正防止の確認は結果の重さに見合わせる。雇用主をまたぐ評判スコアは持たない。
どちらをいつ使うか
これは勝者がひとりだけの競争ではありません。それぞれの手法を、それがいちばん得意なことに使ってください。そして決定の重みはワークサンプルに担わせます。職務にいちばん近い部分だからです。
- 初期には軽いワークサンプルか状況判断の演習を使い、履歴書の洗練ではなく職務に関わる行動で絞り込む。
- 最終候補者にはより本格的なワークサンプルを使い、実際の仕事が評価ルーブリックで採点される様子を見る。
- 構造化面接は、サンプルでは見えないものを足すために使う。動機、背景、キャリアの向き、チームの事情。
- 非構造化の面接にワークサンプルの証拠をくつがえさせない。サンプルが取り除いた偏りを、そのまま呼び戻すことになる。
- プロセス全体の重さを釣り合わせる。選考の回数が多いことは、手がかりが多いことではない。
SkillCort は両者をどう証拠にまとめるか
目的は手法を選ぶことではなく、証拠を組み上げることです。実務では、コンピテンシーを名指しする職務ブループリント、複数の評価者が共有の評価ルーブリックで採点する現実に即したワークサンプル、そしてばらばらの印象として残すのではなく同じコンピテンシーに沿ってメモを取る構造化面接、という形になります。どの手法も最終決定権を奪い合うのではなく、同じ一枚の絵に足していきます。
AI はそれを決めることなく支えます。長い回答やロールプレイを要約し、回答を触れたコンピテンシーに結びつけ、一貫した一次メモを用意し、人が確認すべき不正防止の兆候に印をつけられます。動かしてはならない線は誰が決めるかです。AI は選びも、落としも、順位づけもせず、候補者についての隠れたスコアを雇用主をまたいで持ち回ることもありません。証拠を量って判断を下すのは人です。
課題、回答、評価ルーブリックの点数、構造化面接のメモ、確認した人、そして理由。これらが組み合わさると決定の記録になります。候補者どうしを比べられ、関係者に説明でき、後からでも説明責任に耐えるものです。これが「ワークサンプルか面接か」という論争を、ひとつづきの証拠に変えるものです。
避けたいよくある間違い
チームがワークサンプルと面接の釣り合いを崩すとき、その崩れ方は決まっています。
- 面接をアセスメントとして扱い、ワークサンプルを形式上の手続きとして扱う。
- 非構造化の面接を行い、そこから生まれた印象を「相性」と呼ぶ。
- 代表性がなく、曖昧で、勘で採点されるワークサンプルを作る。
- 強い面接ひとつに、より弱いワークサンプルの証拠をくつがえさせる。
- 現実味と構造から筋道を立てる代わりに、作られた妥当性の数値を引いて選択を正当化する。
- 証拠を確認する人にではなく、点数やモデルに決定を委ねる。
要点
- ワークサンプルは行動を見せ、面接は行動についての会話を見せます。それぞれに得意なことを頼んでください。
- 率直に言えば、実際の仕事を切り取って見るほうが、非構造化の面接よりも成果につながる傾向があります。構造はどの手法も良くします。
- 評価ルーブリックで採点したワークサンプルは偏りの余地を狭め、比べやすくなりますが、公正さには代表性があり、受けやすく、重さの釣り合った課題が要ります。
- 初期には軽いサンプル、最終候補者にはより本格的なサンプル、そしてサンプルでは見えないものには構造化面接を使ってください。
- SkillCort は両方を決定の記録にまとめます。AI は評価を支え、決めるのは人で、雇用主をまたぐスコアはありません。