Adım 1: Ölçütleri yanıttan değil, şablondan çıkarın
Rubriğinizdeki her ölçüt, rol şablonunuzdaki bir davranışa geri gitmelidir. Şablonun eşleme tablosunu açın, görevin gözlemlemek için kurulduğu yetkinlikleri bulun ve davranışlarını ölçüt olarak taşıyın. Şablonun adlandırmadığı hiçbir şey rubriğe girmez ve görevin gözlemlemek için tasarlandığı hiçbir şey puansız kalmaz. Bir puanı sonradan anlamlı kılan şey bu izlenebilirliktir: "politika içinde muhakeme"de alınan bir 4, tanımlı bir davranışa işaret eder; o da işin gerçek ürünlerine.
Sayıyı dar tutun — görev başına üç ila beş ölçüt. Değerlendiriciler her ölçüt ayrı olduğunda güvenilir puanlar; birbirini örten on ölçüt, güçlü tek bir izlenimin her satıra bulaştığı hale puanlamasını üretir. İki ölçüt neredeyse hep birlikte hareket edecekse — yazılı bir destek yanıtında "açıklık" ile "kurgu" gibi — bunları birleştirin ve ölçüt tarifinde bunu belirtin.
Bir yanıt sizi şaşırttı diye inceleme ortasında ölçüt eklemeye direnin. Adaylar rubriğin göremediği bir şeyi — iyi ya da kötü — yapmayı sürdürüyorsa, bunu bir sonraki sürüm için bir bekleme listesine not edin. Ölçerken aracı değiştirmek, tutarlılığın öldüğü yerdir: dün puanlanan adaylarla yarın puanlanacaklar farklı ölçütlerle karşılaşır ve hangi puanın ne anlama geldiğini kimse söyleyemez.
Adım 2: Ölçütleri özellik olarak değil, gözlemlenebilir davranış olarak yazın
Bir ölçüt, değerlendirici yanıtta onu karşılayan satırı gösterebiliyorsa gözlemlenebilirdir. Özellik sözcükleri — empatik, özgüvenli, ayrıntıya dikkat eden — her değerlendiriciyi kendi özel tanımına başvurmaya davet eder; iki puanın ayrıştığı yer de o özel tanımlardır. Her özelliği, bu görevin teslimatında onu kanıtlayan görünür eyleme çevirin.
Çevirme kalıbı mekaniktir: özelliği adlandırın, güçlü bir yanıtta birebir ne göreceğinizi sorun ve onu yazın. Çevirmeyi görev tasarımı aşamasındaki pilot yanıtlarınıza karşı yapın; çünkü pilot size her davranışın bu biçimde ve bu uzunlukta tam olarak neye benzediğini gösterdi. Aşağıdaki örnekler destek ve iç satış görevlerinden alınmıştır.
- "Empati gösterir" yerine → "herhangi bir çözüm önermeden önce, açılış satırlarında müşterinin öfkesini kabul eder."
- "İyi muhakeme" yerine → "iade politikasını doğru uygular ve yaptığı istisnayı gerekçesiyle açıklar."
- "Güçlü iletişimci" yerine → "bir sonraki adımı, sahibini ve müşterinin ne zaman haber alacağını belirtir."
- "Danışmanlık yapar" yerine → "ürünü konumlandırmadan önce potansiyel müşterinin mevcut süreci hakkında en az bir keşif sorusu sorar."
- "Düzenli" yerine → "kuyruğu savunulabilir bir öncelik sırasıyla işler ve seçtiği sıranın gerekçesini belirtir."
Adım 3: Her ölçek düzeyini somut tariflerle çıpalayın
Çıpasız bir 1–4 ölçeği, içgüdünün dört ayrı tadından ibarettir. Her ölçüt için, her düzeydeki bir yanıtın gerçekte ne içerdiğine dair kısa bir tarif yazın — bağımsız değerlendiricileri buluşturan düzey temelli, yani matris rubrik budur. Hizalamayı çıpalar yapar; bu yüzden her biri derece sözcüklerini değil kanıtı tarif etmelidir: "biraz net" ve "çok net" hiçbir şeyi çıpalamaz.
Bir destek talebi görevindeki gerilim düşürme ölçütünü ele alın. Düzey 4: öfkeyi özgül biçimde kabul eder, savunmacı olmaz, politika içinde çözer ve zamanı belirli somut bir sonraki adıma söz verir. Düzey 3: kabul eder ve doğru çözer, ama verdiği söz muğlaktır. Düzey 2: politikada doğrudur ama müşterinin duygusal durumunu görmez ya da hiçbir şey çözmeden özür diler. Düzey 1: üslubu tırmandırır, politikayı yanlış aktarır ya da müşteriyi yolsuz bırakır.
Çift sayıda düzey kullanın — dört iyi çalışır — böylece kararsız puanların park edeceği rahat bir orta nokta olmaz. Ve çıpaları pilot yanıtlarınızdan çıkarın: çalışanlarınızın ürettiği güçlü, ortalama ve zayıf çıktılar düzeylerin gerçek örnekleridir; onların kalıplarını çıpalara taşımak ölçeği göreve karşı dürüst tutar.
Adım 4: Ölçütleri bilinçli ağırlıklandırın
Ağırlıksız rubrikler her şeyin eşit olduğunu sessizce ilan eder; oysa şablon neredeyse hiçbir zaman bunu söylemez. Şablonun yetkinlik ağırlıklarını rubriğe taşıyın: işe alım yöneticisinin tolere etmeyeceği yetkinlik en ağır ölçütleri alır, koçlukla kapanabilir olanlar daha azını. Ağırlıkları puanlama başlamadan önce belirleyin ve her birinin yanına birer cümlelik gerekçe yazın; böylece tercih rivayet değil, incelenebilir bir şey olur.
Hiç ağırlık taşımayan şeyler konusunda da aynı ölçüde bilinçli olun. Süreli bir taslakta yazım hataları, biçimlendirme süsleri ya da sesli bir yanıtta adayın aksanı, şablon bunları adlandırmadıkça açıkça puanlanmayan olarak listelenmelidir — ve çoğu destek ile iç satış rolünde şablon bunları adlandırmaz. Ölçüt olmayanları adıyla anmak, bir rubriğin yapabileceği en güçlü adalet hamlelerinden biridir; çünkü değerlendiricilerin farkında olmadığı önyargıları etkisiz kılar.
- Ağırlıklar şablonu yansıtır: karar açısından kritik yetkinlikler en ağır, koçlukla kapanabilenler daha hafif.
- Ağırlık başına birer cümlelik gerekçe kayda geçirilir.
- Ölçüt olmayanlar açıkça adlandırılır: değerlendiricilerin bir puanı oynatmasına izin vermemesi gerekenler.
- Muhakeme ölçütlerinde geçti/kaldı kapısı yok — sınırdaki yanıtlar çıpalara göre orantılı puanlanır.
Adım 5: Rubriği yayına almadan önce örnek yanıtlarda test edin
Hiçbir şeyi puanlamamış bir rubrik bir varsayımdır. Pilot yanıtlarınızı alın — artı kendi yazdığınız birkaç bilinçli kusurlu yanıt; örneğin sıcak ama politikada yanlış bir cevap ya da doğru ama soğuk bir takip e-postası — ve iki değerlendirici bunları taslak rubriğe göre bağımsız puanlasın. Sonra ölçüt ölçüt karşılaştırın.
İki puanın ayrıştığı yerde çözüm neredeyse her zaman değerlendiricilerde değil, çıpa metnindedir. Aynı yanıtta 2 ile 3 arasındaki fark, düzey tariflerinin yoruma yer bıraktığı anlamına gelir: tartışmalı yanıtın içerdiği somut kanıtla keskinleştirin. Sıcak ama yanlış yanıt özellikle işe yarar — rubriği, üslup ile doğruluğun tek bir izlenimde bulanmak yerine ayrı satırlarda puanlandığını kanıtlamaya zorlar.
Bağımsız puanlar her ölçütte birbirinden en fazla bir düzey uzakta buluşana kadar tekrarlayın. Yapay zekâ burada karar desteği olarak yardım edebilir — uzun yanıtları özetleyerek ya da bir yanıtın her ölçüte nerede dokunduğunu göstererek — ama bu testteki puanlar insan değerlendiricilerinizden gelmelidir; çünkü rubriğin var oluş nedeni onların anlaşmasıdır.
Adım 6: Adaylar girmeden önce bir sürümü dondurun
İlk aday yanıtı geldiği anda rubrik hareket etmeyi bırakmalıdır. Onu v1 olarak dondurun: ölçütler, çıpalar, ağırlıklar ve ölçüt olmayanlar; bir tarihle ve türetildiği şablon sürümüne bir bağlantıyla birlikte. Pozisyondaki her puan artık sabit bir araca atıf yapar; birinci adayı kırkıncıyla karşılaştırmanızı ve bir karar aylar sonra sorgulanırsa ikisini de savunmanızı sağlayan şey budur.
İyileştirmeler canlı rubriğe değil bir bekleme listesine gider. Pozisyon kapandığında — ya da gerçekten bozuk bir çıpa erken revizyonu zorunlu kıldığında — bir değişiklik kaydıyla v2'yi yayımlayın; bir değişiklik pozisyonun ortasına denk gelirse, önceki yanıtların yeni sürüme göre yeniden puanlanıp puanlanmayacağına açıkça karar verin ve bunu kayda geçirin. Dondurulmuş ve sürümlenmiş bir rubrik, denetime hazır bir karar dosyası ile kimsenin yeniden kuramayacağı bir sayı yığını arasındaki farktır.
Öne çıkanlar
- Her ölçüt bir şablon davranışına geri gider — görev başına üç ila beş ayrı ölçüt, inceleme ortasında asla eklenmez.
- Ölçütleri, herkesin kendi özel tanımını çağırmasına yol açan özellik sözcükleri olarak değil, teslimatta görünen eylemler olarak yazın.
- Her ölçek düzeyini somut kanıt tarifleriyle çıpalayın; pilot yanıtları düzeylerin gerçek örnekleri olarak kullanın.
- Ölçütleri puanlama başlamadan önce şablondan ağırlıklandırın ve açıkça puanlanmayanları adıyla belirtin.
- İki bağımsız değerlendirici her ölçütte bir düzey içinde buluşana kadar test edin, sonra rubriği dondurup sürümleyin.