Hoppa till innehåll
SkillCort

8 min · 7 stepsGuide om genomförande

Så ställer du in en röstbaserad AI-intervju

En röstbaserad AI-intervju låter varje kandidat svara högt på samma inledande fråga, när det passar dem, med adaptiva följdfrågor som borrar i det de faktiskt sa. Den här guiden går igenom hur det turbaserade formatet fungerar i SkillCort, hur du skriver den inledande frågan och kriterierna, och hur transkript blir underlag som en namngiven människa poängsätter. AI:n frågar och föreslår; människor beslutar.

What you'll need

  • En roll där muntlig kommunikation eller verbalt resonemang verkligen spelar roll
  • En välformulerad inledande fråga som du ändå skulle ställa till varje kandidat
  • Bedömningskriterier för vad ett starkt muntligt svar innehåller
  • En namngiven bedömare som bekräftar eller åsidosätter varje AI-poängförslag

Step 1: Förstå det turbaserade formatet innan du bygger

Intervjun är en följd av turer, inte ett fritt flytande samtal. Kandidaten hör en fråga och talar in sitt svar — upp till ungefär tre minuter per tur. Tal-till-text ger ett transkript som lagras som underlag, och utifrån det transkriptet genereras en adaptiv följdfråga som läses upp för kandidaten, med undertexter på skärmen.

Den här strukturen är själva poängen: varje kandidat utgår från samma inledande fråga, följdfrågorna hålls förankrade i det kandidaten faktiskt sa, och allt fångas som granskningsbar text. Det beter sig som en strukturerad intervju som aldrig blir trött, körs vid vilken tid som helst som passar kandidaten och lämnar efter sig en fullständig skriftlig dokumentation.

Step 2: Skriv den inledande frågan

Den inledande frågan sätter taket för hela intervjun, eftersom adaptiva följdfrågor bara kan gräva i det kandidaten erbjuder. Be om en specifik, färsk berättelse i första person: ”Berätta om en gång då du var tvungen att ge en kund dåliga nyheter — vad var situationen och vad gjorde du?” slår ”Hur hanterar du svåra samtal?” varje gång.

Sikta på en fråga som en stark kandidat kan besvara innehållsrikt på två till tre minuters tal. Undvik flerdelade frågor — följdfrågemekanismen tar hand om de delar du annars hade buntat ihop. Har du flera oberoende saker att undersöka är de separata inledande frågor, inte en lång.

  • Be om en konkret situation, inte en filosofi
  • En fråga, ett ämne — följdfrågorna sköter djupet
  • Går att besvara på två till tre minuters naturligt tal
  • Neutral formulering som inte avslöjar det ideala svaret

Step 3: Definiera bedömningskriterierna

Koppla en bedömningsmatris med de kriterier ett starkt muntligt svar bör visa — till exempel struktur, ägarskap för utfallet, konkreta detaljer och tydlighet i kommunikationen. Använd förankrade nivåbeskrivningar så att bedömarna vet hur ”starkt” konkret låter i ett transkript. Som i alla bedömningsmatriser i SkillCort är kriterievikterna uttryckliga, och matrisen fryses till en ögonblicksbild när den kopplas.

Skriv kriterier som går att belägga från ett transkript, eftersom det är transkriptet som poängsätts. ”Förklarar sin egen roll snarare än gruppens” går att kontrollera i text; ”verkar självsäker” gör det inte, och kriterier som lutar sig mot röstintryck i stället för innehåll bjuder in fördomar mot brytningar och talstilar.

Step 4: Ställ in möjligheten att skriva och tillgängligheten

Möjligheten att skriva finns alltid: kandidater kan skriva sina svar i stället för att tala, och ingen mikrofon krävs någonsin för att slutföra intervjun. Det är inte ett sämre läge — skrivna svar går in i samma beslutsunderlag och samma bedömningsmatris — så en kandidat utan tyst rum, utan fungerande mikrofon eller med en talavvikelse sållas inte bort av sin utrustning.

Gör möjligheten synlig i dina instruktioner till kandidaten i stället för att låta den upptäckas. Frågorna läses upp med undertexter, så kandidater som tar till sig text bättre än ljud är täckta även på lyssnarsidan. Poängsätt skrivna och talade transkript mot samma kriterier, och var medveten om att hur flytande framförandet är aldrig var ett av dem.

Step 5: Lägg till intervjun i ett genomförande och bjud in kandidater

Placera röstintervjun i ditt assessment och publicera när checklistan är klar, skapa sedan ett genomförande med ett namn och ett tidsfönster och skicka inbjudningar via e-post. Håll integritetsinställningarna lätta — intervjuformatet behöver samtycke till mikrofon, inte Lockdown, och tung proctoring på en samtalsövning uppfattas som fientlig.

Samtyckes- och preflight-steget talar om för kandidaterna exakt vad som händer: deras tal transkriberas, transkriptet lagras som underlag, följdfrågorna genereras av AI, och det finns en möjlighet att skriva i stället. Preflight-kontrollen av mikrofonen sker före den första frågan, så utrustningsproblem dyker upp som saker att åtgärda i uppsättningen, inte som förlorade försök.

Step 6: Granska transkripten och bekräfta varje poäng

Allteftersom intervjuerna slutförs ligger varje turs transkript i kandidatens beslutsunderlag. AI tar fram utkast till poängförslag på kriterienivå utifrån transkripten, med modell och version loggade. En namngiven mänsklig bedömare läser transkriptet och bekräftar eller åsidosätter sedan varje förslag — den bekräftade poängen är poängen, och bedömarens namn står på den.

Läs transkriptet innan du tittar på förslagen när du kan; det håller ditt eget omdöme i förgrunden. Där du inte håller med om ett förslag åsidosätter du det och noterar varför. De åsidosättandena är användbar signal om var kriterierna behöver skarpare ankare, och de är precis den dokumentation av människan i loopen som gör processen försvarbar.

Step 7: Avgör var röstbaserade AI-intervjuer passar — och var de inte gör det

Formatet lyser i asynkron gallring i stor skala: femtio kandidater får var och en samma strukturerade inledning, adaptivt djup och ett poängsatt transkript, utan femtio tider i kalendern. Det fungerar som ett konsekvent första samtal innan människor lägger tid i realtid, och kombineras naturligt med arbetsprovsuppgifter i samma assessment.

Det är fel verktyg för omdömet i slutrundan, för roller där muntlig interaktion är perifer, eller som ersättning för att någonsin tala med den du anställer. Det gallrar; det väljer inte ut. Decision Board visar dess poäng vid sidan av allt annat underlag, och en människa väger hela bilden — ingen kandidat avvisas av en modell.

Pro tips

  • Spela in dig själv när du svarar på din egen inledande fråga — kan du inte ge ett innehållsrikt svar på tre minuter kan kandidaterna inte heller det.
  • Två eller tre inledande frågor med adaptiva följdfrågor är bättre än sex ytliga; djupet är det formatet ger dig.
  • Läs igenom några hela transkript innan du litar på något mönster i poängförslagen — det kalibrerar dig mot vad AI:n ser och missar.
  • Nämn möjligheten att skriva i inbjudningsmejlet, inte bara vid samtyckessteget; vissa kandidater börjar inte om de tror att en mikrofon är obligatorisk.
  • Poängsätt inte hur flytande framförandet är om inte jobbet verkligen kräver muntlig polering — transkript är till för att bedöma innehåll.

Vanliga frågor

Avgör AI:n vem som klarar intervjun?
Nej. AI:n transkriberar svar, genererar följdfrågor och tar fram utkast till poängförslag på kriterienivå med modell och version loggade. En namngiven mänsklig bedömare bekräftar eller åsidosätter varje poäng, och rekryteringsbeslut fattas av människor utifrån hela beslutsunderlaget.
Vad händer om en kandidat inte har någon mikrofon eller inte kan tala sina svar?
Möjligheten att skriva finns alltid och kräver ingen mikrofon. Skrivna svar blir en del av samma beslutsunderlag och poängsätts mot samma bedömningsmatris. Frågorna presenteras också med undertexter, så ingen del av intervjun är beroende av enbart ljud.
Hur länge kan en kandidat tala per tur?
Upp till ungefär tre minuter per tur. Det räcker för ett innehållsrikt svar på en väl avgränsad fråga samtidigt som transkripten förblir granskningsbara. Om din fråga behöver mer än tre minuter är den oftast två frågor.
Är följdfrågorna desamma för varje kandidat?
Den inledande frågan är identisk för alla; följdfrågorna genereras adaptivt utifrån vad varje kandidat faktiskt sa. Konsekvensen kommer från den gemensamma inledningen, den gemensamma bedömningsmatrisen och poängsättningen som bekräftas av en människa — medan följdfrågorna undersöker varje svar där det behöver undersökas.
Får kandidaten veta att svaren behandlas av AI?
Ja. Innan start anger samtyckessteget att tal transkriberas, att transkript lagras som underlag och att följdfrågor genereras av AI, och det nämner möjligheten att skriva i stället. Transparensen här är en hård regel, inte ett alternativ.

For hiring teams

Hör intervjun själv

Boka en demo och gör en live röstbaserad AI-intervju byggd kring en av dina verkliga urvalsfrågor — och se sedan hur transkriptet poängsätts.

Så ställer du in en röstbaserad AI-intervju | SkillCort