By Daniel Whitmore, MSc in Industrial and Organizational Psychology
Em resumo
Uma tarefa de prova de trabalho é uma fatia curta e padronizada do trabalho real de uma função — um ticket recebido, um exercício de priorização, um caso escrito — que todos os candidatos completam nas mesmas condições. Prevê o desempenho na função porque mede o próprio trabalho em vez de um substituto dele. A arte está em escolher trabalho que seja frequente, consequente e observável, e depois padronizar os materiais de partida para que o resultado de cada candidato seja comparável e pontuável.
Amostre o trabalho, não o aproxime
A investigação em seleção aponta na mesma direção há décadas: as avaliações que se parecem com o trabalho preveem o trabalho melhor do que as avaliações que se parecem com um questionário. Um teste de conhecimento do produto diz-lhe o que um candidato a apoio ao cliente memorizou; um ticket simulado de um cliente frustrado diz-lhe como ele lê, o que prioriza e como escreve sob pressão moderada. O primeiro é trivialidade que um novo colaborador aprende na primeira semana. O segundo é o trabalho.
A questão de conceção não é, portanto, «que perguntas devemos fazer», mas «que fatia do trabalho devemos entregar». Esse reenquadramento muda tudo a jusante — quanto tempo dura a tarefa, de que materiais os candidatos precisam, qual é o aspeto do resultado e como os avaliadores o pontuam. Acerte na fatia e o resto da conceção segue-se quase sozinho; erre na fatia e nenhuma engenhosidade de pontuação a salva.
Escolher a fatia: frequente, consequente, observável
Parta da carga de trabalho real da função, não daquilo que é fácil de testar. Liste aquilo em que a pessoa vai realmente passar horas e escolha depois a fatia onde as diferenças de capacidade são mais visíveis e mais caras. No apoio ao cliente, isso raramente é «sabe a política de reembolsos» — é desescalar por escrito um cliente irritado sem deixar de ser rigoroso. Nas vendas internas, raramente é «sabe definir o BANT» — é lidar com uma objeção de preço ou escrever o e-mail de seguimento que ressuscita um negócio parado.
Uma boa fatia passa três testes ao mesmo tempo. É frequente, para que esteja a amostrar o trabalho do dia a dia e não um caso-limite raro. É consequente, para que um desempenho fraco doesse a sério — uma escalada mal gerida, uma renovação perdida. E é observável num produto de trabalho: algo que o candidato produz e que um avaliador consegue ler e pontuar, e não um processo mental privado que tem de adivinhar.
- Frequente: a pessoa vai fazer isto semanalmente, não uma vez por ano.
- Consequente: fazê-lo mal tem um custo visível para os clientes ou para a receita.
- Observável: termina num artefacto — uma resposta, um e-mail, uma fila triada, um plano de chamada.
- Aprendível vs. selecionável: deixe de fora tudo o que um novo colaborador apanha no acolhimento; teste aquilo que tem de trazer consigo.
Realismo vs. padronização: empresa fictícia, trabalho real
O realismo e a padronização puxam em sentidos opostos, e a arte está em segurar os dois. O realismo total — o seu produto real, tickets em direto — torna a tarefa irrepetível e deixa escapar contexto confidencial. A padronização total — enigmas abstratos — deita fora a relevância para a função que tornava a prova de trabalho digna de ser construída. A resolução é um cenário fictício mas plausível: uma empresa inventada com um produto simples, uma folha de política curta e cenários que rimam com os seus.
O invólucro fictício é uma qualidade, não um compromisso. Coloca todos os candidatos em pé de igualdade, independentemente do setor de onde vêm: o veterano vindo de um concorrente e quem está a mudar de carreira leem ambos o mesmo enunciado de duas páginas, por isso está a medir juízo e comunicação, e não conhecimento de bastidores acumulado. Também torna a tarefa reutilizável entre vagas e clientes sem que ninguém ensaie respostas de uma ronda anterior.
Mantenha os materiais de partida deliberadamente curtos. Se os candidatos precisam de quinze páginas de contexto antes de conseguirem sequer tentar a tarefa, está a testar resistência de leitura e tempo livre, e não a capacidade-alvo. Uma mensagem de cliente credível, um excerto de política, um resumo curto do produto — contexto suficiente para o cenário parecer real, e pouco o bastante para que o trabalho propriamente dito comece nos primeiros minutos.
Delimitar o tempo: proporcional à função, honesto quanto ao relógio
Uma prova de trabalho deve levar uma fração significativa de uma hora, não um fim de semana. Para funções de apoio ao cliente e de vendas internas, vinte a quarenta e cinco minutos concentrados chegam normalmente para ver juízo, tom e clareza ao longo de dois ou três exercícios ligados entre si. As tarefas mais longas não acrescentam sinal proporcional; filtram por quem tem noites livres, o que enviesa discretamente o seu conjunto contra candidatos empregados e cuidadores.
Seja honesto quanto ao que o relógio mede. Se o trabalho real envolve compor respostas ponderadas com material de referência à mão, uma contagem decrescente punitiva acrescenta ruído, não realismo. Se o trabalho recompensa genuinamente a rapidez — uma fila de chat em direto —, então uma pressão de tempo moderada faz parte do constructo. Defina o limite a partir do trabalho, diga aos candidatos exatamente o que esperar e dê a todos as mesmas condições. As armadilhas de tempo que apanham os candidatos de surpresa produzem dados de ansiedade, não dados de capacidade.
Evitar as preocupações com trabalho não pago
Os candidatos desconfiam, e bem, de «avaliações» que se parecem com consultoria não paga: audite o nosso funil real, esboce uma campanha que possamos lançar. Para lá da ética, as tarefas de trabalho não pago são más medições — cada candidato ataca um problema real diferente, por isso nada é comparável. A conceção com empresa fictícia resolve os dois problemas ao mesmo tempo: nenhuma submissão pode ser usada comercialmente e toda a gente responde ao mesmo enunciado.
Sinalize a sua intenção explicitamente. Diga aos candidatos que o cenário é inventado, que o trabalho será usado apenas para avaliação e, em traços gerais, como vai ser pontuado. Mantenha o âmbito visivelmente delimitado — uma resposta e uma fundamentação curta, não uma apresentação de estratégia. Uma tarefa que respeita os candidatos não é só mais gentil; protege as taxas de conclusão e a sua marca empregadora, e mantém no seu processo os candidatos mais fortes, que são os que têm mais opções.
- Situe todas as tarefas numa empresa fictícia, para que nenhuma submissão tenha valor comercial.
- Declare com clareza que as respostas são usadas apenas para avaliar, nunca para lançar.
- Delimite o que é entregue: uma resposta, um e-mail, uma triagem — não um projeto em aberto.
- Nunca peça aos candidatos que trabalhem nos seus clientes, negócios ou conteúdos reais.
Tornar o resultado pontuável
Uma prova de trabalho ganha-se ou perde-se no momento da pontuação. Conceba a tarefa e a sua grelha em conjunto: para cada competência que a fatia deve revelar, escreva qual é o aspeto de um desempenho forte, aceitável e fraco em termos concretos e observáveis, antes de qualquer candidato responder. «Reconheceu a frustração do cliente antes de propor uma solução» é pontuável; «boa comunicação» é um estado de espírito.
Prefira a pontuação proporcional ao aprovado/reprovado nos itens de juízo. A maioria dos cenários realistas tem uma melhor resposta, uma resposta defensável e uma resposta fraca — uma grelha que só conhece certo e errado apaga a distinção que interessa de facto ao seu responsável pela contratação. E restrinja o formato do resultado apenas o suficiente para comparar: uma resposta de algumas frases mais uma fundamentação numa linha é fácil de colocar lado a lado; um texto livre não é.
A IA justifica aqui o seu lugar como apoio à decisão: resume respostas mais longas, mapeia uma resposta para as competências da grelha, redige as primeiras notas para o avaliador confirmar. O que nunca faz é pontuar e rejeitar por sua conta. O avaliador assume cada nível atribuído — é isso que mantém o resultado explicável ao seu painel e ao candidato.
Construir uma vez, reutilizar em várias vagas
O último objetivo de conceção é a reutilização. Se cada vaga nova significar inventar uma tarefa de raiz, a qualidade erode sob a pressão dos prazos e os padrões derivam de responsável para responsável. Em vez disso, ancore as tarefas num perfil de função — as competências nomeadas de que uma família de funções precisa — e parametrize os detalhes de superfície. O cenário de desescalada para o apoio ao cliente e o e-mail de resposta a objeções para as vendas internas mantêm-se estruturalmente idênticos; o produto fictício, o cliente e os detalhes de política é que rodam.
A reutilização é também o que torna as evidências comparáveis ao longo do tempo. Quando os candidatos a apoio ao cliente deste trimestre enfrentam a mesma tarefa estrutural que os do trimestre passado, as pontuações significam a mesma coisa, a calibração transfere-se e os seus processos de decisão podem ser comparados entre coortes. Uma prova de trabalho bem concebida não é um truque de triagem pontual; é um instrumento que a sua equipa mantém, versiona e em que confia.
Pontos essenciais
- Escolha a fatia de trabalho que é frequente, consequente e que termina num artefacto pontuável — e deixe de fora tudo o que o acolhimento vai ensinar de qualquer forma.
- Resolva a tensão entre realismo e padronização com uma empresa fictícia mas plausível: trabalho real, igualdade de condições, risco zero de confidencialidade ou de trabalho não pago.
- Delimite o tempo de forma proporcional — cerca de 20–45 minutos concentrados para funções de apoio ao cliente e de vendas internas — e deixe que seja o trabalho, e não o drama, a acertar o relógio.
- Escreva a grelha ao mesmo tempo que a tarefa, com descritores de nível concretos e pontuação proporcional; a IA resume e mapeia, as pessoas atribuem todas as pontuações.
- Ancore as tarefas num perfil de função para construir uma vez e reutilizar em várias vagas, mantendo as pontuações comparáveis entre coortes.
