Saltar al contenido
SkillCort

12 de junio de 2026 · Actualizado el Jul 7, 2026 · 7 min de lecturaDiseño de pruebas de trabajo

Diseñar tareas de prueba de trabajo que predigan el desempeño en el puesto

El mejor indicio de cómo hará alguien el trabajo es verle hacer una porción de él. Pero una prueba de trabajo solo se gana esa capacidad predictiva si está bien diseñada: lo bastante realista para importar, lo bastante estandarizada para comparar, lo bastante breve para respetar al candidato y lo bastante estructurada para puntuarla. Este es un método repetible — uno que se construye una vez, no una vez por vacante.

Una mujer en un escritorio despejado resolviendo una tarea en su portátil, vista de perfil

By Daniel Whitmore, MSc in Industrial and Organizational Psychology

En resumen

Una tarea de prueba de trabajo es una porción breve y estandarizada del trabajo real de un puesto — un ticket entrante, un ejercicio de priorización, un caso escrito — que todos los candidatos completan en las mismas condiciones. Predice el desempeño en el puesto porque mide el trabajo mismo y no un sustituto suyo. El oficio está en elegir un trabajo que sea frecuente, consecuente y observable, y después estandarizar los materiales de partida para que el resultado de cada candidato sea comparable y puntuable.

Muestree el trabajo, no lo aproxime

La investigación sobre selección lleva décadas apuntando en la misma dirección: las evaluaciones que se parecen al trabajo predicen el trabajo mejor que las evaluaciones que se parecen a un cuestionario. Una prueba de conocimiento de producto le dice qué ha memorizado un candidato de soporte; un ticket simulado de un cliente frustrado le dice cómo lee, qué prioriza y cómo escribe bajo una presión moderada. Lo primero son datos sueltos que una nueva incorporación aprende la primera semana. Lo segundo es el trabajo.

La pregunta de diseño, por tanto, no es «qué preguntas deberíamos hacer», sino «qué porción del trabajo deberíamos entregar». Ese replanteamiento lo cambia todo aguas abajo — cuánto dura la tarea, qué materiales necesitan los candidatos, qué aspecto tiene el resultado y cómo lo puntúan los evaluadores. Acierte con la porción y el resto del diseño casi se deduce solo; equivóquese y ninguna puntuación ingeniosa lo rescata.

Elegir la porción: frecuente, consecuente, observable

Parta de la carga de trabajo real del puesto, no de lo que resulta fácil de evaluar. Enumere aquello en lo que la persona pasará horas de verdad y elija después la porción donde las diferencias de habilidad sean más visibles y más costosas. En soporte al cliente, eso rara vez es «conocer la política de reembolsos» — es desescalar por escrito a un cliente enfadado sin dejar de ser preciso. En venta interna, rara vez es «saber definir BANT» — es manejar una objeción de precio o escribir el correo de seguimiento que reanima una operación estancada.

Una buena porción supera tres pruebas a la vez. Es frecuente, de modo que está muestreando el trabajo cotidiano y no un caso límite raro. Es consecuente, de modo que un desempeño flojo haría daño de verdad — un escalado mal llevado, una renovación perdida. Y es observable en un producto de trabajo: algo que el candidato produce y que un evaluador puede leer y puntuar, no un proceso mental privado que hay que adivinar.

  • Frecuente: la persona hará esto cada semana, no una vez al año.
  • Consecuente: hacerlo mal tiene un coste visible para los clientes o para los ingresos.
  • Observable: termina en un producto — una respuesta, un correo, una cola triada, un plan de llamada.
  • Aprendible frente a seleccionable: descarte todo lo que una nueva incorporación adquiere en la acogida; evalúe lo que debe traer consigo.

Realismo frente a estandarización: empresa ficticia, trabajo real

El realismo y la estandarización tiran en direcciones opuestas, y el oficio está en sostener ambos. El realismo total — su producto real, tickets en vivo — hace la tarea irrepetible y filtra contexto confidencial. La estandarización total — acertijos abstractos — tira por la borda la relevancia para el puesto que hacía que la prueba de trabajo mereciera construirse. La solución es un entorno ficticio pero plausible: una empresa inventada con un producto sencillo, una hoja breve de políticas y escenarios que riman con los suyos reales.

La envoltura ficticia es una virtud, no una concesión. Pone a todos los candidatos en igualdad de condiciones sea cual sea su sector de procedencia: el veterano de la competencia y quien cambia de carrera leen el mismo informe de dos páginas, así que usted está midiendo criterio y comunicación, no conocimiento interno acumulado. También hace la tarea reutilizable entre vacantes y clientes sin que nadie ensaye respuestas de una ronda anterior.

Mantenga los materiales de partida deliberadamente breves. Si los candidatos necesitan quince páginas de contexto antes de poder intentar la tarea, está evaluando resistencia lectora y tiempo libre, no la habilidad objetivo. Un mensaje creíble de cliente, un extracto de política, un resumen corto de producto — contexto suficiente para que el escenario resulte real, y lo bastante escaso como para que el trabajo de verdad empiece en los primeros minutos.

Acotar el tiempo: proporcional al puesto, honesto con el reloj

Una prueba de trabajo debería llevar una fracción significativa de una hora, no un fin de semana. Para puestos de soporte y de venta interna, de veinte a cuarenta y cinco minutos de concentración suele bastar para ver criterio, tono y claridad a lo largo de dos o tres ejercicios encadenados. Las tareas más largas no aportan señal en proporción; filtran por quién tiene las tardes libres, lo que sesga calladamente su grupo de candidatos en contra de quienes ya trabajan y de quienes cuidan de alguien.

Sea honesto sobre qué mide el reloj. Si el trabajo real consiste en redactar respuestas meditadas con material de referencia a mano, una cuenta atrás implacable añade ruido, no realismo. Si el puesto premia genuinamente la rapidez — una cola de chat en vivo —, entonces una presión temporal moderada forma parte de lo que se mide. Fije el límite a partir del trabajo, diga a los candidatos exactamente qué esperar y dé a todos las mismas condiciones. Las trampas de tiempo que sorprenden a los candidatos producen datos de ansiedad, no datos de habilidad.

Evitar la sospecha de trabajo gratuito

Los candidatos desconfían con razón de las «evaluaciones» que parecen consultoría no remunerada: audite nuestro embudo real, redacte una campaña que podríamos lanzar. Más allá de la ética, las tareas de trabajo gratuito son malas mediciones — cada candidato ataca un problema real distinto, así que nada es comparable. El diseño de empresa ficticia resuelve ambos problemas a la vez: la entrega de nadie puede usarse comercialmente y todo el mundo responde al mismo encargo.

Deje clara su intención de forma explícita. Diga a los candidatos que el escenario es inventado, que el trabajo se usará solo para evaluar y, a grandes rasgos, cómo se puntuará. Mantenga el alcance visiblemente acotado — una respuesta y una justificación breve, no un dosier de estrategia. Una tarea que respeta a los candidatos no solo es más amable; protege sus tasas de finalización y su marca como empleador, y mantiene en el proceso a los candidatos más fuertes, que son los que más opciones tienen.

  • Sitúe cada tarea en una empresa ficticia para que ninguna entrega tenga valor comercial.
  • Diga con claridad que las respuestas se usan solo para evaluar, nunca para lanzarse.
  • Acote el entregable: una respuesta, un correo, una triada — no un proyecto abierto.
  • Nunca pida a los candidatos que trabajen sobre sus clientes, operaciones o contenidos reales.

Hacer que el resultado sea puntuable

Una prueba de trabajo triunfa o fracasa en el momento de puntuar. Diseñe la tarea y su rúbrica a la vez: para cada competencia que la porción debe revelar, escriba en términos concretos y observables qué aspecto tiene un desempeño fuerte, aceptable y débil antes de que responda ningún candidato. «Reconoció la frustración del cliente antes de proponer una solución» es puntuable; «buena comunicación» es un estado de ánimo.

Prefiera la puntuación proporcional al apto/no apto en los ítems de criterio. La mayoría de los escenarios realistas tienen una respuesta óptima, una defendible y una mala — una rúbrica que solo distingue correcto e incorrecto borra la diferencia que de verdad le importa a su responsable de contratación. Y restrinja el formato del resultado lo justo para poder comparar: una respuesta de unas pocas frases más una justificación de una línea es fácil de poner al lado de otra; un texto libre no lo es.

La IA se gana aquí su sitio como apoyo a la decisión: resumiendo respuestas largas, relacionando una respuesta con las competencias de la rúbrica, redactando las primeras notas para que el evaluador las confirme. Lo que nunca hace es puntuar y rechazar por su cuenta. El evaluador asume cada nivel asignado — eso es lo que mantiene el resultado explicable ante su panel y ante el candidato.

Construir una vez, reutilizar entre vacantes

El último objetivo de diseño es la reutilización. Si cada vacante nueva obliga a inventar una tarea desde cero, la calidad se erosiona bajo la presión de los plazos y los estándares se desvían entre responsables de contratación. En su lugar, ancle las tareas a un perfil de puesto — las competencias nombradas que necesita una familia de puestos — y parametrice los detalles superficiales. El escenario de desescalado para soporte y el correo de manejo de objeciones para venta interna se mantienen estructuralmente idénticos; el producto ficticio, el cliente y los detalles de la política van rotando.

La reutilización es también lo que hace comparable la evidencia a lo largo del tiempo. Cuando los candidatos de soporte de este trimestre afrontan la misma tarea estructural que los del anterior, las puntuaciones significan lo mismo, la calibración se traslada y sus expedientes de decisión pueden compararse entre cohortes. Una prueba de trabajo bien diseñada no es un truco de criba de usar y tirar; es un instrumento que su equipo mantiene, versiona y en el que confía.

Ideas clave

  • Elija la porción de trabajo que sea frecuente, consecuente y termine en un producto puntuable — y descarte todo lo que la incorporación vaya a enseñar de todos modos.
  • Resuelva la tensión entre realismo y estandarización con una empresa ficticia pero plausible: trabajo real, mismas condiciones para todos, cero riesgo de confidencialidad o de trabajo gratuito.
  • Acote el tiempo de forma proporcional — unos 20–45 minutos de concentración para puestos de soporte y de venta interna — y deje que sea el trabajo, y no el dramatismo, quien ponga el reloj.
  • Escriba la rúbrica junto con la tarea, con descriptores de nivel concretos y puntuación proporcional; la IA resume y relaciona, las personas asignan todas las puntuaciones.
  • Ancle las tareas a un perfil de puesto para construir una vez y reutilizar entre vacantes, manteniendo las puntuaciones comparables entre cohortes.

Preguntas frecuentes

¿Cuánto debería durar una tarea de prueba de trabajo?
Para la mayoría de los puestos de soporte y de venta interna, de veinte a cuarenta y cinco minutos de concentración repartidos en dos o tres ejercicios encadenados basta para ver criterio, tono y claridad. Las tareas más largas filtran sobre todo por tiempo libre y no por habilidad, y alejan a quienes ya trabajan y a quienes cuidan de alguien — a menudo sus mejores aspirantes.
¿Cómo hacemos realista una prueba de trabajo sin revelar información confidencial?
Sitúela en una empresa ficticia pero plausible: un producto inventado, una hoja breve de políticas y escenarios que reflejen la estructura de su trabajo real. Los candidatos hacen el mismo tipo de trabajo que harían en el puesto, pero sobre materiales idénticos y compartibles que no filtran nada y no favorecen el sector de procedencia de nadie.
¿Cómo evitamos que los candidatos sientan que la tarea es trabajo gratuito?
Use escenarios ficticios para que ninguna entrega tenga valor comercial, diga explícitamente que las respuestas se usan solo para evaluar y mantenga el entregable bien acotado — una respuesta y una justificación breve, no un proyecto. Nunca pida a los candidatos que trabajen sobre sus clientes, operaciones o contenidos reales.
¿Puede la IA puntuar la prueba de trabajo por nosotros?
La IA puede apoyar la puntuación — resumiendo respuestas, relacionando respuestas con las competencias de la rúbrica y redactando las primeras notas —, pero un evaluador humano asigna cada puntuación y toma cada decisión. Eso mantiene la evaluación explicable ante los candidatos y defendible ante su propio panel.
¿Necesitamos una tarea nueva para cada vacante abierta?
No. Ancle las tareas a un perfil de puesto con competencias nombradas y después rote los detalles superficiales — el producto ficticio, el cliente y la política. La estructura permanece constante, así que la calibración se traslada y las puntuaciones siguen siendo comparables entre vacantes y cohortes.

Para equipos de selección

Convierta uno de sus puestos en una prueba de trabajo

Traiga una vacante de soporte o de ventas a una demostración de 30 minutos y la relacionaremos con un perfil de puesto, le mostraremos una tarea de prueba de trabajo real y recorreremos la rúbrica y el expediente de decisión que produce.