Consigna y contexto
Un equipo está contratando a un ingeniero senior que debe resolver compromisos técnicos (trade-offs), comunicarse a través del conflicto y entregar resultados a través de los límites del equipo. El entrevistador te pide que diseñes una pregunta sobre el comportamiento pasado y expliques cómo formularla, registrar la evidencia, calibrar las calificaciones y manejar los desacuerdos entre entrevistadores.
Esto evalúa el diseño estructurado de entrevistas conductuales, no respuestas STAR memorizadas. Una entrevista estructurada utiliza preguntas predeterminadas y estándares de calificación comunes; una pregunta conductual indaga sobre un evento real del pasado. Una rúbrica debe describir comportamientos observables, no un “buen encaje cultural” ni la sensación de un entrevistador.
Qué evalúa el entrevistador
- Si traduces un requisito laboral en una competencia observable.
- Si una sola pregunta evalúa una competencia principal.
- Si cada candidato recibe la misma consigna, límite de tiempo y preguntas de seguimiento necesarias.
- Si los anclajes conductuales distinguen las calificaciones sin reemplazar la evidencia con los antecedentes o el prestigio profesional.
- Si gestionas la formulación de preguntas, el sesgo del evaluador, la calibración y la falta de evidencia.
Preguntas a clarificar primero
- ¿El objetivo es la colaboración, la influencia o la resolución de conflictos? Usa aquí “impulsar la entrega compartida a través del desacuerdo”.
- ¿Qué contexto de colaboración es real para el rol? Usa dependencias entre equipos, cambios de interfaz o riesgo de lanzamiento.
- ¿Cuánto dura la entrevista y cuántos entrevistadores participan? Asume 45 minutos y dos evaluadores independientes.
- ¿Pueden los candidatos usar notas? Establece la regla por adelantado para que la fluidez de la memoria no se califique como habilidad.
- ¿La puntuación es un filtro de contratación o retroalimentación de desarrollo? La precisión de la evidencia y las reglas de retención difieren.
Marco de respuesta de 30 segundos
“Definiría la competencia como el uso de evidencia para impulsar la entrega compartida cuando los objetivos entran en conflicto, y luego redactaría una pregunta sobre el comportamiento pasado. Cada candidato recibe la misma consigna, límite de tiempo y preguntas de seguimiento necesarias; una rúbrica del uno al cuatro describe los anclajes conductuales. Los entrevistadores registran hechos y vacíos de forma independiente, califican de forma independiente y calibran con base en los anclajes en lugar de reemplazar la rúbrica con una impresión general”.
Respuesta detallada
Convertir la competencia en resultados observables
“Buen colaborador” es demasiado amplio. Hazlo comprobable: cuando dos equipos no están de acuerdo sobre una interfaz, el candidato aclara el objetivo compartido, aporta evidencia, propone una opción reversible y guía a ambos equipos a través de puntos de control. La competencia debe nombrar el detonante, las acciones del candidato y un resultado verificable.
Diseñar una pregunta sobre el comportamiento pasado
Pregunta: “Cuéntame sobre una ocasión en la que tú y otro equipo tuvieron un desacuerdo sobre un enfoque técnico o una prioridad de entrega, pero aún así tenían que entregar a tiempo. ¿De qué eras responsable? ¿Cómo verificaste los hechos clave? ¿Qué hiciste y qué sucedió?”
La pregunta se enfoca en una competencia y solicita un evento real. Evita mezclar un escenario hipotético con la revisión del currículum. Mantén la redacción, el orden y las aclaraciones permitidas consistentes entre todos los candidatos.
Estandarizar preguntas de profundización neutrales y limitadas
Las preguntas de profundización llenan vacíos en los hechos de Situación, Tarea, Acción y Resultado; no deben dirigir al candidato hacia la solución preferida del entrevistador. Usa preguntas comunes como “¿Qué paso realizaste personalmente?”, “¿Qué evidencia cambió o respaldó tu elección?” y “¿Cómo se verificó el resultado?”. Evita preguntas capciosas como “¿No deberías haberte comunicado primero?”. Define la cantidad de preguntas de profundización y el límite de tiempo en la guía del entrevistador.
Construir una escala anclada en el comportamiento
Las calificaciones del uno al cuatro son utilizables cuando cada punto nombra evidencia: 1 tiene solo una afirmación vaga y ninguna acción personal o resultado; 2 describe una acción personal pero una verificación o balance técnico débil; 3 utiliza evidencia para aclarar el desacuerdo, impulsar un plan ejecutable y explicar el resultado; 4 además crea un mecanismo reutilizable que reduce conflictos similares en el futuro. Los anclajes guían el juicio; no lo reemplazan mecánicamente.
Registrar hechos, vacíos y explicaciones alternativas
Registra las palabras del candidato, números, tiempos, acciones personales, acciones de otros y fuentes de resultados. “El equipo estaba feliz” es una opinión no verificada; “las reversiones (rollbacks) se redujeron de tres a una” es un resultado verificable. Si las condiciones del mercado, un gerente u otro equipo afectaron el resultado, marca el límite de atribución en lugar de asignar todo el éxito al candidato.
Calificar de forma independiente y calibrar
Dos entrevistadores primero califican de forma independiente con justificaciones escritas y luego comparan los desacuerdos. La calibración regresa a los anclajes y la evidencia: ¿falta un hecho, se interpreta el mismo hecho de manera diferente o el umbral del puesto es diferente? No mires primero la impresión total de otro evaluador ni la escuela o el empleador del candidato. Si la rúbrica no puede separar las respuestas reales, pide a expertos en el puesto ejemplos conductuales adicionales y actualiza la guía.
Gestionar la equidad, filtraciones y excepciones
Brinda a los candidatos el mismo tiempo, consignas y oportunidades de aclaración. No califiques el acento, la extroversión, la velocidad de memoria o la similitud con el entrevistador como evidencia laboral. Acepta un ejemplo equivalente de un proyecto más pequeño cuando el candidato carezca de la misma escala y califica según los anclajes conductuales. Si la pregunta se filtra, registra el impacto y usa una pregunta de respaldo en lugar de culpar a los candidatos por una falla del proceso.
Respuesta modelo de alta calidad
“Mediría la capacidad de impulsar la entrega compartida a través del desacuerdo, no la comunicación genérica. La consigna solicita una disputa real entre equipos que aún debía entregarse a tiempo, incluyendo responsabilidad, evidencia, acciones y resultado. Cada candidato sigue el mismo orden y dos entrevistadores indagan únicamente sobre acciones personales faltantes, compromisos técnicos asumidos o verificación de resultados.
Usaría anclajes del uno al cuatro: 1 no tiene hechos verificables; 2 tiene una acción personal pero un compromiso o resultado poco claro; 3 usa evidencia para aclarar el desacuerdo, proponer un plan y entregar resultados; 4 además crea una revisión, acuerdo de interfaz o punto de control que previene conflictos similares. Los entrevistadores registran citas y vacíos, califican de forma independiente y discuten solo desacuerdos basados en los anclajes.
Si un candidato carece de un proyecto de la misma escala, aceptaría evidencia conductualmente equivalente y registraría la diferencia de contexto. Si varios equipos influyeron en el resultado, separaría la contribución del candidato de los factores externos. El expediente de contratación conservaría la evidencia, la calificación, el nivel de confianza y los elementos no verificados para que una impresión general no pueda anular el estándar estructurado”.
Errores comunes
- Llamar al “encaje cultural” una competencia: no se puede observar ni revisar → define una situación, acción y resultado concretos.
- Evaluar cinco competencias en una sola pregunta: el motivo de una calificación alta se vuelve difuso → asigna una competencia principal por pregunta.
- Permitir que las preguntas de profundización varíen libremente: los candidatos reciben diferentes oportunidades → especifica preguntas neutrales, orden y límite de tiempo.
- Asignar únicamente etiquetas numéricas: los números no tienen un significado compartido → redacta anclajes conductuales y ejemplos para cada nivel.
- Atribuir los resultados del equipo completamente a una persona: los colaboradores y las condiciones externas desaparecen → registra las acciones personales, las acciones de otros y las fuentes de resultados por separado.
- Leer el currículum antes de calificar: el efecto halo contamina la respuesta → registra y califica de forma independiente antes de la calibración.
- Calificar la fluidez como habilidad: el acento, el estrés o las diferencias de memoria se convierten en penalizaciones → califica la evidencia de comportamiento relevante para el trabajo.
- Aplicar los anclajes mecánicamente: los contextos nuevos no encajan → documenta la evidencia, permite el razonamiento de expertos y recalibra la rúbrica.
Preguntas de seguimiento y respuestas
Pregunta de seguimiento 1: ¿Por qué no usar STAR como rúbrica de calificación?
STAR es una estructura de respuesta, no un nivel de competencia. Ayuda a verificar si la situación, la tarea, la acción y el resultado están presentes, pero los anclajes conductuales relacionados con el puesto siguen siendo necesarios para juzgar la calidad de la acción, la evidencia y la atribución.
Pregunta de seguimiento 2: El candidato describe un resultado de equipo. ¿Cómo evalúas la contribución personal?
Pregunta qué paso decidió o realizó el candidato, quién manejó otras acciones críticas y qué registro verifica el resultado. Si la distinción sigue sin ser clara, marca la contribución personal como evidencia insuficiente en lugar de sustituirla por el prestigio del equipo.
Pregunta de seguimiento 3: Un entrevistador califica con 1 y otro con 4. ¿Qué se hace ahora?
Verifica si ambos citaron la misma declaración y anclaje, luego separa un hecho faltante de una diferencia de interpretación. Si el desacuerdo persiste, conserva el nivel de confianza y la evidencia no resuelta y haz que el revisor designado aplique el umbral del puesto.
Pregunta de seguimiento 4: ¿Qué pasa si el candidato no tiene experiencia en proyectos entre equipos?
Acepta un ejemplo más pequeño pero conductualmente equivalente, como proyectos académicos, código abierto o entregas a clientes, siempre que muestre conflicto, acción personal, evidencia y resultado. Registra la diferencia de contexto; no trates la escala de recursos como el nivel de competencia.
Pregunta de seguimiento 5: ¿Cómo evitas la filtración de preguntas?
Prepara una pregunta de respaldo que mida la misma competencia, restringe el acceso al banco de preguntas y registra el momento de la filtración y los candidatos afectados. Usa la de respaldo y marca el riesgo de comparabilidad en lugar de fingir que una pregunta expuesta sigue siendo comparable.
Pregunta de seguimiento 6: ¿Cómo validas la rúbrica después del lanzamiento?
Verifica la concordancia entre entrevistadores sobre las mismas respuestas, la correlación entre las calificaciones y el rendimiento laboral posterior, las diferencias de grupo en las tasas de aprobación y las apelaciones. Cuando los anclajes sean vagos o generen diferencias irrelevantes, revísalos con expertos en el puesto y muestras de respuestas reales, y luego vuelve a capacitar a los entrevistadores.