# Matriz de competencias y rúbricas de evaluación — Criterio Talent

> Cómo escribir una matriz de competencias y rúbricas de niveles en conducta observable, con una rúbrica de ejemplo y la prueba de calibración de dos lectores.

URL: https://criteriotalent.com/recursos/matriz-de-competencias-y-rubricas/

---

**Entrega 01 · septiembre de 2025**

# Matriz de competencias y rúbricas: cómo escribir niveles que dos personas interpreten igual

Casi todas las matrices de competencias son una lista de sustantivos con una escala del uno al cinco. Eso no es un instrumento: es un formato. El instrumento son los descriptores.

Método · Instrumentos de evaluación

Publicado el 29 de agosto de 2026 · 6 min de lectura

**En corto**

Se escribe al revés de como suele hacerse: primero los descriptores de cada nivel en términos de conducta observable, y sólo después el número que los ordena. Un nivel está bien escrito cuando dos personas del equipo leen la misma respuesta por separado y asignan lo mismo; mientras no coincidan, el problema está en la rúbrica y no en quien la aplica.

Pida la matriz de competencias de cualquier área de Recursos Humanos y va a recibir, casi siempre, la misma cosa: una columna de sustantivos —comunicación, liderazgo, orientación a resultados— y al lado una escala del uno al cinco. Nada más. Eso no es un instrumento de evaluación; es un formato para anotar lo que cada quien ya había decidido por su cuenta.

El instrumento son los descriptores: la frase que dice qué tuvo que hacer una persona para que su respuesta valga un tres y no un dos. Escribirlos cuesta unas horas y es el trabajo que decide si toda la evaluación posterior significa algo. Esta entrega trata sobre cómo escribirlos.

## Un número sin descriptor no informa a nadie

«Comunicación: 3 de 5» le dice a tres lectores tres cosas distintas. Para quien entrevistó puede significar que la persona explicó bien un proceso complicado; para quien lee el reporte, que habla correcto pero sin brillo; para el área que contrata, que no sabe si eso alcanza para presentarse ante un comité.

El número es una compresión de un juicio. Sin el descriptor, la compresión no se puede deshacer: nadie puede reconstruir qué se midió. Y como no se puede reconstruir, tampoco se puede discutir, corregir ni defender. La consecuencia práctica aparece meses después, cuando alguien pregunta por qué avanzó una persona y lo único disponible es una tabla de números que ya nadie sabe leer.

La prueba rápida de si una matriz sirve: tápele los números a un reporte y déjele sólo los descriptores. Si el lector todavía entiende qué se concluyó, la matriz funciona. Si sin los números no queda nada, los números eran todo lo que había.

## Los niveles describen conducta, no personas

«Es proactivo» no es un nivel: es una etiqueta. Nadie puede señalar en una transcripción la frase donde la persona fue proactiva, porque la proactividad no se dice, se infiere. Y todo lo que se infiere sin poder citarlo es exactamente lo que después no se puede sostener.

«Se adelantó al vencimiento del contrato y llevó dos cotizaciones antes de que se lo pidieran» sí es un nivel. Describe algo que ocurrió, que la persona puede contar y que queda en el texto de lo que dijo. La regla para escribir descriptores es esa: si el nivel no se puede citar, no es un nivel.

Hay además una razón que no es de método sino de riesgo. Los atributos —«tiene presencia», «da confianza», «encaja»— son puertas por las que entra el prejuicio sin que nadie lo note, porque no obligan a nombrar ninguna conducta concreta. Se habla de eso con más calma en [la entrega sobre sesgo](https://criteriotalent.com/recursos/sesgo-en-entrevistas-con-ia/), pero conviene saberlo desde el momento de escribir la rúbrica: un descriptor vago no es sólo impreciso, es permisivo.

## Una rúbrica completa, de ejemplo

Lo que sigue es una rúbrica ficticia, escrita para este artículo, sobre gestión de proveedores en una operación industrial. Cuatro niveles, y en cada uno lo que tiene que aparecer en la respuesta para asignarlo. Nótese que ningún nivel menciona rasgos de la persona.

Rúbrica ficticia, escrita como ejemplo. Ninguna empresa la usa tal cual: los niveles se escriben con las palabras y los umbrales de cada operación.

| Nivel | Qué hizo la persona | Qué tiene que aparecer en la respuesta | 1 de 4 | Describe el problema del proveedor, pero no una acción propia. | Narra la situación en tercera persona o en plural. No aparece un verbo en primera persona con una decisión detrás. | 2 de 4 | Actúa, pero cuando el problema ya escaló solo. | Aparece una acción propia y una fecha o una secuencia que la coloca después de que alguien más lo señaló. | 3 de 4 | Actúa por iniciativa propia, involucra a las áreas afectadas y cuantifica el impacto. | Acción propia, con quién la coordinó, y una magnitud: días de paro, piezas, costo o incumplimiento concreto. | 4 de 4 | Todo lo anterior y deja un mecanismo para que no vuelva a ocurrir. | Además de lo del nivel 3, algo que quedó instalado: una cláusula, un indicador, una segunda fuente, una revisión periódica.

Con esa rúbrica en la mano, una respuesta de ejemplo como ésta se ubica sola:

Es un tres: hay acción propia, hay coordinación y hay magnitud. No es un cuatro porque no aparece nada que quedara instalado después. Y lo importante no es que el lector coincida conmigo, sino que dos lectores cualesquiera puedan discutirlo señalando la misma frase.

## La prueba de calibración: dos lectores, la misma respuesta

Una rúbrica no está terminada cuando se escribe. Está terminada cuando se calibra, y el procedimiento cabe en una tarde: se juntan cinco respuestas —de procesos anteriores, o escritas a mano para la prueba—, dos personas del equipo las leen por separado y asignan nivel sin hablar entre ellas. Después se comparan.

Lo interesante no son las coincidencias, sino los desacuerdos: cada uno señala exactamente qué frontera entre dos niveles está mal escrita. Si una respuesta recibe un dos y un tres, la línea entre el dos y el tres no dice lo suficiente. Se corrige el descriptor, no al lector.

Esta prueba conviene hacerla antes de la primera vacante, y volver a hacerla cuando la rúbrica cambie. Es también el argumento más sólido frente a un sistema automático: si dos personas del equipo no logran coincidir usando la rúbrica, ningún modelo va a producir con ella un resultado que se pueda defender. Sobre lo que hace el sistema con esa rúbrica ya escrita, [la página de la plataforma](https://criteriotalent.com/plataforma/) describe el recorrido completo.

## Los cuatro modos de falla que más se repiten

- Niveles que se solapan. Dos descriptores que se pueden aplicar a la misma respuesta. Se detecta en la calibración y se arregla moviendo una condición de un nivel al otro, no añadiendo adjetivos.
- Atributos disfrazados de conducta. «Comunica con claridad» parece conducta y no lo es: no dice qué hizo la persona. «Explicó el problema a un área que no conocía el proceso y comprobó que lo hubieran entendido» sí lo dice.
- Escalas de cinco niveles donde sólo se usan tres. Si en la práctica nadie asigna nunca el uno ni el cinco, la escala real es de tres y conviene escribirla así. Una escala con extremos decorativos comprime todo al centro.
- Demasiadas competencias. Una matriz de doce competencias no es un instrumento, es una lista de deseos. Nadie puede explorar doce cosas en una conversación, y lo que se obtiene son doce valoraciones sin sustento en vez de cuatro sólidas.

## Cuántas competencias caben, de verdad

Entre tres y cinco por ronda corta. No es una cifra de manual: es lo que cabe cuando cada competencia necesita un reactivo conductual, su repregunta y el tiempo para que la persona cuente algo con principio y final. Si el puesto pide más, se reparten entre las rondas del proceso; la aritmética está en [la entrega sobre qué cabe en una ronda](https://criteriotalent.com/recursos/que-cabe-en-una-ronda-de-entrevista/).

La forma de elegirlas también importa. Sirven las competencias que separan candidatos; no sirven las que todos cumplen ni las que nadie cumple. Si toda la gente que llega a la primera ronda comunica igual de bien, «comunicación» no está midiendo, está decorando el reporte.

## Lo que una rúbrica no resuelve

No define el puesto. Si el área que contrata y Recursos Humanos no coinciden en qué se busca, la rúbrica va a formalizar el desacuerdo con mucha precisión: todos los candidatos quedarán evaluados con la misma confusión, y encima documentada.

Tampoco elimina el juicio. Alguien tiene que decidir qué nivel es suficiente para esta vacante y este mercado, y esa decisión es humana, discutible y depende del contexto. Lo que la rúbrica hace es mover la discusión a un terreno donde se puede tener: sobre lo que la persona dijo que hizo, y no sobre la impresión que dejó.

## Preguntas sobre esta entrega

### ¿Sirve reutilizar una matriz de competencias comprada o de un marco genérico?

Como punto de partida, sí; como instrumento, casi nunca. Los marcos genéricos traen los sustantivos, que es la parte fácil, y descriptores escritos para cualquier empresa, que es la parte que hay que reescribir con los umbrales y el vocabulario de la operación propia.

### ¿Cada cuánto conviene revisar una rúbrica?

Cuando la calibración empieza a fallar, cuando el puesto cambia, o cuando un nivel deja de asignarse nunca. Y cada vez que se toque hay que versionarla, o las comparaciones anteriores dejan de ser comparaciones.

**Para seguir leyendo en el sitio**

### [Soluciones](https://criteriotalent.com/soluciones/)

Cómo se configura para alto volumen, perfiles técnicos, dirección y procesos de varias rondas.

### [Plataforma](https://criteriotalent.com/plataforma/)

Cómo conduce la entrevista, repregunta y cita la evidencia de cada conclusión.

### [Integraciones](https://criteriotalent.com/integraciones/)

Cómo su ATS pide la entrevista y recibe el reporte, sin que nadie vuelva a teclear nada.

### [Contacto](https://criteriotalent.com/contacto/)

Una demostración de 30 minutos sobre una vacante real suya.

**Otras entregas**

**Método · Diseño de entrevistas**

### [Cómo diseñar una entrevista estructurada con IA que deje evidencia útil y conserve la decisión humana](https://criteriotalent.com/recursos/entrevista-estructurada-con-ia/)

Ocho decisiones de diseño, en orden. La primera es la que casi todo el mundo se salta: no se le pide a un modelo que juzgue, se le pide que documente.

**Método · Comparación y decisión**

### [Cómo comparar candidatos de una misma vacante sin comparar impresiones](https://criteriotalent.com/recursos/comparar-candidatos-sin-comparar-impresiones/)

Cuatro condiciones que tienen que cumplirse antes de poner dos entrevistas una al lado de la otra, y qué hacer con la tabla cuando por fin se puede.

**Método · Reactivos y nivel del puesto**

### [Preguntas que sí separan candidatos: cómo escribirlas para cualquier nivel de puesto](https://criteriotalent.com/recursos/preguntas-que-si-separan-candidatos/)

La mayoría de las preguntas de un guion no separan a nadie: se contestan igual de bien esté quien esté del otro lado. Las que sí separan se escriben igual para un puesto de piso que para una dirección; lo que cambia es el listón.

**Siguiente paso**

## Véalo con una vacante suya sobre la mesa.

Treinta minutos: se define una entrevista a partir de su job post, se recorre como la ve el candidato y se lee un reporte con su evidencia.
