La respuesta para reclutamiento
No recomendamos fijar el mismo número para todas las vacantes. Empiece por la evidencia necesaria para decidir y conserve cada instrumento solo si responde una pregunta laboral distinta. Una batería corta puede estar mal diseñada y una más amplia puede completarse bien cuando su propósito, comunicación y operación son claros.
Cuatro hallazgos inéditos
No apareció una penalización lineal
Tres pruebas alcanzaron 83.35% y cuatro 83.09%; una registró 81.73% y dos 81.07%. Cinco fue el grupo menor, con 78.85%, pero seis o más volvió a 81.22%.
Decisión: no imponer un límite universal basándose solo en el promedio global.
La composición cambia la lectura
Entre composiciones de una sola prueba que pasaron controles de diversidad, la finalización osciló aproximadamente entre 60% y 89%. Baterías con igual tamaño pueden producir experiencias distintas.
Decisión: estimar duración y fricción por instrumentos concretos, no únicamente por cantidad.
La mayor recuperación ocurre pronto
Entre 7 y 30 días, la finalización completa aumentó entre 1.7 y 3.9 puntos según tamaño. En seis o más pruebas pasó de 77.36% a 81.22%.
Decisión: concentrar comunicación, soporte y recordatorios en las primeras dos semanas.
Dentro de empresa, 3 frente a 4 casi empata
En organizaciones con al menos diez episodios de ambos tamaños, la diferencia ponderada entre tres y cuatro fue de 0.36 puntos. Entre cuatro y seis o más fue 0.11 puntos.
Decisión: auditar aporte incremental; el contexto operativo pesa más que sumar una prueba.
Finalización completa por tamaño
Fuente: PsicoSmart, run de baterías 1. Episodios asignados del 1-sep-2025 al 31-jul-2026.
| Pruebas | Episodios | 7 días | 30 días |
|---|---|---|---|
| 1 | 173,049 | 80.02% | 81.73% |
| 2 | 120,048 | 79.15% | 81.07% |
| 3 | 134,989 | 81.50% | 83.35% |
| 4 | 94,222 | 80.82% | 83.09% |
| 5 | 55,983 | 76.31% | 78.85% |
| 6 o más | 45,238 | 77.36% | 81.22% |
Composiciones seleccionadas para mostrar el contraste
Esta tabla no reproduce las primeras filas del CSV ni constituye un ranking de eficacia. Presenta siete casos ordenados por finalización para hacer visible el contraste. HonestiValues + Kostick registró 89.28%, 16PF 88.71% y Dominos 60.02%; las diferencias también pueden reflejar empresas, puestos, comunicación y población.
| Composición observada | Pruebas | Episodios | Finalización 30 días |
|---|---|---|---|
| HonestiValues + Kostick | 2 | 1,865 | 89.28% |
| 16PF | 1 | 6,376 | 88.71% |
| HonestiValues | 1 | 69,317 | 86.26% |
| Cleaver | 1 | 18,772 | 83.16% |
| Cleaver + HonestiValues | 2 | 9,880 | 79.47% |
| Terman-Merrill | 1 | 10,114 | 76.92% |
| Dominos | 1 | 3,509 | 60.02% |
Descargar las 30 composiciones publicables en CSV
El CSV completo conserva el orden técnico del dataset. Solo se publican composiciones con al menos 100 episodios, 20 organizaciones, participación máxima de una organización ≤25% y al menos 8 organizaciones efectivas.
Qué cambia al comparar dentro de la misma organización
Cada comparación incluye únicamente organizaciones con al menos diez episodios de ambos tamaños. Esto reduce el efecto de mezclar clientes, aunque no controla puesto, instrumentos, duración ni cambios operativos.
| Comparación | Organizaciones | Diferencia ponderada |
|---|---|---|
| 3 frente a 4 pruebas | 898 | +0.36 pp |
| 4 frente a 5 pruebas | 686 | -0.78 pp |
| 4 frente a 6 o más pruebas | 426 | +0.11 pp |
La cercanía de 3 frente a 4 (+0.36 puntos) y de 4 frente a 6 o más (+0.11) respalda una conclusión prudente: el tamaño aislado aporta poca orientación en esas comparaciones y la composición debe auditarse.
Cómo diseñar una batería defendible
| Paso | Pregunta de reclutamiento | Evidencia | Criterio para retirar |
|---|---|---|---|
| 1. Decisión | ¿Qué decisión debe mejorar? | Riesgos y conductas críticas del puesto. | Si no cambia ninguna decisión documentada. |
| 2. Aporte | ¿Qué pregunta distinta responde cada prueba? | Constructo, calidad técnica y relación con el puesto. | Si duplica evidencia ya disponible. |
| 3. Carga | ¿Cuánto tiempo y esfuerzo exige el conjunto? | Duración real, dispositivo, accesibilidad y soporte. | Si el costo supera el aporte incremental. |
| 4. Secuencia | ¿Qué debe aplicarse primero? | Núcleo breve y pruebas condicionales para finalistas. | Si se aplica a todos sin necesidad. |
| 5. Seguimiento | ¿Dónde se pierde al candidato? | Finalización a 7, 14 y 30 días por composición. | Si mantiene fricción sin evidencia nueva. |
Dataset publicado bajo CC BY 4.0: condiciones y atribución.
Modelo práctico: núcleo + módulos
Use un núcleo mínimo relacionado con todos los finalistas y añada módulos solo por exposición del puesto: ventas, manejo de activos, liderazgo, razonamiento o seguridad. Esto convierte la batería en un diseño argumentado, no en una lista acumulada por costumbre. Para elegir qué evidencia aporta cada instrumento, consulte también el marco para seleccionar pruebas psicométricas por necesidad del puesto.
Metodología, responsabilidad y limitaciones
Responsable: equipo de investigación de PsicoSmart. El procesamiento fue automatizado mediante un materializador versionado; la interpretación, los límites y la decisión de publicación fueron revisados editorialmente. Esta página reproduce el snapshot aprobado battery run 1 y no recalcula datos durante la visita.
- Unidad: shard + organización + candidato + marca exacta de asignación. El código de PsicoSmart inserta conjuntamente las pruebas del lote.
- Periodo: asignaciones del 1 de septiembre de 2025 al 31 de julio de 2026; todos los episodios tuvieron al menos 30 días de observación.
- Universo: 623,529 episodios y 1,796,497 pruebas; se excluyeron códigos técnicos `e_%` y registros legados sin fecha de asignación reconstruible.
- Finalización: todas las pruebas con `porcentaje=100` dentro de 30 días. Se documentó tolerancia de 12 horas por un formato histórico de reloj; afectó una fracción pequeña.
- Privacidad: no se publican candidatos, respuestas ni organizaciones. Cada tamaño superó 1,888 organizaciones observadas y ninguna concentró más de 5.68%.
- Comparaciones: el análisis dentro de organización exige al menos diez episodios de cada tamaño comparado. Reduce mezcla entre clientes, pero no controla puesto, dificultad, motivación ni duración de cada instrumento.
- Límite causal: no hubo asignación aleatoria. Las tasas no prueban que el tamaño cause finalización ni clasifican la calidad de una prueba.
Diseñe la batería desde el puesto, no desde una cifra
PsicoSmart permite combinar instrumentos y revisar resultados dentro de un proceso estructurado.
Conocer PsicoSmart