Si usted recluta, la pregunta útil no es “¿cuál prueba ocupa el primer lugar?”, sino “¿qué evidencia necesito para tomar esta decisión y qué instrumento puede aportarla?”. Una aplicación es un uso completado de una prueba; una misma persona puede completar varias. El estudio no identifica puesto, industria, motivo de aplicación ni resultado de contratación.
Lo que reclutamiento debe decidir primero
- No elija una prueba porque sea popular; exija relación con el puesto y evidencia técnica.
- No agregue instrumentos que midan lo mismo sin aportar información incremental.
- Combine evaluación con entrevista estructurada, muestra de trabajo y referencias cuando correspondan.
- Mida duración, abandono, consistencia, equidad y relación con resultados posteriores.
Qué información inédita aporta este estudio
Estas respuestas proceden del uso agregado real de PsicoSmart; no son una recopilación de opiniones ni una lista tomada de terceros.
¿Cuáles concentraron más aplicaciones?
Honesti·values registró 275,731 aplicaciones, Cleaver 235,733 y Terman-Merrill 144,004. Juntas representaron 42.94% del uso observado.
Utilidad: sirve como referencia de adopción y para cuestionar si la batería propia fue elegida por necesidad o por costumbre.
¿Qué tan concentrado está el uso?
Las cinco primeras pruebas reunieron 863,411 aplicaciones, 56.57% del total. Existe un núcleo de instrumentos recurrentes, pero el estudio no demuestra que esa concentración produzca mejores contrataciones.
Utilidad: auditar redundancia y exigir una función distinta para cada instrumento.
¿Cambió el volumen de evaluación?
Entre enero y julio, las aplicaciones pasaron de 782,224 en 2025 a 952,929 en 2026: +21.82%.
Utilidad: planear capacidad y experiencia del candidato; el crecimiento no justifica añadir más pruebas.
¿Creció el uso por cliente o se amplió la adopción?
En julio, las aplicaciones aumentaron 24.83% y las organizaciones activas 32.26%. El promedio aproximado bajó de 57.7 a 54.4 aplicaciones por organización.
Utilidad: el patrón es compatible con adopción más distribuida, aunque el conteo organizacional puede duplicar identidades entre bases.
Marco de seis pasos para diseñar una batería
- Definir la decisión: selección, promoción, desarrollo u otra finalidad concreta.
- Analizar el puesto: identificar conductas, capacidades y riesgos laborales relevantes.
- Elegir evidencia complementaria: decidir qué aportarán prueba, entrevista, ejercicio y referencias.
- Revisar calidad técnica: propósito, confiabilidad, validez, baremos y población de referencia.
- Diseñar la experiencia: controlar duración, instrucciones, accesibilidad, privacidad y soporte.
- Validar el proceso: contrastar resultados con desempeño posterior y métricas de equidad.
La pregunta correcta no es “¿cuál es la mejor prueba?”, sino “¿qué evidencia necesitamos para este puesto, qué instrumento puede aportarla y cómo comprobaremos que mejora la decisión?”.
De la necesidad del puesto a la evidencia
Esta matriz sirve para discutir una batería antes de consultar el ranking. No prescribe marcas o instrumentos: obliga a definir qué información cambiará la decisión.
| Necesidad | Evidencia principal | Complemento | Control de calidad |
|---|---|---|---|
| Capacidad para aprender o resolver problemas | Medida cognitiva pertinente al nivel y al trabajo. | Muestra de trabajo o caso comparable con tareas reales. | Relación con desempeño y ausencia de barreras irrelevantes. |
| Estilo conductual o interacción | Instrumento de personalidad o estilo usado como hipótesis. | Entrevista estructurada y simulación relacionada con el puesto. | No convertir preferencias en diagnósticos ni perfiles ideales universales. |
| Ventas o servicio | Competencias definidas a partir del proceso comercial real. | Role play, evidencia de resultados y entrevista conductual. | Medir aporte incremental frente a experiencia y ejercicio. |
| Integridad o exposición a activos | Señales de valores/riesgo relacionadas con responsabilidades concretas. | Preguntas conductuales, referencias y controles internos. | Nunca interpretar una prueba como detector de mentiras. |
| Batería existente | Propósito documentado de cada instrumento. | Análisis de redundancia, duración y experiencia del candidato. | Retirar pruebas que no cambien decisiones o no tengan evidencia suficiente. |
El ranking como contexto, no como receta
Aplicaciones completadas durante los últimos 12 meses
Fuente: PsicoSmart. Aplicaciones completadas; corte 2026-08-27.
| Posición | Prueba | Aplicaciones | Participación |
|---|---|---|---|
| 1 | Honesti·values | 275,731 | 18.07% |
| 2 | Cleaver (DISC) | 235,733 | 15.44% |
| 3 | Terman-Merrill | 144,004 | 9.43% |
| 4 | Zavic | 115,205 | 7.55% |
| 5 | 16PF | 92,738 | 6.08% |
| 6 | Kostick | 88,847 | 5.82% |
| 7 | BARSIT | 86,517 | 5.67% |
| 8 | IPV (ventas) | 78,966 | 5.17% |
| 9 | D-48 (Dominós) | 43,236 | 2.83% |
| 10 | Trab·eq | 40,248 | 2.64% |
¿Por qué Honesti·values ocupa el primer lugar?
La lectura empresarial más plausible es que las organizaciones quieren reducir incertidumbre sobre honestidad, valores, ética e integridad antes de asignar responsabilidades. Honesti·values reunió 275,731 aplicaciones, 18.07% del total, y superó por 39,998 aplicaciones a la segunda prueba. Esto convierte la integridad en la señal temática más visible del ranking.
Sin embargo, el registro actual indica qué prueba se aplicó, no por qué fue elegida. Por eso esta explicación debe tratarse como una hipótesis respaldada por el patrón de uso, no como una causa demostrada.
Lo que sí sabemos
- Es la prueba individual con mayor frecuencia observada.
- Casi una de cada cinco aplicaciones completadas corresponde a este instrumento.
- La ventaja sobre el segundo lugar es de 39,998 aplicaciones.
Por qué puede estar ocurriendo
- Las empresas necesitan gestionar riesgos de confianza en puestos con dinero, inventario, información, clientes o autonomía.
- El trabajo digital, remoto y distribuido hace más difícil basarse únicamente en supervisión directa.
- Compliance, reputación y cultura organizacional vuelven más visible el costo de una conducta incompatible con políticas internas.
- En procesos masivos, las empresas buscan criterios estandarizados que puedan aplicar de forma consistente.
El contexto externo confirma que el riesgo es material, aunque no explica directamente la elección de esta prueba. El ACFE Report to the Nations 2026 estudió 2,402 casos reales de fraude ocupacional en 143 países y señala una asociación entre controles antifraude, menores pérdidas y detección más rápida. Por otra parte, el Future of Jobs Report 2025 encontró que 37% de los empleadores encuestados considera la confiabilidad y atención al detalle una habilidad central. Estas fuentes ayudan a entender la preocupación empresarial por la confianza; no prueban que un test prediga fraude o conducta ética.
Qué investigación confirmaría el motivo
El siguiente corte debería agregar dimensiones anonimizadas de industria, familia de puesto, tamaño de organización, combinación de pruebas y motivo declarado de aplicación. Una encuesta breve a responsables de RR. HH. —riesgo, cultura, cumplimiento, selección general u otra finalidad— permitiría distinguir interés real de simple disponibilidad o configuración predeterminada.
Cinco conclusiones para responsables de Recursos Humanos
El valor empresarial del ranking no está en copiar las pruebas más populares. Está en comparar la estrategia propia con patrones observados, detectar decisiones que se toman por costumbre y hacer explícito qué evidencia necesita cada puesto.
Un núcleo común domina el uso
Las cinco primeras pruebas reúnen 56.57% de las aplicaciones. Para una empresa, esto justifica auditar si su batería central responde a requisitos reales del puesto o si se conserva solo por tradición.
Decisión: conservar un núcleo únicamente cuando cada instrumento aporte evidencia distinta y relevante.
Popularidad no sustituye validación
El ranking es una referencia de adopción, no una clasificación de calidad. Una prueba frecuente puede ser innecesaria para un puesto concreto; una menos frecuente puede responder mejor a una necesidad específica.
Decisión: documentar propósito, evidencia técnica, población y criterio de uso antes de incorporar una evaluación.
El crecimiento exige capacidad operativa
El volumen comparable aumentó 21.82%. Las áreas de talento que escalan evaluaciones necesitan automatización, tiempos de respuesta definidos, soporte al candidato y controles de acceso; de otro modo, más pruebas también significan más fricción.
Decisión: medir tiempo de invitación a resultado, abandono, incidencias y carga del equipo.
La adopción se distribuyó entre más organizaciones
En julio, las organizaciones activas crecieron 32.26% y las aplicaciones 24.83%. Con la misma definición operativa, el promedio aproximado pasó de 57.7 a 54.4 aplicaciones por organización (-5.6%).
Decisión: diseñar procesos que funcionen tanto para equipos pequeños como para operaciones de alto volumen.
Una batería debe demostrar aporte incremental
El volumen de uso no muestra si una prueba mejora la decisión frente a entrevista, experiencia u otro instrumento. Agregar evaluaciones puede aumentar costo y abandono sin producir evidencia nueva.
Decisión: conservar cada prueba solo si responde una pregunta laboral distinta y su aporte puede medirse.
Ver contexto técnico de volumen y adopción
El volumen creció en 2026
Entre enero y julio de 2025 se completaron 782,224 aplicaciones. En el mismo periodo de 2026 fueron 952,929: 170,705 adicionales.
Evolución mensual de 2026
Agosto se excluye por ser parcial. Un máximo mensual no demuestra estacionalidad.
| Mes | Aplicaciones | Organizaciones activas |
|---|---|---|
| Enero | 132,462 | 2,399 |
| Febrero | 129,875 | 2,441 |
| Marzo | 133,251 | 2,583 |
| Abril | 131,083 | 2,551 |
| Mayo | 136,449 | 2,661 |
| Junio | 137,242 | 2,704 |
| Julio | 152,567 | 2,804 |
Lo que una empresa no debe concluir de este estudio
- Que la primera prueba del ranking es la mejor para cualquier vacante.
- Que aplicar más instrumentos produce automáticamente mejores contrataciones.
- Que los porcentajes representan todo el mercado latinoamericano.
- Que una evaluación puede reemplazar la entrevista estructurada o la evidencia del puesto.
- Que el volumen observado demuestra impacto causal sobre rotación, desempeño o ventas.
Estas fronteras aumentan la utilidad del estudio: distinguen lo que los datos permiten decidir de lo que todavía necesita investigación.
Metodología y limitaciones
- Origen: agregados anonimizados de 40 bases operativas de PsicoSmart; no es una muestra aleatoria del mercado.
- Unidad: una aplicación técnicamente completada (
porcentaje = 100), no una persona única. Una persona puede completar varias pruebas. - Periodo: los 12 meses anteriores al 27 de agosto de 2026.
- Exclusiones: códigos técnicos con prefijo
e_. - Alcance: el ranking mide frecuencia dentro de PsicoSmart, no calidad, eficacia, validez, capacidad predictiva ni cuota de mercado.
- Variables ausentes: no identifica puesto, industria, combinación de pruebas, motivo de aplicación ni resultado de contratación.
- Organizaciones: los conteos se suman entre bases y podrían sobreestimarse si una identidad existe en más de una.
- Geografía: se retiró la tabla por país porque describe actividad comercial de cuentas pero no ayuda a elegir una prueba para un candidato o puesto.
- Privacidad: solo se publican agregados con al menos 10 observaciones.
Fuente para cita: PsicoSmart, análisis agregado de 1,526,302 aplicaciones completadas; corte 27 de agosto de 2026.