Si estás buscando alternativas a Codility, ya tomaste una decisión que quizá no notaste. Decidiste que el problema es Codility, no el formato. Yo tengo una empresa de evaluación, así que lee esto con el sesgo que merece: mi producto es una de las alternativas, y prefiero decirlo antes de la tabla y no después. Lo que no voy a hacer es pasarte otra lista rankeada de proveedores de tests de código, porque creo que la lista es la trampa. Casi toda alternativa a Codility que encuentres evalúa lo mismo que evalúa Codility. Esto es qué es eso, y qué no puede ver.
¿Cuáles son las alternativas a Codility?
La respuesta corta primero, porque es a lo que viniste. Las herramientas que aparecen en casi toda lista de alternativas a Codility caen en cinco grupos.
| Grupo | Herramientas | Qué corren |
|---|---|---|
| Pruebas de código cronometradas | HackerRank, CodeSignal, HackerEarth, Coderbyte, TestDome, Qualified | Tareas automatizadas en una ventana fija, calificadas por el resultado |
| Tareas tipo proyecto | DevSkiller, Geektastic, CodeSubmit | Asignaciones más largas sobre un repositorio realista, muchas veces revisadas por pares |
| Pairing en vivo | CoderPad, Karat | Una persona en la llamada, sea tu ingeniero o un entrevistador externo |
| Librerías de skills multirol | TestGorilla, iMocha, Vervoe, Adaface, Mercer Mettl | Bancos de pruebas que cubren ventas, soporte y operaciones además de ingeniería |
| Simulación de trabajo observada | Skillvee | Una sesión grabada donde el candidato hace el trabajo, con IA incluida |
Los primeros cuatro grupos califican un entregable producido bajo condiciones de examen. El quinto observa el trabajo mientras ocurre. Esa es la única línea de esta página que cambia lo que aprendes de una persona, y ninguna lista rankeada que haya leído la dibuja.
Skillvee es una simulación de 60 minutos de un "día de trabajo" que reemplaza el filtro telefónico del reclutador y la primera ronda de entrevistas. El candidato resuelve un reto real, habla con compañeros de IA para conseguir la información que necesita y defiende sus decisiones en una llamada, mientras se graba la pantalla. Funciona para cualquier rol cuyo trabajo ocurre en una computadora, ingeniería incluida, y mide cómo trabaja una persona: comunicación, colaboración, autonomía, uso de IA, resolución de problemas, calidad del entregable y gestión del tiempo. El detalle de cómo se arma la sesión está en la página de producto.
¿Por qué los equipos dejan Codility?
Las razones para dejar Codility son reales y casi siempre justas. Un precio por asiento que se pone caro a medida que crece el equipo de contratación. Tareas que se sienten rígidas, más un examen de certificación que el trabajo. Una tasa de finalización que cae cuando el candidato choca con un puzzle que nunca tocaría en el día a día. Soporte más lento del que quiere un equipo que va rápido. Todo eso es legítimo, y cualquiera de los cambios habituales arregla parte.
Entonces la gente sale de compras. Escribe "alternativas a Codility" y se topa con un muro de listas, casi todas escritas por un proveedor rival que se pone a sí mismo primero. Ese género compara logos y casillas de funciones porque son seguras de comparar. Rara vez hace la única pregunta que decide si cambiar sirve de algo. Si estás un paso antes en esa búsqueda, la guía de alternativas a HackerRank divide la categoría en las tres cosas distintas que la gente quiere decir con eso.
¿Qué miden en realidad las alternativas a Codility?
La pregunta es esta: qué me va a mostrar esta herramienta que no sepa ya por un currículum y un puntaje de código.
Pasa los nombres honestos por ahí. HackerRank tiene una librería de preguntas enorme y años de historia enterprise. CodeSignal tiene un IDE pulido y puntajes estandarizados que comparan entre candidatos. iMocha y TestGorilla van anchos, por muchos roles. HackerEarth y DevSkiller apuestan por tareas con marco realista. CoderPad está hecho para pair programming en vivo. Buenas herramientas, todas.
También comparten una columna vertebral. Cada una evalúa código producido bajo condiciones de examen: si el candidato resuelve problemas acotados, en una ventana fija, en un entorno que parece un test porque lo es. Eso es una señal real. Es una dimensión de señal, y es la misma dimensión en toda la lista. Cambiar Codility por HackerRank cambia la librería y la factura. No cambia lo que aprendes de la persona.
Está bien si lo que te está fallando es de verdad el puntaje de código. No está bien si lo que te sigue quemando es todo lo que el puntaje nunca cubrió.
¿Cómo se comparan Codility, HackerRank, CodeSignal y una simulación?
Mi apuesta, sesgo declarado y todo: compara estas herramientas por lo que miden, no por lo que listan. Esta es la tabla que ojalá encabezara las páginas de alternativas.
| Codility | HackerRank / CodeSignal | Skillvee (simulación) | |
|---|---|---|---|
| Formato base | Tests de código cronometrados | Tests de código, puntajes estandarizados | Simulación de trabajo observada de 60 min |
| Calidad de código | Sí | Sí | Sí |
| Comunicación | No | No | Sí |
| Colaboración | No | No | Sí |
| Autonomía | No | No | Sí |
| Aprovechamiento de IA | Se trata como amenaza | Se trata como amenaza | Se mide como skill |
| Criterio ante la ambigüedad | Parcial | Parcial | Sí |
| Modelo de precio | Por asiento | Por volumen / por tramos | Por evaluación, reemplaza etapas |
| Mejor en | Tests algorítmicos estructurados | Filtro de alto volumen, puntaje estandarizado | Ver cómo trabaja alguien antes del onsite |
| Peor en | Todo lo que no es código | Todo lo que no es código | Filtro de puzzles a volumen altísimo |
Lee las filas del medio otra vez. Comunicación, colaboración, autonomía, criterio. Esas son las dimensiones en las que falló de verdad tu última contratación de la que te arrepentiste. Ningún test cronometrado las mide. Es un límite del formato, no un reproche a la ingeniería de Codility. Un test califica un resultado. Esas dimensiones solo aparecen mientras alguien trabaja, en cómo pregunta, corrige y decide. Para ser justo con las dos, HackerRank y CodeSignal también venden productos de entrevista en vivo, y ahí un entrevistador humano juzga la comunicación sin problema. La tabla habla del filtro automático por el que de verdad se compran.
Esa última columna es la simulación descrita arriba: el candidato trabaja, la pantalla se graba y el modelo se le entrega a propósito en vez de defenderse de él. Para una contratación de ingeniería eso significa que ves a alguien leer código ajeno, hacerle la pregunta correcta a un par y justificar un tradeoff, antes de que cualquier ingeniero senior gaste una hora de entrevista. Vive en la misma línea de pensamiento que el análisis de CodeSignal vs HackerRank, que recorre el mismo replanteo desde el ángulo de dos proveedores.
¿Alguna alternativa a Codility resuelve el problema de la IA?
Hay una razón por la que esta comparación importa más en 2026 que hace tres años. Los candidatos ahora traen un modelo a tu test de código, los invites o no. Así que los grandes y sus alternativas siguen sacando proctoring, navegadores bloqueados y detección de plagio para defender el formato de examen.
Creo que esa es la pelea equivocada, y escribí la versión larga de por qué en la pieza sobre trampas con IA. En resumen: la detección es una carrera armamentista que vuelves a perder con cada modelo nuevo, y trata usar IA como trampa justo cuando usar bien la IA se volvió parte del trabajo. Cambiar Codility por otro test cronometrado te compra una versión más linda de un filtro que pelea la guerra equivocada. Un mejor bloqueo no ayuda acá. La herramienta que sí ayuda es la que le pasa la IA al candidato a propósito y mira qué hace con ella. Si ya tomaste esa decisión, la mitad difícil es definir qué evaluar, y lo desarmé en seis conductas observables. Llevé ese hilo más lejos en la pieza sobre alternativas a CodeSignal, que ordena toda esta categoría según qué trabajo hace la IA mientras tu candidato trabaja.
¿Cuándo Codility sigue siendo la opción correcta?
Ser justo acá no me cuesta nada, así que, directo. Si tu cuello de botella es puro volumen, miles de postulantes y la necesidad de un piso algorítmico barato, un test de código cronometrado todavía hace ese trabajo. Elige por calce de librería, experiencia del candidato y precio para tu volumen, y cualquiera de los nombres de arriba va a servir. Codility es una versión competente de esa herramienta. HackerRank también, normalmente a un precio de entrada más bajo. Si ese es todo el problema, no necesitas cambiar de categoría, solo comprar dentro de la que ya estás.
El cambio de categoría se gana su lugar cuando el problema caro vive después del filtro. Onsites gastados en gente que evalúa bien y trabaja mal. Ingenieros senior dando cinco o más horas por contratación a entrevistas que una señal previa al onsite pudo haber adelantado. Sorpresas post-contratación que nunca fueron sobre el código. Ahí es donde ver a alguien trabajar le gana a calificar su resultado, y a volúmenes típicos de mitad de embudo las cuentas por evaluación tienden a favorecer un filtro que reemplaza etapas en vez de sumar una.
¿Dónde se complica el enfoque de simulación?
La columna de la simulación no es gratis, y prefiero que lo escuches de mí. Una sesión observada de 60 minutos cuesta más por candidato que un test automático, así que a escala de tope de embudo de verdad vas a querer un primer filtro barato adelante. Y vive o muere por el diseño de la tarea. Una tarea simulada floja mide si alguien sigue instrucciones, no si sabe pensar, que es la misma falla que una mala pregunta de Codility, solo que más cara de correr. Eso es trabajo de ingeniería real, y alguien lo tiene que hacer bien.
La conclusión honesta: casi todas las alternativas a Codility son movimientos laterales. Mejor interfaz, factura más amable, los mismos puntos ciegos. Si quieres que tus resultados de contratación cambien de verdad, deja de buscar otro test de código y pregúntate si deberías seguir corriendo uno, o empezar a ver a la gente trabajar.