Líderes de opinión

Vigilancia de exámenes en la era de la IA, por qué el diseño de pruebas sigue siendo lo primero

mm
Añade Unite.AI a tus fuentes preferidas en Google

Asegurando el futuro de los exámenes en línea ante la creciente demanda y el endurecimiento de las leyes de privacidad.

El mercado global de software de exámenes en línea, valorado en $9.4 mil millones en 2025, se espera que alcance $28.7 mil millones para 2034, a medida que los proveedores de capacitación, los organismos profesionales y las instituciones educativas trasladan cada vez más las evaluaciones a línea.

La popularidad de los exámenes en línea es fácil de comprender, ya que las instituciones educativas están gestionando limitaciones de financiación y espacio limitado en el campus, mientras que los empleadores y los organismos profesionales buscan formas más flexibles de evaluar a los candidatos. Las pruebas remotas permiten a las personas equilibrar el aprendizaje y la certificación con el trabajo y los compromisos personales, haciendo que las evaluaciones sean más accesibles que los formatos tradicionales presenciales.

Sin embargo, el mayor desafío de la industria no es la escala; es la antigua mercancía, la confianza. A medida que las herramientas de IA dificultan la detección del fraude, las instituciones están bajo una presión creciente para demostrar que las evaluaciones en línea son justas, seguras y cumplen con la normativa.

Recientemente, la Association of Chartered Certified Accountants salió a la luz tras anunciar su decisión de eliminar los exámenes remotos ante las preocupaciones de fraude con IA, mientras que Ofqual ha informado que los docentes encuentran cada vez más difícil identificar la IA en los trabajos evaluados. Incluso Princeton University, una de las universidades más prestigiosas del mundo, ha modificado su Código de Honor de 133 años para introducir la vigilancia en los exámenes presenciales.

Dadas estas presiones, es fácil asumir que más vigilancia es la solución. Sin embargo, en cierto punto, más supervisión no conduce necesariamente a mejores estándares ni a resultados más precisos. En muchos casos, la monitorización excesiva puede perjudicar la accesibilidad, reducir la confianza de los candidatos y generar preocupaciones de privacidad.

La vigilancia no es un atajo para un buen diseño de evaluación

La vigilancia es una herramienta eficaz para prevenir conductas indebidas, pero no es una solución independiente para un diseño deficiente de la evaluación. Los supervisores presenciales no pueden observar a todos los candidatos simultáneamente. Sin embargo, la vigilancia en línea tiene sus propias limitaciones, ya que se ha observado que los estudiantes utilizan dispositivos inteligentes para eludir las tácticas de monitorización en línea.

Cuando un examen se centra en evaluar la memoria del candidato, como un examen estandarizado de opción múltiple, el incentivo a hacer trampa aumenta porque existe un conjunto limitado de respuestas correctas entre las que elegir. Si ese examen tiene un peso significativo en la nota final, ese incentivo se incrementa aún más. Estos formatos de examen son inherentemente más vulnerables a la IA, que sobresale en recuperar y reproducir este tipo de información.

Cuando los exámenes están diseñados para evaluar la capacidad del candidato de analizar información y aplicar teoría a diferentes contextos, la ventaja inmediata que ofrece la IA disminuye rápidamente. Esto refleja mejor los entornos profesionales modernos, donde rara vez se requiere que los empleados operen únicamente de memoria.

En la práctica, esto se traduce en una pregunta contextual basada en un escenario hipotético que solicita a los candidatos justificar sus respuestas. Cuando se combina con límites de tiempo, bloqueos del navegador o restricciones de copiar‑pegar, incluso una respuesta bien construida por IA resulta difícil de aplicar de manera útil. Estas preguntas exigen razonamiento original, no hechos recuperables.

Al ofrecer exámenes de libro abierto, estudios de caso y otras tareas de pensamiento crítico bajo condiciones controladas, las instituciones pueden desarrollar modelos de evaluación en los que las medidas de seguridad se distribuyen en múltiples partes del proceso de evaluación. Esto les permitirá reducir su dependencia de la monitorización, ya que la integridad se incorpora en la estructura del examen en lugar de imponerse mediante la vigilancia.

Aunque la evaluación basada en la memoria sigue siendo fundamental para probar los conocimientos básicos del candidato, las instituciones pueden obtener una comprensión mucho más detallada de la capacidad del candidato cuando la combinan con otros formatos de pruebas aplicadas.

Los ponderaciones de los exámenes también pueden reestructurarse para mitigar el fraude. Si la calificación se distribuye de manera más equitativa entre los exámenes, los candidatos sienten mucha menos presión por obtener una puntuación alta, lo que naturalmente reduce el incentivo a hacer trampa. Esta es otra alternativa para asegurar los exámenes sin recurrir a una vigilancia intensiva.

La vigilancia es esencial en todos los exámenes, pero nunca debe ser el único mecanismo para mantener la integridad. En lugar de centrarse en diferentes formas de monitorizar a los candidatos, los formatos y preguntas de los exámenes deben diseñarse para que todas las formas de trampa, no solo la IA, sean más difíciles por diseño.

Por qué el cumplimiento es fundamental

A medida que las instituciones implementan medidas de vigilancia en los exámenes en línea, también deben navegar por las leyes de privacidad y protección de datos para garantizar que los métodos de vigilancia sean justos y cumplan con la normativa legal.

Según el RGPD, la captura de transmisiones de video, grabaciones de audio y otros datos biométricos se considera altamente sensible; por lo tanto, la recopilación debe estar justificada y los candidatos deben saber cómo se utiliza su información. 

El EU AI Act también ha introducido restricciones al monitoreo totalmente automatizado de exámenes, enfatizando que las evaluaciones de alto riesgo deben mantener supervisión humana, resultados auditables y la capacidad del personal para intervenir o anular decisiones automatizadas.

Al mismo tiempo, las instituciones deben considerar el riesgo a largo plazo asociado con el almacenamiento de grandes cantidades de datos de vigilancia, ya que cuanto más vigilancia introduzca un examen en línea, más datos deberán gestionarse con el tiempo. Esto representa un riesgo significativo, dado el alto volumen de ataques de ciberseguridad dirigidos al sector educativo del Reino Unido.

Por eso, un modelo de vigilancia único para todos ya no es legalmente defendible. Para evitar una vigilancia generalizada, las instituciones deberían adoptar una mentalidad de minimización de datos y configurar los modelos de vigilancia según el nivel de riesgo de cada examen.

Cuando el diseño cuidadoso del examen se complementa con una vigilancia proporcionada, los exámenes en línea se vuelven más seguros. Más importante aún, demuestra a los reguladores y a los candidatos que las condiciones de evaluación son justas y cumplen con la normativa, al tiempo que proporcionan la trazabilidad necesaria para validar los resultados.

El futuro de la evaluación

El ritmo al que crecen los exámenes en línea representa una gran oportunidad para el aprendizaje y el desarrollo profesional. Sin embargo, también plantea un desafío fundamental sobre cómo se define y gestiona la seguridad de los exámenes.

Los proveedores de capacitación, los organismos profesionales y las instituciones educativas que prosperen serán aquellos que consideren el diseño de exámenes y la vigilancia como complementarios, en lugar de depender únicamente de la vigilancia. La integridad no es algo que pueda monitorizarse desde el exterior; debe incorporarse desde el principio.

El Dr. James Gupta es CEO y fundador de la plataforma de exámenes en línea Synap, que ayuda a las organizaciones a entregar exámenes y evaluaciones profesionales con confianza.

James estudió Medicina y tiene un título de Maestría en Informática de la Salud, combinando experiencia en atención médica de primera línea con profunda experiencia en educación y tecnología.

Synap se creó originalmente para apoyar la propia revisión de exámenes médicos de James, lo que le dio una visión de primera mano de los desafíos que enfrentan los estudiantes y las instituciones por igual. Lo que comenzó como una solución personal ha evolucionado hasta convertirse en una plataforma global de confianza utilizada por empresas, proveedores de capacitación y universidades para entregar exámenes y evaluaciones profesionales de alto riesgo a gran escala.

Hoy en día, Synap apoya a más de 500.000 usuarios registrados en todo el mundo. Se han respondido más de 300 millones de preguntas en la plataforma y se han entregado más de 10 millones de pruebas, lo que refleja la escala, la confiabilidad y el impacto de Synap en múltiples sectores.

Bajo el liderazgo de James, Synap ha crecido hasta convertirse en una infraestructura de evaluación segura y escalable diseñada para satisfacer las demandas del panorama profesional actual, lo que permite a las organizaciones entregar exámenes digitales con confianza, integridad y conocimientos de rendimiento medibles.