Cada semana en la ESSEC termino la sesión con un quiz obligatorio de diez preguntas, reabierto a distancia dos semanas más tarde, cuya nota solo puede subir. Cuento cómo funciona, qué revela sobre la ilusión de saber y qué dicen mis alumnos.
Muchos docentes oyen «obligatorio» y entienden «con nota». Las dos palabras viajan juntas desde hace tanto tiempo que cuesta imaginarlas separadas. Si un ejercicio cuenta para el expediente es porque produce una nota; y si no produce una nota, nadie lo hará.
Y sin embargo, lo que practico cada semana en mis clases de la ESSEC Business School, donde enseño desde enero de 2022, es justo lo contrario. Al final de cada sesión, mis alumnos hacen un quiz corto sobre lo que acabo de enseñarles. Hacerlo es obligatorio. Dos semanas más tarde reabro el mismo quiz a distancia, y cada uno tiene una semana para volver a hacerlo. La nota que se retiene es la mejor de los dos intentos, de modo que la del aula nunca puede bajar la media. Este artículo describe cómo funciona, por qué se sostiene y qué me ha enseñado sobre mis propias clases.
Una evaluación formativa es una evaluación cuyo resultado sirve para ajustar el aprendizaje mientras ocurre, y no para hacer un balance. No es el formato lo que la define, sino el uso que se hace del resultado: el mismo cuestionario es formativo si guía la continuación del curso, y sumativo si certifica un nivel. El término viene de los trabajos de Michael Scriven, en 1967, retomados por Benjamin Bloom.
Tres usos se distinguen bien en cuanto se mira el momento y la finalidad. La evaluación diagnósticaEvaluación diagnósticaEvaluación situada antes de una enseñanza o de una formación para establecer lo que los participantes ya saben, y lo que les falta. No cuenta para la aprobación: su resultado sirve para formar grupos, ajustar el ritmo, orientar hacia un itinerario o identificar requisitos previos ausentes antes de que bloqueen el resto del programa. Se distingue de la evaluación formativa por su momento, antes del aprendizaje y no durante, y de la evaluación sumativa por su función, informar y no sancionar. Ejemplo: antes de un módulo de estadística, un cuestionario de veinte preguntas sobre fracciones, porcentajes y lectura de un gráfico; los participantes que fallan en porcentajes siguen una sesión de refuerzo antes de la primera clase. Para ser útil, una evaluación diagnóstica debe cubrir los requisitos previos reales del programa, no su contenido, y devolver un resultado legible por competencia y no una nota global: cinco sobre diez no dice qué repasar. En la formación profesional, la evaluación inicial al comienzo es su forma más común; comparada con una evaluación de fin de curso, sirve también para medir el progreso.Ver la definición completa abre una secuencia y sirve para saber de dónde se parte. La evaluación formativaEvaluación formativaEvaluación realizada durante el aprendizaje, cuya función es informar al alumno y al docente sobre los logros en curso de construcción. Su producto útil es la retroalimentación, no la nota: es frecuente, de bajo riesgo, y sirve para corregir la trayectoria mientras todavía hay tiempo. El término proviene de los trabajos de Michael Scriven en 1967, retomados por Benjamin Bloom, que oponen la evaluación que forma a la evaluación que hace balance. En concreto, una evaluación formativa se reconoce por tres rasgos: una retroalimentación rápida y precisa sobre cada respuesta, un resultado que pesa poco o nada en la nota final, y una decisión pedagógica tomada a partir de los errores observados. Ejemplo: un cuestionario de diez preguntas al final de cada sesión, corregido automáticamente, con la justificación de la respuesta correcta mostrada de inmediato; el docente relee las estadísticas por pregunta y retoma en la clase siguiente la noción que la mitad del grupo ha fallado. El efecto de testing refuerza el interés del dispositivo: ponerse a prueba consolida la memoria más que releer. La misma pregunta puede servir en formativo o en sumativo; lo que decide es el uso del resultado, no el formato.Ver la definición completa la acompaña y sirve para corregir el rumbo. La evaluación sumativaEvaluación sumativaEvaluación que interviene al término de una secuencia, de un módulo o de un curso para establecer un balance de los logros y producir una nota que cuenta. Fija un resultado más que acompaña un progreso, y se distingue de la evaluación formativa por su función, no por el formato de las preguntas planteadas. La palabra viene de suma: la nota resume lo aprendido y sirve para decidir, aprobar un módulo, clasificar, admitir, otorgar un título. Cuando esa decisión condiciona un diploma o una certificación, se habla más precisamente de evaluación certificativa. Ejemplo: el examen final de una asignatura de derecho de contratos, dos horas, un caso práctico y diez preguntas cortas, calificado sobre diez y con un peso del sesenta por ciento en la nota de la asignatura, el resto proveniente de la evaluación continua. Como su nota tiene consecuencias, una evaluación sumativa exige más que una formativa: un baremo publicado de antemano, condiciones de realización idénticas para todos, una identificación del candidato, una corrección trazable y una vía de reclamación. Un análisis de ítems después de la prueba sigue siendo útil: una pregunta que los mejores candidatos fallan más que los demás señala un enunciado ambiguo o una clave de corrección errónea.Ver la definición completa la cierra y sirve para acreditar un nivel alcanzado.
| Tipo | Cuándo | Para qué sirve el resultado |
|---|
| Diagnóstica | Antes de la secuencia | Situar el punto de partida y adaptar el curso |
| Formativa | Durante la secuencia | Corregir, repasar, reorientar la sesión |
| Sumativa | Al final de la secuencia | Acreditar un nivel, producir una nota |
Mi sistema: un quiz de fin de sesión, obligatorio y sin riesgo para la nota
Los últimos minutos de cada sesión están reservados al quiz. Las preguntas tratan únicamente sobre lo que acabo de enseñar, no sobre el programa entero, y son deliberadamente cortas: diez preguntas por lo general, diez minutos. Los alumnos lo hacen en Evalmee, en el aula, en su propio ordenador, mientras yo sigo delante de ellos.
La corrección está disponible en cuanto se entrega el quiz. Evalmee también puede mostrarla después de cada pregunta; en clase no activo esa opción: las diez preguntas se hacen de una sola vez, y la corrección viene después. El alumno puede entonces pedir una retroalimentación de la IA sobre el conjunto de su examen: un análisis global de lo que domina y de lo que le falta, más que una lectura pregunta por pregunta. Se va con esa retroalimentación, no solo con una nota, y no la espera una semana, cuando ya haya olvidado lo que tenía en la cabeza al responder.
Hacer el quiz es obligatorio. La nota del aula, en cambio, no es forzosamente la que se retiene. Dos semanas más tarde abro un segundo intento, fuera del aula esta vez: cada uno lo hace donde quiere, cuando quiere, y dispone de una semana para hacerlo. La nota que entra en la media es la mejor de las dos. El plazo es deliberado. La retroalimentación se lee el mismo día; dos semanas después hay que recuperar lo que se vio, y no copiar lo que acaban de corregir. En la práctica, ese segundo intento es una copia del mismo examen, abierta durante siete días; los intentos múltiples sobre un mismo examen están en camino en Evalmee y simplificarán este paso. El quiz del aula nunca puede costar un punto: solo puede aportarlo.
Por qué es obligatorio, y por qué la nota solo puede subir
La obligación recae sobre el acto, no sobre el resultado. Le pido a cada alumno que se enfrente a las preguntas; no le pido que acierte a la primera. Es una distinción sencilla de enunciar y sorprendentemente difícil de hacer entender, porque la escuela ha pasado un siglo confundiendo las dos.
Una nota seca sobre el intento en clase rompería justo lo que busco: una respuesta honesta, que venga de ellos. En el aula, con los dispositivos antifraude de Evalmee, mis alumnos están librados a sí mismos. Sin asistente, sin nadie al lado, nada que optimizar: responden lo que creen que es verdad, incluso cuando no están seguros. Es exactamente la información que quiero, la que un trabajo hecho con ChatGPT nunca me daría. Una nota que sancionara ese primer intento produciría lo contrario: responder lo que tiene más probabilidades de ser aceptado, evitar descubrir que uno se ha equivocado, vivir el quiz como una sanción más al final de una jornada ya larga.
El segundo intento es lo que hace sostenible el conjunto. Sin él, el quiz sería solo una constatación desagradable. Con él, el mal resultado del final de la sesión se convierte en una lista de cosas que repasar esa misma noche, y el alumno mantiene el control de lo que sigue. Lo que está en juego se desplaza de la nota hacia la distancia entre los dos intentos. Quedarse con el máximo de los dos intentos, y no con su media, es el detalle que cuenta: el primero no puede perjudicar, el segundo, dos semanas más tarde, recompensa el trabajo hecho entre los dos.

Dos maneras de sostener la obligación sin la sanción
Existen dos formas de hacer obligatoria una evaluación formativa sin que el primer intento pueda castigar, y ambas se defienden.
La primera es estrictamente sin nota. Se exige el paso por el quiz, el resultado aparece como una referencia personal, y nada entra en la media. Es la versión más pura de lo formativo, y la única posible cuando el reglamento de estudios, un referencial de certificación o la duración de una formación no dejan ningún espacio para una nota más. Tiene un coste: sin nada en juego, una parte de los participantes lo toma a la ligera, y el quiz mide entonces su atención más que su comprensión.
La segunda es la que yo elegí: con nota, pero con un segundo intento abierto dos semanas más tarde, fuera del aula y durante una semana, y la mejor de las dos notas conservada. Lo que está en juego existe, empuja a preparar el segundo intento, y sigue siendo incapaz de perjudicar. El plazo de dos semanas no es un detalle de organización: convierte el segundo intento en un segundo repaso, espaciado, del mismo contenido, que es justo lo que recomienda la investigación sobre la memoria. Entre las dos, el principio no cambia. La obligación recae sobre el acto, el primer intento no cuesta nada, y la retroalimentación llega de inmediato.
Lo que revela el quiz: la ilusión de saber, amplificada por ChatGPT
Cuando uno es alumno, tiene permanentemente la ilusión de saber. No es un defecto de carácter, es un funcionamiento normal de la memoria. Koriat y Bjork lo mostraron ya en 2005: los juicios que uno hace sobre su propio aprendizaje se producen en presencia de pistas que han desaparecido en el momento de la prueba real, de modo que uno se siente preparado de una forma que después no se verifica. La demostración más clara viene de Roediger y Karpicke, en 2006: los participantes que habían releído su texto varias veces predecían un mejor recuerdo (la parte del texto que serían capaces de restituir de memoria una semana más tarde) que quienes se habían puesto a prueba, y fue lo contrario lo que ocurrió en la prueba, una semana más tarde.
La IA generativa no crea esta ilusión, la amplifica. Dos clics cuestan tan poco esfuerzo que el alumno olvida haberlos hecho. Relee una respuesta que le parece evidente, la encuentra correcta y sale de ahí con la sensación sincera de haber sabido. Un trabajo para casa o un quiz hecho en una herramienta sin seguridad ya no mide al alumno, mide al asistente. Por esta razón muchos docentes han dejado de mandar trabajo escrito para hacer en casa.
El orden de magnitud está documentado. En un ensayo aleatorizado realizado en un instituto de Turquía, en clases de matemáticas, Bastani y sus coautores midieron en 2025 que el acceso a un asistente conversacional estándar mejoraba el rendimiento durante los ejercicios en un 48 por ciento, pero reducía el rendimiento en el examen sin asistencia en un 17 por ciento. Una variante con salvaguardas pedagógicas, que da pistas en lugar de dar la respuesta, hacía desaparecer ese efecto negativo. El rendimiento aparente sube, la competencia real baja.
En el aula, con las salidas de pantalla y el copia y pega detectados y señalados en pantalla, ese atajo ya no está disponible. El quiz se convierte entonces en el único momento de la semana en que la distancia entre «he seguido la clase» y «lo sé» se hace visible, primero para el alumno y después para mí.
Por qué equivocarse en clase es una buena noticia
Un 5 sobre 20 en un quiz de fin de clase sacude. Ese es el objetivo. Esa nota no le costará nada a la media, pero produce un desacuerdo nítido entre lo que el alumno creía saber y lo que acaba de demostrar, y ese desacuerdo es lo que dispara el trabajo. Metcalfe, en su síntesis de 2017 sobre el aprendizaje a partir del error, describe el llamado efecto de hipercorrección: los errores cometidos con mucha confianza son los que mejor se corrigen, siempre que después llegue una retroalimentación correctiva. Es exactamente la configuración de un quiz con corrección inmediata y segundo intento, donde el primero no puede penalizar.
La objeción existe y la escucho a menudo. Una responsable pedagógica de una escuela de ingenieros me la formuló durante una demostración, la semana del inicio de curso: algunos alumnos necesitan tiempo para integrar y consolidar, y verse evaluados en caliente los descoloca. Mi respuesta es que ahí está precisamente el interés del planteamiento. Ponerse a prueba no sustituye a la consolidación, indica qué consolidar, y lo indica el mismo día en lugar de en el examen final. El tiempo de estudio es escaso: mejor que se gaste en el lugar correcto.
Su preferencia, un quiz al principio de la sesión siguiente sobre la sesión anterior, es una variante perfectamente legítima, y muchos docentes la usan así. Añade un intervalo que hace trabajar la memoria a largo plazo, y los alumnos llegan preparados, lo que por cierto hace más defendible una nota directa. La verdadera decisión es cuándo evaluar, no si conviene evaluar.
El efecto de evaluación: por qué ponerse a prueba vale más que releer
Nada de todo esto es una intuición personal. El efecto de evaluaciónEfecto de evaluación (testing effect)Fenómeno por el cual ponerse a prueba sobre un contenido mejora su retención de forma más duradera que releerlo. El recuerdo activo consolida la huella en la memoria, lo que convierte la evaluación frecuente en un instrumento de aprendizaje y no solo en un instrumento de medida.Ver la definición completa es uno de los resultados mejor establecidos de la psicología del aprendizaje. En Roediger y Karpicke, en 2006, los estudiantes que se habían puesto a prueba sobre un texto recordaban el 61 por ciento una semana después, frente al 40 por ciento de quienes solo lo habían releído. Ponerse a prueba no es únicamente una medida del aprendizaje, es un instrumento del aprendizaje.

La revisión de Dunlosky y sus coautores, publicada en 2013, comparó diez técnicas de aprendizaje habituales. Ponerse a prueba queda clasificado ahí en utilidad alta, al mismo nivel que repartir el trabajo en el tiempo. La simple relectura, la técnica más extendida entre los estudiantes, queda clasificada en utilidad baja.
El efecto se sostiene también fuera del laboratorio. Pennebaker, Gosling y Ferrell siguieron en 2013 una asignatura magistral de unos 900 estudiantes que pasó a quizzes diarios online con retroalimentación inmediata. Comparados con las cohortes de los mismos cursos en formato clásico, esos estudiantes ganaron alrededor de media letra en preguntas de examen idénticas de un año a otro, y la brecha de resultados entre categorías sociales se redujo más de la mitad. El estudio es cuasiexperimental y estadounidense, así que hay que trasladarlo con prudencia, pero el orden de magnitud está ahí.
El plazo de dos semanas entre mis dos intentos se apoya en un segundo resultado, igual de sólido: el espaciamiento. Cepeda y sus coautores revisaron, en 2006, más de doscientos cincuenta estudios que comparaban repeticiones concentradas y repeticiones espaciadas. A igual tiempo de estudio, espaciar los repasos retiene mejor, y el intervalo óptimo entre dos pasos crece con el tiempo durante el cual se quiere retener. Un quiz al final de la sesión, y luego el mismo quiz dos semanas más tarde, es el efecto de evaluación y el espaciamiento a la vez.
Lo que dicen mis alumnos
Es la parte que cuento pocas veces, porque contradice lo que todo el mundo espera. A mis alumnos les gustan estos quizzes. Una sesión en la que no había previsto ninguno se quejaron, con la sensación de salir de clase habiendo aprendido menos que de costumbre.
Quiero ser honesto sobre el estatus de esta observación: es la impresión de un docente sobre sus propias promociones, no una medición. No tengo grupo de control ni encuesta de satisfacción sobre este punto concreto. Lo que sí puedo decir es que la sensación que describen coincide con lo que predice el efecto de evaluación, vivido desde dentro: una sesión que termina con un recuerdo activo deja una impresión de dominio más sólida que una sesión que termina con una diapositiva de conclusión.
Tres reglas para que la obligación se viva bien
El riesgo de una evaluación obligatoria es que se viva como un control disfrazado o como una carga más. Tres reglas lo evitan, y se comprueban cada semana.
Decir por qué. Desde la primera sesión explico la regla en una frase: el quiz es obligatorio porque forma parte del aprendizaje, y la nota del aula no te puede perjudicar. Una obligación cuya razón se entiende se acepta; la misma obligación sin explicación se padece.
Mantener el ritmo. Un quiz corto en cada sesión, nunca por sorpresa, vale más que un control grande al mes. La regularidad es lo que sustituye el estudio de última hora por un trabajo continuo, y lo que le da al espaciamiento la ocasión de actuar.
Obligar solo a lo que sirve. La obligación se justifica cuando la evaluación aporta un beneficio neto e inmediato, retroalimentación incluida. Un quiz obligatorio sin corrección accesible sería una exigencia sin contrapartida, y los participantes lo notarían pronto.
Cómo montar el tuyo en una sola sesión
El planteamiento no exige ningún equipamiento particular más allá de una plataforma de evaluación, y se pone en marcha en una sola sesión. Esto es lo que cuenta, generalizando más allá de mi caso.
- Preguntas cortas, sobre lo que se acaba de enseñar y no sobre el conjunto del programa.
- La corrección disponible en cuanto se entrega el quiz, para que el participante se vaya con la retroalimentación y no solo con una nota.
- Las salidas de pantalla y el copia y pega detectados y señalados, para que el resultado mida a la persona. La página de supervisión detalla qué se detecta y qué no.
- Un segundo intento abierto a distancia dos semanas más tarde, para todos, con la mejor de las dos notas retenida. Si ninguna nota puede entrar en la media, la variante estrictamente sin nota conserva lo esencial: el paso obligatorio y la retroalimentación inmediata.
- Las estadísticas pregunta por pregunta releídas antes de la sesión siguiente: la tasa de acierto de cada pregunta dice qué quedó claro y qué falta retomar.
- Las notas enviadas a tu LMS si llevas ahí la cuenta, mediante la integración existente, sin volver a teclearlas.
Tres recursos completan este artículo. La página formativo y evaluación continua describe la configuración del lado del producto. El artículo sobre cómo estructurar eficazmente una formación muestra dónde colocar estos puntos de control en un recorrido completo. Y el caso de estudio de Gianluca Quercini, profesor investigador en CentraleSupélec, muestra la misma lógica a otra escala: un cuestionario al final de cada sesión de prácticas, para 816 estudiantes repartidos en 32 grupos, supervisado por cada docente de prácticas, contado en un webinar de la ANSTIA.
Preguntas frecuentes
No necesariamente. Una evaluación formativa sirve para ajustar el aprendizaje mientras ocurre, no para certificar un nivel, y una nota que sanciona el primer intento desplaza la atención hacia la nota en lugar de hacia los errores. Si lleva nota, una regla preserva su función: quedarse con la nota más alta de los dos intentos, para que equivocarse en clase no cueste nada.
¿Se puede hacer obligatoria una evaluación que no lleva nota?
Sí, siempre que la obligación recaiga sobre el acto y no sobre el resultado. En mis clases de la ESSEC, el quiz de fin de sesión lo tiene que hacer todo el mundo, pero la nota que se retiene es la mejor de los dos intentos, uno en el aula y otro abierto a distancia dos semanas más tarde. El intento en clase no puede penalizar, y cada uno se enfrenta a lo que realmente ha entendido sin la presión de una nota que cuenta.
Prepara unas cuantas preguntas cortas sobre lo que se acaba de enseñar, para responder al final o al principio de la sesión, con la corrección disponible en cuanto se entrega el quiz. Haz obligatorio el paso por el quiz, abre un segundo intento a distancia dos semanas más tarde y quédate con la mejor de las dos notas. Después relee las tasas de acierto pregunta por pregunta antes de la sesión siguiente.
Hace visible, tanto para el docente como para quien aprende, la distancia entre lo que se ha seguido y lo que realmente se sabe. Sirve para decidir qué repasar del lado de quien aprende, y qué retomar del lado del curso. Tiene además un efecto directo sobre la memorización, porque ponerse a prueba retiene mejor que releer.
Sí, pero no por la misma razón que un examen final. Sin salvaguardas, un participante responde fuera del quiz, con un asistente conversacional, y se va con una nota que no dice nada de lo que sabe. Detectar las salidas de pantalla y el copia y pega, y señalarlos en pantalla, basta para que la medida recaiga sobre la persona.