Volver al blog
Psicología

Un estudiante de 22 años repitió el experimento de Ebbinghaus y la curva del olvido se sostuvo

1 de junio de 2026 11 min de lectura

Ilustración generada con GPT Image.
Ilustración generada con GPT Image.

La curva del olvido tiene el estatus de un adorno de manual: un trazo que se desploma y luego se aplana, atribuido a un alemán del siglo diecinueve que habría trabajado con un solo sujeto, él mismo. La lectura implícita es que un resultado así pertenece a la historia de las ideas más que a la ciencia verificable.

Dos detalles refuerzan la sospecha. Hermann Ebbinghaus es en efecto a la vez el experimentador y el único sujeto. Y el primer estado de su trabajo, fechado en 1880, no es una publicación: es el manuscrito que deposita para su habilitación, el Urmanuskript, que quedó inédito y se publicó en alemán solo en 1983, en Passavia Universitätsverlag, en Passau. El libro, Über das Gedächtnis, aparece en Leipzig, en Duncker, en 1885. La traducción inglesa, Memory: A Contribution to Experimental Psychology, llega en 1913, firmada por Henry A. Ruger y Clara E. Bussenius para el Teachers College de Columbia.

A finales de 2011, un investigador de la Universidad de Ámsterdam y su estudiante hicieron lo que mejor zanja un debate de este tipo. Repitieron el experimento.

Qué midió Ebbinghaus, exactamente

El texto de 1913 expone el protocolo sin ambigüedad. Las investigaciones sobre el olvido caen en el año 1879-1880 y comprenden 163 ensayos dobles. Cada ensayo doble consiste en aprender ocho series de 13 sílabas, es decir 104 sílabas, y volver a aprenderlas al cabo de un plazo fijado. El aprendizaje continúa hasta dos recitaciones seguidas sin fallo. Treinta y ocho de esos ensayos dobles, realizados entre las 11 y las 12 del mediodía, solo tenían seis series.

El material es el dispositivo de control que hace posible la medición: unas 2.300 sílabas sin significado, construidas colocando una vocal o un diptongo entre dos consonantes, mezcladas y luego extraídas al azar. Ebbinghaus sí probó otros materiales, pero sus razones para descartarlos no son las que se le atribuyen. Las series de cifras, escribe, resultaron impracticables porque sus elementos de base eran demasiado pocos y se agotaban demasiado rápido. En cuanto a los cantos del Don Juan de Byron, que aprendió de memoria, no le dieron una dispersión de las medidas mayor que la de las sílabas. Lo que reivindica para su material no es, por tanto, la ausencia de variabilidad, sino la homogeneidad, la reserva inagotable de combinaciones nuevas y la posibilidad de variar limpiamente la longitud.

Los siete intervalos se enuncian en la página 66: alrededor de un tercio de hora, una hora, nueve horas, un día, dos días, seis días, treinta y un días. Los valores realmente medidos se apartan un poco de esas etiquetas, ya que la tabla final recoge 0,33 horas, 1 hora, 8,8 horas y luego 24, 48, 6 por 24 y 31 por 24 horas. La medida no es una puntuación de recuerdo, sino el ahorro de trabajo en el reaprendizaje, expresado en porcentaje del tiempo del primer aprendizaje, descontado el tiempo de recitación. La tabla da 58,2 y después 44,2, 35,8, 33,7, 27,8, 25,4 y 21,1 por ciento, con errores probables de la media de 1 en los tres primeros puntos, y luego 1,2, 1,4, 1,3 y 0,8. El número de ensayos por punto no es constante: 12, 16, 12, 26, 26, 26 y 45 para el punto de los treinta y un días. Ebbinghaus corrige además sus tiempos según la hora de la sesión: los valores de final de la mañana se reducen alrededor de un 5 por ciento y los de las 18 a las 20 horas alrededor de un 12 por ciento, porcentajes que estima sobre otras series y detalla en su texto. Murre y Dros, que leen el manuscrito de 1880, dan un 13 por ciento para la corrección de la tarde. Recuerdan también que tenía veintinueve años.

Ámsterdam, invierno de 2011

Jaap Murre y Joeri Dros presentan su replicación a PLOS ONE el 22 de noviembre de 2014. Se acepta el 25 de enero de 2015 y aparece el 6 de julio de 2015 con la referencia PLoS ONE 10(7): e0120644. El segundo autor, J. Dros, de 22 años, es el único sujeto. Como en Ebbinghaus, el sujeto es también autor, con la diferencia de que aquí el protocolo lo lleva un tercero. El experimento fue examinado y aprobado por la comisión de control del departamento de psicología de la Universidad de Ámsterdam, expediente 2014-BC-3879.

La fase de entrenamiento va del 8 al 29 de noviembre de 2011: 14 listas aprendidas y reaprendidas veinte minutos después, seguidas de 19 listas aprendidas sin reaprendizaje, para absorber el efecto de familiarización. La fase experimental va del 1 de diciembre de 2011 al 13 de febrero de 2012, que los autores cuentan como 75 días. En ella se aprenden y reaprenden sesenta y nueve listas, diez por intervalo salvo nueve para el intervalo de nueve horas. El total de recogida ronda las 70 horas.

El material retoma la estructura de origen: 70 listas de 104 sílabas, ocho filas de 13. Las sílabas son de tipo consonante vocal consonante, construidas sobre la fonotáctica del neerlandés, retirando las que tenían demasiado sentido, un filtrado que Ebbinghaus no aplicaba. Las filas se recitan a 150 pulsaciones por minuto, cadencia tomada de Ebbinghaus, con una repetición que dura 5,2 segundos de media y quince segundos de pausa entre dos filas. El criterio de parada cambia: una recitación correcta en lugar de dos, la opción que el propio Ebbinghaus había adoptado en su segunda campaña, en 1883-1884, al juzgar que el primer método solo cumplía su función de forma incompleta. No es la única desviación, y los autores las enumeran: diez listas por intervalo en lugar de 12 a 45, ninguna hora de sesión fija allí donde Ebbinghaus probaba sus cuatro intervalos más largos en tres momentos del día, un ritmo de recitación en yambos y no en tres tiempos, y un calendario de aprendizaje del que, en Ebbinghaus, se ignora qué aspecto tenía más allá de las nueve horas. Un control verifica que el sorteo no sesgó el reparto: el número medio de repeticiones en el primer aprendizaje no difiere significativamente según el intervalo, F(6, 69) = 0,691, p = 0,658. Los datos brutos están depositados en el Open Science Framework, en osf.io/6kfrp.

Las cuatro curvas

La comparación no es entre dos curvas, sino entre cuatro. Incluye una replicación anterior, la de Heller, Mack y Seitz, publicada en 1991 en la Zeitschrift für Psychologie, volumen 199, páginas 3 a 18, con dos sujetos cuyos datos se recogen por separado. Las puntuaciones de ahorro puestas una al lado de otra dan, para Ebbinghaus: 0,582, 0,442, 0,358, 0,337, 0,278, 0,254, 0,211. Para Mack: 0,544, 0,432, 0,285, 0,316, 0,365, 0,309, 0,258. Para Seitz: 0,442, 0,325, 0,270, 0,270, 0,286, 0,205, 0,201. Para Dros: 0,472, 0,373, 0,276, 0,317, 0,230, 0,168, 0,041.

El juicio de los autores es explícito: teniendo en cuenta las diferencias individuales esperables, encuentran notable el parecido de los cuatro gráficos. Más de ciento treinta años separan la primera serie de la última, la lengua del material no es la misma y, una vez normalizadas las curvas sobre su primer punto, los trazos se solapan en gran medida.

La única desviación clara es el punto de Dros a los treinta y un días: 0,041 frente a 0,211 de Ebbinghaus. Los autores no lo ocultan, pero tampoco lo zanjan. Escriben que solo pueden especular, y plantean tres vías. Puede que este sujeto olvide más a largo plazo. Las listas del intervalo largo se aprendieron todas al principio del periodo, por falta de tiempo disponible, es decir en aprendizaje masivo allí donde los demás intervalos estaban repartidos. Y el tiempo de aprendizaje derivó al alza a lo largo de los 75 días, a razón de 2,67 segundos por día y por lista, con una regresión lineal que explica el 56,18 por ciento de la varianza. Corregida esa deriva, la puntuación a los treinta y un días sube a 0,137, que sigue quedando muy por debajo de las otras tres. Una cuarta hipótesis, el número de listas intercaladas entre aprendizaje y reaprendizaje, se pone a prueba y se descarta: solo da cuenta de alrededor del 8,4 por ciento de la varianza.

El punto de las veinticuatro horas

La replicación no se limita a confirmar. Vuelve sobre un punto que Ebbinghaus había visto y no había sabido clasificar.

En su propia curva, el ahorro pasa del 35,8 por ciento a las 8,8 horas al 33,7 por ciento a las veinticuatro horas. La caída casi se interrumpe. Ebbinghaus se explica largamente. Cifra el descenso en 2,5 puntos en el tramo de 9 a 24 horas y en 6,1 puntos en el de 24 a 48 (su propia tabla da más bien 2,1 y 5,9), y considera poco creíble que se pierda alrededor del triple en el segundo. Sobre todo, contempla explícitamente el sueño como causa y lo descarta: aun suponiendo que la noche frene claramente el borrado, la forma obtenida no le parece sostenerse. Concluye que uno de los tres valores debe estar afectado por el azar, supone que el 33,7 es uno o dos puntos demasiado alto, luego se desdice, porque unas observaciones que presenta a continuación lo confirman, y se declara en la duda.

Esas observaciones vienen de la campaña de 1883-1884: siete ensayos de nueve series de 12 sílabas, reaprendidas al cabo de veinticuatro horas, dan un 33,4 por ciento. Frente a 33,7. El propio Ebbinghaus subraya que las dos cifras proceden de periodos alejados y de investigaciones muy distintas, lo que hace la coincidencia aún más llamativa. El punto se sostiene. Murre y Dros leen esa secuencia como una desconfianza lo bastante fuerte como para justificar una contraprueba, algo que Ebbinghaus, por su parte, no dice en esos términos.

En 1924, Jenkins y Dallenbach interpretan la anomalía como un efecto del sueño, y eso es lo que les lleva a montar su estudio sobre el olvido durante el sueño y durante la vigilia, aparecido en el American Journal of Psychology. Murre y Dros formalizan la intuición: añaden a la función potencial un término de realce constante, aplicado solo a los intervalos de un día o más. En los cuatro conjuntos de datos, la varianza explicada media pasa del 98,7 al 99,1 por ciento, la suma de los cuadrados de las desviaciones de 0,00932 a 0,00628, y el criterio de información de Akaike de menos 22 a menos 23,6. La amplitud del repunte vale 0,030 en Ebbinghaus y 0,131 en Mack.

Los autores se mantienen prudentes, y conviene seguirlos. Ellos mismos califican esos resultados de dispares, y dicen que una diferencia de AIC de 1,6 de media puede llamarse, como mucho, una tendencia hacia una diferencia que contaría, con grandes diferencias entre sujetos. Los datos de Dros no muestran ningún repunte, y sus ajustes están probablemente arrastrados por ese punto tan bajo de los treinta y un días. Y atribuir el repunte al sueño exigiría, escriben, otros experimentos. La conclusión publicada dice exactamente eso: la curva sí ha sido replicada, no es perfectamente lisa y muy probablemente muestra un salto hacia arriba a partir del punto de las veinticuatro horas.

Por qué se sostuvo la versión decorativa

El calendario es casi insolente. La replicación aparece el 6 de julio de 2015. Menos de dos meses después, el 28 de agosto, Science publica el informe de la Open Science Collaboration, referencia 349(6251): aac4716. Sobre 100 estudios de psicología repetidos, experimentales y correlacionales, aparecidos en 2008 en tres revistas, el 97 por ciento de los originales mostraba un resultado estadísticamente significativo, frente al 36 por ciento de las replicaciones, y los efectos replicados tenían la mitad de la amplitud de los efectos de origen.

La comparación es tentadora y exige una precaución, porque las dos pruebas no miden lo mismo. La Open Science Collaboration juzga una reproducción sobre todo por la significación estadística de un efecto, mientras que Murre y Dros comparan la forma de una curva descriptiva, punto por punto, sin contraste de hipótesis central. Una medida de 1880 obtenida por un hombre solo sobre sí mismo no pasa, por tanto, el mismo examen que los cien estudios de 2008. Pasa otro, y lo pasa.

Queda que Murre y Dros apuntan en el haber de Ebbinghaus, en su observación final, una lista de prácticas que la psicología tardó un siglo en volver estándar: material de estimulación controlado, contrabalanceo de los efectos de la hora del día, protección frente a la parada opcional, análisis estadístico de los datos y modelización. El contrabalanceo merece un matiz. Ebbinghaus sí probó sus cuatro intervalos más largos en tres momentos del día, pero para los intervalos cortos corrigió a posteriori, con porcentajes estimados sobre otras series. Heller y sus coautores, en cambio, pudieron fijar sus horarios, no encontraron ningún efecto de la hora del día y no aplicaron ninguna corrección.

Queda también por explicar por qué la curva siguió siendo un decorado. Existía una replicación desde 1991, la de Heller, Mack y Seitz. Estaba en alemán, sin resumen en inglés, ausente de la web en el momento en que Murre y Dros escriben, y nunca citada en una revista internacional en lengua inglesa. La prueba estaba disponible y era invisible. El propio Ebbinghaus invitaba a la prudencia: este enunciado y la fórmula en que se apoya, escribe, no tienen más valor que el de un resumen de resultados obtenidos una sola vez y en las circunstancias descritas, y no puede decir, a estas alturas, si otras circunstancias u otros individuos les darían otras constantes. Han hecho falta 70 horas de sílabas sin pies ni cabeza, un invierno neerlandés y ciento treinta y un años para empezar a responderle. Tres sujetos más no hacen una población, pero hacen algo mejor que una leyenda de manual.

¿Un proyecto del mismo estilo?

Diseño y despliego productos como este. Hablemos.

Hablemos