Refuerzo continuo
Publicado
La idea básica
Pregunte a cualquiera que tenga un perro y seguramente admitirá que utiliza incentivos, como una golosina, para enseñarle trucos. Levanta la pata de su perro, dice "sacuda" y realiza un movimiento de sacudida exagerado, antes de colmar a su perro de elogios exagerados y una golosina. Después de hacer esto repetidamente durante unos meses, se dará cuenta de que su perro le dará la mano aunque no le dé golosinas. El aprendizaje de un nuevo comportamiento de este modo se explica por el refuerzo continuo.
El refuerzo continuo es el refuerzo repetido de un comportamiento cada vez que se produce. Puede consistir en un refuerzo positivo (añadir un estímulo) o negativo (eliminar un estímulo), con el objetivo de fomentar determinadas acciones.
El refuerzo continuo es uno de los dos tipos fundamentales de esquemas de refuerzo. Es más eficaz cuando se utiliza en las fases iniciales del aprendizaje para establecer una asociación sólida entre un comportamiento determinado y sus consecuencias.1 El segundo esquema, el refuerzo parcial, refuerza un comportamiento deseado de forma ocasional. Este esquema puede ser predecible o impredecible.
Cuando el refuerzo se produce cada vez que se muestra un comportamiento deseado, se pueden establecer asociaciones fácilmente, lo que permite aprender con rapidez. Sin embargo, en algunos casos los beneficios del refuerzo continuo tienen un límite. Su perro puede ser menos propenso a estrecharle la mano cuando ha comido demasiado. La extinción del comportamiento aprendido puede materializarse rápidamente cuando cesa el refuerzo.2
La forma en que se lleva a cabo el refuerzo positivo es más importante que la cantidad.
-Burrhus Frederic Skinner, psicólogo estadounidense
Términos clave
Refuerzo: Consecuencia que se aplica para fomentar un determinado comportamiento con el fin de aumentar la probabilidad de que se repita.
Refuerzo continuo: Tipo de aprendizaje que refuerza un comportamiento deseado cada vez que se produce.
Refuerzo parcial: Tipo de aprendizaje que refuerza ocasionalmente un comportamiento deseado después de que se produzca, como elogiar a un alumno cada dos por tres cuando responde correctamente a una pregunta.
Extinción: Proceso que describe una conducta deseada que disminuye con el tiempo, normalmente como resultado de que ya no se ofrece refuerzo.
Condicionamiento clásico: Técnica de aprendizaje que asocia inconscientemente un estímulo con una respuesta conductual automática. Cuando el estímulo se repite, la respuesta conductual automática acaba aprendiendo a asociarse con ese estímulo.3
Condicionamiento operante: Técnica de aprendizaje que emplea refuerzos positivos y negativos en forma de recompensas o castigos para animar a un individuo a adoptar o abandonar un comportamiento específico. A veces se denomina condicionamiento instrumental.3
Historia
El uso temprano de la palabra "refuerzo" se remonta a principios del siglo XX, cuando Ivan Pavlov, un fisiólogo ruso, exploró vagamente su impacto en el fortalecimiento del condicionamiento. A diferencia de la definición actual, Pavlov utilizaba la palabra para describir el fortalecimiento de la asociación de un estímulo incondicionado y otro condicionado cuando se presentaban juntos. Pavlov descubrió el condicionamiento clásico, un tipo de aprendizaje que implica un refuerzo continuo.4
Los estudios realizados por Edward Thorndike a principios del siglo XX también apuntaban a la idea del refuerzo. Thorndike desarrolló la Ley del Efecto tras realizar un experimento que consistía en colocar gatos hambrientos en una caja rompecabezas y observar sus intentos de encontrar una recompensa alimenticia. Thorndike se dio cuenta de que los gatos acababan aprendiendo a repetir comportamientos eficaces que les permitían escapar más rápido.5
La Ley del Efecto de Thorndike afirma que es más probable que los organismos repitan un comportamiento si va seguido de una consecuencia agradable, mientras que es menos probable que los organismos repitan un comportamiento si va seguido de una consecuencia desagradable. Los descubrimientos de Thorndike contribuyeron al desarrollo del conductismo y el condicionamiento operante.
El psicólogo estadounidense Burrhus Frederic Skinner llevó más lejos las ideas de Thorndike y Pavlov al investigar el refuerzo y su papel en el condicionamiento operante. En su libro de 1938, El comportamiento de los organismos, Skinner explicaba que el refuerzo, como el elogio verbal, tras mostrar un determinado comportamiento puede aumentar la probabilidad de que éste se repita en el futuro.
Partiendo de sus ideas, Skinner reconoció que el comportamiento tiende a reforzarse varias veces. Junto con el psicólogo estadounidense Charles Ferster, realizó nuevos análisis para investigar las formas en que se podía organizar el refuerzo a lo largo del tiempo. Esto condujo a la articulación formal del refuerzo continuo en su libro de 1957, Schedules of Reinforcement. La influyente publicación de Skinner y Fester esbozaba dos tipos de programas de refuerzo: el refuerzo continuo y el refuerzo parcial. Los autores esbozaron además cuatro programas de refuerzo parcial: de relación fija, de relación variable, de intervalo fijo y de intervalo variable.6 Hoy en día, los programas de refuerzo de Skinner y Chester siguen siendo relevantes, con importantes implicaciones en campos como la educación, la gestión y el marketing.
Personas
Ivan Pavlov
Fisiólogo ruso famoso por su descubrimiento del condicionamiento clásico. Los descubrimientos de Pavlov influyeron en la configuración del conductismo como una importante escuela de pensamiento en psicología. Pavlov fue uno de los primeros en utilizar la palabra "refuerzo" para describir una herramienta que puede facilitar el aprendizaje. Al darse cuenta de la importancia de su descubrimiento del condicionamiento clásico, Pavlov pasó el resto de su carrera estudiando este tipo de aprendizaje.7
Edward Thorndike
Conocido por su desarrollo de la Ley del Efecto,8 este psicólogo estadounidense también fue profesor en el Teachers College de la Universidad de Columbia. La Ley del Efecto de Thorndike tuvo implicaciones influyentes en la teoría del refuerzo y el conductismo.
Burrhus Frederic Skinner
Psicólogo y conductista estadounidense conocido comúnmente como el padre del condicionamiento operante. Skinner explora la idea del refuerzo en numerosas ocasiones en sus primeras publicaciones. El libro de Skinner de 1957, Schedules of Reinforcement, introdujo formalmente el concepto de refuerzo continuo y otros tipos de programas de refuerzo.9 Esta publicación fue muy influyente a la hora de dar forma a nuestra comprensión del refuerzo en el aprendizaje humano.
Consecuencias
El refuerzo continuo tiene importantes implicaciones en el aprendizaje humano, el desarrollo del lenguaje y el desarrollo moral.3 En el aprendizaje humano, el refuerzo continuo ha contribuido al desarrollo de la economía de fichas. La economía de fichas es un sistema basado en fichas que refuerzan continuamente determinados comportamientos. Estas fichas pueden canjearse por recompensas u otros reforzadores. Debido a sus rápidos efectos, este sistema se ha aplicado a niños y pacientes psiquiátricos.10
Los padres suelen utilizar variaciones informales de la economía de fichas para conseguir que los niños sigan ciertas normas, ya sea hacer la cama cada mañana, no robar la comida de su hermano o dar las gracias al conductor del autobús. Para crear una economía de fichas atractiva, los padres identifican un puñado de estos comportamientos para recompensarlos. Entregar físicamente al niño una ficha, moneda o pegatina cada vez que realice este comportamiento crea un efecto tangible inmediato, una forma de refuerzo continuo. Una vez que el niño ha reunido un determinado número de fichas, puede canjearlas por recompensas, como poder elegir la cena o quedarse despierto hasta tarde.10
El refuerzo continuo también tiene efectos beneficiosos para moldear el rendimiento de las habilidades y extinguir comportamientos no deseados en un entorno educativo. Los alumnos que muestran comportamientos no óptimos, como llegar tarde o distraer en clase, pueden ser tratados ignorándolos por el profesor, en lugar de ser reforzados atrayendo su atención.10
Controversias
En nuestra vida cotidiana, el refuerzo continuo no aparece tan a menudo como el refuerzo parcial. Imaginemos que recibimos una recompensa por acudir todos los días al trabajo. La recompensa acaba perdiendo su atractivo, y en lugar de ser una recompensa satisfactoria, la pérdida de la recompensa puede convertirse en un refuerzo negativo mayor. El refuerzo continuo aparece con menos frecuencia, ya que requiere más esfuerzo para mantenerlo sistemáticamente, lo que puede resultar poco realista a largo plazo.2
El refuerzo continuo también aparece con menos frecuencia, ya que presenta deficiencias que se abordan mejor con otros esquemas de refuerzo. Lo más importante es que la investigación ha demostrado que el refuerzo continuo hace que los sujetos respondan más lentamente a las recompensas que cuando se utilizan esquemas de refuerzo parcial. El refuerzo continuo también tiene una alta tasa de extinción. Cuando se interrumpe este programa de refuerzo, la respuesta desaparece más rápidamente que cuando se interrumpe un programa de refuerzo parcial. Esto se debe a que el sujeto abandona cuando se da cuenta de que ya no recibe una recompensa.2
Aunque el refuerzo continuo tiene sus ventajas a corto plazo, muchos prefieren la lenta tasa de extinción de los programas de refuerzo parcial a la hora de enseñar conductas a largo plazo. Los programas de refuerzo parcial son menos predecibles y más realistas de mantener, lo que proporciona un proceso mucho más atractivo durante un período de tiempo más largo.2
Estudio de caso
Refuerzo continuo y redes sociales
Junto con el refuerzo parcial, el refuerzo continuo desempeña un papel clave en la adicción a las redes sociales. Si recibimos "me gusta" o visitas a nuestras publicaciones, actuamos como una forma de refuerzo continuo. El refuerzo continuo hace que la persona aprenda a disfrutar acumulando "me gusta" o visitas.
Una vez aprendido este concepto, los programas de refuerzo parcial pueden influir aún más en esta adicción y evitar su rápida extinción. Esto puede observarse cuando un individuo se da cuenta de que una publicación recibe más "me gusta" de lo habitual. La recompensa extra actúa como una forma de refuerzo parcial. Dado que este refuerzo parcial es impredecible, anima a publicar más mensajes, ya que el individuo no sabe si el siguiente mensaje, o los dos siguientes, tendrán como resultado el refuerzo placentero de más "me gusta".11
El refuerzo continuo a corto plazo, combinado con el refuerzo parcial a largo plazo, son sólo dos de los muchos factores que pueden explicar la adicción de un individuo a las redes sociales.
Contenido TDL relacionado
Refuerzo positivo: Este artículo de The Decision Lab explora las consecuencias y controversias del refuerzo positivo, una herramienta clave del condicionamiento operante que tiene efectos significativos en el aprendizaje humano.
¿Por qué trabajamos más cuando nos prometen una recompensa?: Los incentivos pueden ser una poderosa herramienta para motivar a las personas a realizar una determinada acción, pero también pueden resultar contraproducentes, provocando una disminución de la motivación propia en lugar de aumentarla. Este artículo explora las implicaciones de la incentivación en nuestro comportamiento.
Teoría del refuerzo: ¿Por qué los niños tienden a repetir conductas cuando se les recompensa con pegatinas y caritas sonrientes en nuestra hoja de ejercicios? Este artículo explora la teoría del refuerzo con más detalle, observando sus principales consecuencias y críticas.
Conductismo: El refuerzo continuo es sólo uno de los muchos conceptos surgidos del conductismo, una teoría y escuela de psicología muy influyente. Lea este artículo de TDL para saber más sobre este movimiento y sus protagonistas.
Fuentes
- Hulac, D., Benson, N., Nesmith, M. C., & Wollersheim Shervey, S. (2016). Uso de programas de refuerzo de intervalo variable para apoyar a los estudiantes en el aula: Una introducción con ejemplos ilustrativos. Journal of Educational Research and Practice, 6(1). https://doi.org/10.5590/jerap.2016.06.1.06
- Cherry, K. (2005, 8 de noviembre). Horarios de refuerzo y cómo funcionan. Verywell Mind. https://www.verywellmind.com/what-is-a-schedule-of-reinforcement-2794864#:~:text=En%20el%20reforzamiento%2C%20continuo%2C%20el%20deseado,entre%20el%20comportamiento%20y%20la%20respuesta.&text=Los%20programas%20de%20reforzamiento%20continuo%20son%20mayores,para%20enseñar%20un%20comportamiento%20nuevo.
- Cherry, K. (2021, 20 de febrero). Historia y conceptos clave de la psicología conductual. Verywell Mind. https://www.verywellmind.com/behavioral-psychology-4157183#a-brief-history-of-behaviorism
- Pavlov, I. P. (1928). Conferencias sobre los reflejos condicionados: Veinticinco años de estudio objetivo de la actividad nerviosa superior (comportamiento) de los animales. (W. H. Gantt, Trans.). Liverwright Publishing Corporation. https://doi.org/10.1037/11081-000
- Condicionamiento operante | Psicología sin límites. (s.f.). Lumen Learning - Producción sencilla de libros. https://courses.lumenlearning.com/boundless-psychology/chapter/operant-conditioning/
- Ferster, C. B., y Skinner, B. F. (1957). Schedules of reinforcement. Appleton-Century-Crofts. https://doi.org/10.1037/10627-000
- Mcleod, S. (2018). Estudio de los perros de Pavlov y condicionamiento pavloviano explicado. Simply Psychology. https://www.simplypsychology.org/pavlov.html#:~:text=Como%20muchos%20grandes%20avances%20científicos,el%20condicionamiento%20clásico)%20fue%20descubierto%20accidentalmente.&text=Durante%20la%201890s%2C%20fisiólogo%20ruso,en%20respuesta%20a%20ser%20alimentado.
- Thorndike, E. L. (1927). La ley del efecto. The American Journal of Psychology, 39, 212-222. https://doi.org/10.2307/1415413
- Ferster, C. B., y Skinner, B. F. (1957). Schedules of reinforcement. Appleton-Century-Crofts. https://doi.org/10.1037/10627-000
- Mcleod, S. (2007, 5 de febrero). Condicionamiento operante (B.F. Skinner). Guías de estudio para estudiantes de Psicología - Simplemente Psicología. https://www.simplypsychology.org/operant-conditioning.html#sch
- Grieve, R. (2016, 25 de julio). El poder de las recompensas y por qué las buscamos. The Conversation. https://theconversation.com/the-power-of-rewards-and-why-we-seek-them-out-62691



