Renforcement continu

Publié

L'idée de base

Demandez à n'importe quel propriétaire de chien et il vous avouera certainement qu'il utilise des incitations, comme une friandise, pour apprendre des tours à son chien. Vous levez la patte de votre chien, dites "secoue" et faites un mouvement de secousse exagéré, avant de le couvrir d'éloges et de lui donner une friandise. Après avoir répété ce geste pendant quelques mois, vous vous rendez compte que votre chien vous serre la main même si vous ne lui donnez pas de friandises. L'apprentissage d'un nouveau comportement de cette manière s'explique par le renforcement continu.

Le renforcement continu est le renforcement répété d'un comportement à chaque fois qu'il se produit. Il peut s'agir d'un renforcement positif (ajout d'un stimulus) ou négatif (suppression d'un stimulus), dans le but d'encourager certaines actions.

Le renforcement continu est l'un des deux types fondamentaux de programmes de renforcement. Il est le plus efficace lorsqu'il est utilisé dans les premiers stades de l'apprentissage afin de mettre en place une association forte entre un certain comportement et ses conséquences.1 Le second schéma, le renforcement partiel, renforce un comportement souhaité de manière occasionnelle. Ce schéma peut être prévisible ou imprévisible.

Lorsque le renforcement se produit à chaque fois qu'un comportement souhaité est manifesté, des associations peuvent être facilement faites, ce qui permet d'apprendre rapidement. Toutefois, dans certains cas, les avantages du renforcement continu sont limités. Votre chien sera peut-être moins enclin à vous serrer la main s'il a trop mangé. L'extinction du comportement appris peut se matérialiser rapidement lorsque le renforcement cesse.2

“

La manière dont le renforcement positif est effectué est plus importante que la quantité.


-Burrhus Frederic Skinner, psychologue américain

Termes clés

Renforcement : Une conséquence appliquée pour encourager un certain comportement afin d'augmenter les chances qu'il se reproduise.

Renforcement continu : Un type d'apprentissage qui renforce le comportement souhaité à chaque fois qu'il se produit.

Renforcement partiel : Un type d'apprentissage qui renforce occasionnellement un comportement souhaité après qu'il se soit produit, comme féliciter un élève une fois sur deux lorsqu'il répond correctement à une question.

Extinction : Processus décrivant la diminution d'un comportement désiré au fil du temps, généralement en raison de l'arrêt du renforcement.

Conditionnement classique : Technique d'apprentissage qui associe inconsciemment un stimulus à une réponse comportementale automatique. Lorsque le stimulus est répété, la réponse comportementale automatique finit par être associée à ce stimulus.3

Conditionnement opérant : Technique d'apprentissage qui utilise des renforcements positifs et négatifs sous forme de récompenses ou de punitions pour encourager un individu à adopter ou à cesser un comportement spécifique. Il est parfois appelé conditionnement instrumental.3

L'histoire

Les premières utilisations du mot "renforcement" remontent au début des années 1900, lorsque Ivan Pavlov, un physiologiste russe, a vaguement exploré son impact sur le renforcement du conditionnement. Contrairement à la définition actuelle, Pavlov utilisait le mot pour décrire le renforcement de l'association d'un stimulus inconditionnel et d'un stimulus conditionné lorsqu'ils sont présentés ensemble. Pavlov a ensuite découvert le conditionnement classique, un type d'apprentissage qui implique un renforcement continu.4

Les études menées par Edward Thorndike au début des années 1900 ont également suggéré l'idée du renforcement. Thorndike a développé la loi de l'effet après avoir mené une expérience consistant à placer des chats affamés dans une boîte à puzzle et à observer leurs tentatives pour trouver une récompense alimentaire. Thorndike s'est rendu compte que les chats finiraient par apprendre à répéter des comportements efficaces qui leur permettraient de s'échapper plus rapidement.5

La loi de l'effet de Thorndike stipule que les organismes sont plus susceptibles de répéter un comportement s'il est suivi d'une conséquence agréable, tandis que les organismes sont moins susceptibles de répéter un comportement s'il est suivi d'une conséquence désagréable. Les découvertes de Thorndike ont contribué au développement du behaviorisme et du conditionnement opérant.

Le psychologue américain Burrhus Frederic Skinner a approfondi les idées de Thorndike et de Pavlov en étudiant le renforcement et son rôle dans le conditionnement opérant. Dans son livre de 1938, The Behavior of Organisms, Skinner explique que le renforcement, tel que l'éloge verbal, après la manifestation d'un certain comportement peut augmenter la probabilité que ce comportement soit répété à l'avenir.

S'appuyant sur ses idées, Skinner a reconnu que les comportements ont tendance à être renforcés plusieurs fois. En collaboration avec le psychologue américain Charles Ferster, une analyse plus poussée a été réalisée afin d'étudier les moyens d'organiser le renforcement dans le temps. Ces travaux ont abouti à la formulation formelle du renforcement continu dans leur livre de 1957, Schedules of Reinforcement. L'ouvrage influent de Skinner et Fester décrit deux types d'horaires de renforcement : le renforcement continu et le renforcement partiel. Les auteurs ont également défini quatre schémas de renforcement partiel : les schémas à rapport fixe, à rapport variable, à intervalle fixe et à intervalle variable.6 Aujourd'hui, les schémas de renforcement de Skinner et Chester restent pertinents et ont d'importantes implications dans des domaines tels que l'éducation, la gestion et le marketing.

Les personnes

Ivan Pavlov

Physiologiste russe réputé pour sa découverte du conditionnement classique. Les découvertes de Pavlov ont contribué à faire du béhaviorisme une école de pensée majeure en psychologie. Pavlov a été l'un des premiers à utiliser le mot "renforcement" pour décrire un outil pouvant faciliter l'apprentissage. Après avoir réalisé l'importance de sa découverte sur le conditionnement classique, Pavlov a consacré le reste de sa carrière à l'étude de ce type d'apprentissage.7

Edward Thorndike

Réputé pour avoir développé la loi de l'effet8, ce psychologue américain était également enseignant au Teachers College de l'université de Columbia. La loi de l'effet de Thorndike a eu des répercussions importantes sur la théorie du renforcement et le behaviorisme.

Burrhus Frederic Skinner

Psychologue et comportementaliste américain communément appelé le père du conditionnement opérant. Skinner explore l'idée de renforcement à de nombreuses reprises dans ses premières publications. Son livre de 1957, Schedules of Reinforcement, introduit formellement le concept de renforcement continu et d'autres types de calendriers de renforcement.9 Cette publication a eu une grande influence sur notre compréhension du renforcement dans l'apprentissage humain.

Conséquences

Le renforcement continu a des implications importantes dans l'apprentissage humain, le développement du langage et le développement moral.3 Dans l'apprentissage humain, le renforcement continu a contribué au développement de l'économie des jetons. L'économie des jetons est un système qui repose sur des jetons qui renforcent en permanence certains comportements. Ces jetons peuvent ensuite être échangés contre des récompenses ou d'autres renforçateurs. En raison de ses effets rapides, ce système a été appliqué aux enfants et aux patients psychiatriques.10

Les variantes informelles de l'économie des jetons sont couramment utilisées par les parents pour inciter les enfants à respecter certaines règles, qu'il s'agisse de faire leur lit tous les matins, de s'abstenir de voler la nourriture de leurs frères et sœurs ou de dire merci au chauffeur de bus. Pour créer une économie de jetons attrayante, les parents identifient une poignée de ces comportements à récompenser. Le fait de remettre à l'enfant un jeton, une pièce de monnaie ou un autocollant chaque fois qu'il adopte ce comportement crée un effet tangible immédiat, une forme de renforcement continu. Après avoir accumulé un certain nombre de jetons, l'enfant peut les échanger contre des récompenses telles que la possibilité de choisir son dîner ou de se coucher tard.10

Le renforcement continu a également des effets bénéfiques sur l'acquisition de compétences et l'élimination de comportements indésirables dans un environnement éducatif. Les élèves qui affichent des comportements sous-optimaux, tels que les retards ou les distractions en classe, peuvent être ignorés par l'enseignant, au lieu d'être renforcés en attirant l'attention de l'enseignant.10

Controverses

Dans notre vie quotidienne, le renforcement continu n'apparaît pas aussi souvent que le renforcement partiel. Imaginez que vous receviez une récompense pour être présent au travail tous les jours. La récompense finit par perdre de son attrait et, au lieu d'être une récompense satisfaisante, la perte de la récompense peut devenir un renforcement négatif plus important. Le renforcement continu apparaît moins souvent car il nécessite plus d'efforts pour être maintenu systématiquement, ce qui peut s'avérer irréaliste à long terme.2

Le renforcement continu apparaît également moins souvent, car il présente des lacunes qui sont mieux prises en compte par d'autres schémas de renforcement. Plus important encore, la recherche a montré que le renforcement continu fait que les sujets réagissent plus lentement aux récompenses que lorsqu'on utilise des schémas de renforcement partiels. Le renforcement continu présente également un taux élevé d'extinction. L'arrêt de ce schéma de renforcement entraîne la disparition de la réponse plus rapidement que lors de l'arrêt d'un schéma de renforcement partiel. En effet, le sujet abandonne lorsqu'il se rend compte qu'il ne reçoit plus de récompense.2

Bien que le renforcement continu présente des avantages à court terme, nombreux sont ceux qui préfèrent le rythme lent d'extinction des programmes de renforcement partiel lorsqu'il s'agit d'enseigner des comportements à long terme. Les programmes de renforcement partiel sont moins prévisibles et plus réalistes à maintenir, offrant un processus beaucoup plus engageant sur une plus longue période de temps.2

Étude de cas

Renforcement continu et médias sociaux

Avec le renforcement partiel, le renforcement continu joue un rôle clé dans l'addiction aux médias sociaux. Si nos posts reçoivent des "likes" ou des vues, ils agissent comme une forme de renforcement continu. Le renforcement continu permet à l'individu d'apprendre à aimer accumuler les "likes" ou les vues.

Une fois ce concept assimilé, des programmes de renforcement partiel peuvent influencer davantage cette dépendance et empêcher une extinction rapide. C'est ce que l'on observe lorsqu'une personne remarque qu'un message reçoit plus de "j'aime" que d'habitude. La récompense supplémentaire agit comme une forme de renforcement partiel. Comme ce renforcement partiel est imprévisible, il incite à publier davantage de messages, car l'individu ne sait pas si le prochain message, ou les deux prochains messages, se traduiront par le renforcement agréable d'un plus grand nombre de "likes".11

Le renforcement continu à court terme, combiné au renforcement partiel à long terme, ne sont que deux des nombreux facteurs qui peuvent expliquer la dépendance d'un individu aux médias sociaux.

Contenu connexe de TDL

Renforcement positif : Cet article du Decision Lab explore les conséquences et les controverses concernant le renforcement positif, un outil clé du conditionnement opérant qui a des effets significatifs sur l'apprentissage humain.

Pourquoi travaillons-nous plus dur lorsqu'on nous promet une récompense ? Les incitations peuvent être un outil puissant pour motiver les gens à entreprendre une certaine action, mais elles peuvent aussi se retourner contre eux, entraînant une baisse de leur motivation au lieu de l'augmenter. Cet article explore les implications de l'incitation sur notre comportement.

Théorie du renforcement : Pourquoi les enfants ont-ils tendance à répéter leurs comportements lorsqu'ils sont récompensés par des autocollants et des smileys sur notre feuille de travail ? Cet article explore plus en détail la théorie du renforcement, en observant les principales conséquences et critiques de cette théorie.

Le béhaviorisme : Le renforcement continu est l'un des nombreux concepts issus du béhaviorisme, une théorie et une école de psychologie très influentes. Lisez cet article de la TDL pour en savoir plus sur ce mouvement et ses principaux acteurs.

Sources d'information

  1. Hulac, D., Benson, N., Nesmith, M. C. et Wollersheim Shervey, S. (2016). L'utilisation de calendriers de renforcement à intervalles variables pour soutenir les élèves en classe : An introduction with illustrative examples. Journal of Educational Research and Practice, 6(1). https://doi.org/10.5590/jerap.2016.06.1.06
  2. Cherry, K. (2005, 8 novembre). Les calendriers de renforcement et leur fonctionnement. Verywell Mind. https://www.verywellmind.com/what-is-a-schedule-of-reinforcement-2794864#:~:text=Dans%20continue%20reinforcement%2C%20the%20desired,between%20the%20behavior%20and%20response.&text=Continuous%20reinforcement%20schedules%20are%20most,to%20teach%20a%20new%20behavior
  3. Cherry, K. (2021, 20 février). Histoire et concepts clés de la psychologie comportementale. Verywell Mind. https://www.verywellmind.com/behavioral-psychology-4157183#a-brief-history-of-behaviorism
  4. Pavlov, I. P. (1928). Conférences sur les réflexes conditionnés : Vingt-cinq ans d'étude objective de l'activité nerveuse supérieure (comportement) des animaux. (W. H. Gantt, Trans.). Liverwright Publishing Corporation. https://doi.org/10.1037/11081-000
  5. Conditionnement opérant | Boundless psychology. (n.d.). Lumen Learning - Simple Book Production. https://courses.lumenlearning.com/boundless-psychology/chapter/operant-conditioning/
  6. Ferster, C. B. et Skinner, B. F. (1957). Schedules of reinforcement. Appleton-Century-Crofts. https://doi.org/10.1037/10627-000
  7. Mcleod, S. (2018). L'étude des chiens de Pavlov et le conditionnement pavlovien expliqués. Simply Psychology. https://www.simplypsychology.org/pavlov.html#:~:text=Comme%20beaucoup%20de%20grandes%20avancées%20scientifiques,%20le%20conditionnement classique)%20a%20été%20découvert%20par%20accident.&text=Durant%20les%201890s%2C%20physiologiste%20russe,en%20réponse%20à%20l'alimentation%20d'un%20chien.
  8. Thorndike, E. L. (1927). The law of effect. The American Journal of Psychology, 39, 212-222. https://doi.org/10.2307/1415413
  9. Ferster, C. B. et Skinner, B. F. (1957). Schedules of reinforcement. Appleton-Century-Crofts. https://doi.org/10.1037/10627-000
  10. Mcleod, S. (2007, 5 février). Le conditionnement opérant (B.F. Skinner). Guides d'étude pour les étudiants en psychologie - Simply Psychology. https://www.simplypsychology.org/operant-conditioning.html#sch
  11. Grieve, R. (2016, 25 juillet). Le pouvoir des récompenses et pourquoi nous les recherchons. The Conversation. https://theconversation.com/the-power-of-rewards-and-why-we-seek-them-out-62691

Read Next

Notes illustration

Vous souhaitez savoir comment les sciences du comportement peuvent aider votre organisation ?