Les quatre cadrans du conditionnement opĂ©rant, leurs dĂ©finitions exactes, et surtout la thĂšse qui traverse tout le module : on se sert des quatre. Se limiter Ă un ou deux, câest se priver dâoutils et se retrouver dĂ©muni le jour oĂč la situation dĂ©passe la friandise.
Renforcement, punition, positif, négatif
Les définitions
Un renforcement est la consĂ©quence dâun comportement qui rend plus probable sa reproduction. Une punition est la consĂ©quence dâun comportement qui rend moins probable sa reproduction.
Lâun comme lâautre peut ĂȘtre positif (ajout dâun stimulus agissant sur lâorganisme) ou nĂ©gatif (retrait dâun stimulus). Attention au piĂšge de vocabulaire : positif et nĂ©gatif ne signifient pas agrĂ©able et dĂ©sagrĂ©able, mais ajout et retrait.
DâoĂč les quatre cadrans, formulĂ©s proprement :
- R+ : la frĂ©quence du comportement augmente par ajout dâun stimulus appĂ©titif. Exemple, une rĂ©compense, des fĂ©licitations.
- R- : la frĂ©quence augmente par retrait dâun stimulus aversif. Exemple, la levĂ©e dâune contrainte ou dâune douleur.
- P+ : la frĂ©quence diminue par ajout dâun stimulus aversif.
- P- : la frĂ©quence diminue par retrait dâun stimulus appĂ©titif, dâun privilĂšge, dâun droit.
Retenez la mécanique globale : avec les renforcements, la réponse augmente en fréquence et en intensité ; avec les punitions, elle diminue.
Les quatre cadrans sur un seul exercice
Lâexemple de la marche en laisse suffit Ă tout dĂ©montrer. Le chien marche Ă la jambe, vous donnez une friandise : R+. Il vous dĂ©passe, vous vous immobilisez : P-. Vous mettez un Ă -coup sur la laisse : P+. Il marche, la laisse est dĂ©tendue, il nây a plus dâĂ -coup : R-.
Maintenant regardez une sĂ©ance rĂ©elle. Le chien tire, vous mettez un Ă -coup et vous faites demi-tour : P+. Au bout de quelques allers-retours, ne comprenant pas encore, il sâimmobilise, et vous vous arrĂȘtez avec lui : P-. Puis il finit par se trouver au niveau de votre jambe, et vous rĂ©compensez : R+. Trois cadrans sur la mĂȘme action, sans effort et sans conflit, et le quatriĂšme Ă©tait disponible.
Pourquoi il est absurde de les opposer
Lâusage veut quâon range P+ et R- dâun cĂŽtĂ©, R+ et P- de lâautre, et quâon se batte entre camps. Câest une erreur, et une erreur coĂ»teuse pour le chien.
La limite du tout-R+ est facile Ă voir : le jour oĂč la stimulation extĂ©rieure vaudra plus que votre rĂ©compense, le chien partira. Il aura appris que rester Ă la jambe est agrĂ©able quand il ne se passe rien, pas que partir est interdit. Si en revanche il sait que partir est interdit, que marcher Ă la jambe est la bonne rĂ©ponse, et quâen plus la bonne rĂ©ponse est rĂ©compensĂ©e, vous obtenez un chien Ă©quilibrĂ©.
La limite du tout-punition est aussi nette : des chiens anxieux, peureux, fragiles, des comportements dĂ©gradĂ©s, et surtout la fin de la collaboration. Passer son temps Ă punir est une Ă©norme erreur. Passer son temps Ă rĂ©compenser en est une autre : le chien nâapprend alors ni la frustration, ni le renoncement, ni les autocontrĂŽles, ni ses propres limites.
Si le chien Ă©tait bĂȘte, un seul cadran suffirait. Il est intelligent, alors mettez-vous Ă son niveau et servez-vous des quatre.
LâefficacitĂ© comparĂ©e
Une phrase Ă connaĂźtre, et Ă peser. Du point de vue de lâapprentissage, les renforcements ont une efficacitĂ© supĂ©rieure aux punitions. Et lâapprentissage par renforcement nĂ©gatif sâinstalle plus vite et rĂ©siste mieux Ă lâextinction que lâapprentissage par renforcement positif.
Autrement dit, le chien apprend plus vite ce quâil nâa pas le droit de faire que ce quâil a le droit de faire, et cet acquis-lĂ est plus solide. La conclusion pratique nâest pas de tout miser sur ce registre : câest que sans mĂ©langer les deux, vous Ă©duquerez pendant des annĂ©es sans jamais obtenir ce que vous voulez.
La sĂ©quence la plus efficace est simple : quand un mauvais comportement diminue jusquâĂ disparaĂźtre, renforcez par-dessus le bon comportement qui lâa remplacĂ©. Le chien apprend plus vite et comprend beaucoup mieux.
Renforçateurs primaires et secondaires
La distinction et son instabilité
Un renforçateur primaire rĂ©pond directement Ă un besoin essentiel : la nourriture. Un renforçateur secondaire ne le devient quâaprĂšs un apprentissage prĂ©alable : le jeu, par exemple.
Ce classement nâest pas figĂ©, et câest le point important. Nos chiens domestiques sont nourris Ă heure fixe, souvent trop : ils nâont plus besoin de chercher leur nourriture, et la valeur de ce renforçateur primaire baisse dans leur Ă©chelle. Ă lâinverse, une balle rarement disponible, qui rĂ©pond Ă des patrons moteurs, peut passer devant la nourriture toujours prĂ©sente.
Corollaire Ă ne jamais oublier : plus le renforçateur a de valeur, plus lâapprentissage ou le dĂ©sapprentissage est rapide. Un chien privĂ© de nourriture pendant une semaine verra celle-ci redevenir un renforçateur primaire, ce qui nâest Ă©videmment pas un protocole mais une illustration du principe.
Nâayez jamais de mode de rĂ©compense préétabli
Chaque renforçateur a une valeur diffĂ©rente selon les chiens ; le contexte, lâenvironnement et les apprentissages antĂ©rieurs font bouger les paramĂštres.
Un chien abandonnĂ©, qui a vĂ©cu dehors, nâa jamais rien partagĂ© avec un humain : sâacharner Ă jouer au boudin avec lui ne mĂšnera nulle part. En revanche il a probablement manquĂ© de nourriture, et si celle-ci ne le rend pas fou, elle devient un levier extraordinaire. SymĂ©triquement, un chien gavĂ© de friandises par ses prĂ©cĂ©dents apprentissages a besoin quâon passe Ă autre chose. Un chien qui nâa pas confiance en la vie se travaille au contraire Ă la caresse et Ă la voix, progressivement.
Les renforcements sociaux (fĂ©licitations, caresse, contact) ont une propriĂ©tĂ© rare : chez beaucoup de chiens, ils subissent moins dâattĂ©nuation que les autres, Ă condition que le lien soit fort. MĂ©fiez-vous cependant du gavage de caresses : caresser tout le temps et pour tout banalise le geste, et sur un couple maĂźtre-chien un peu fragile, la caresse finit par ne plus rien valoir.
Notez enfin le principe de Premack : tout comportement Ă forte frĂ©quence peut servir de renforçateur Ă un autre comportement. Câest ce qui permet de dresser un chien Ă la recherche de stupĂ©fiants : chercher nâa aucun intĂ©rĂȘt pour lui, mais retrouver donne accĂšs au jouet prĂ©fĂ©rĂ©, et lâactivitĂ© sans intĂ©rĂȘt devient passionnante.
Ăchappement et Ă©vitement
Le renforcement négatif en détail
Un stimulus aversif est un stimulus dont lâanimal veut sâĂ©loigner, ou qui provoque du mal-ĂȘtre, de la douleur ou de la peur. Câest lâopposĂ© du stimulus appĂ©titif. Un renforcement nĂ©gatif est un stimulus aversif qui disparaĂźt, ou nâapparaĂźt pas, Ă la suite dâune rĂ©ponse, ce qui augmente la probabilitĂ© de cette rĂ©ponse.
Le manuel donne un exemple : apprendre au chien un lieu de couchage en lâagressant chaque fois quâil se couche ailleurs, et en le laissant tranquille quand il choisit le bon endroit. Câest efficace, on ne peut pas prĂ©tendre le contraire, et câest exactement ce quâil ne faut pas faire. Les consĂ©quences sont la dĂ©tĂ©rioration, voire la destruction de la relation. Un chien Ă©levĂ© ainsi ne cherchera plus la rĂ©ponse auprĂšs de son maĂźtre le jour oĂč il aura peur : il ira mordre.
Ăchappement
Le stimulus aversif est prĂ©sent, et la rĂ©ponse permet de sây soustraire, en gĂ©nĂ©ral par la fuite. Il commence Ă pleuvoir, le chien se rĂ©fugie dans sa niche : rĂ©ponse dâĂ©chappement. Il a pris la pluie.
Ăvitement
Le stimulus aversif nâest pas encore lĂ , mais un signal permet de lâanticiper et dâempĂȘcher quâil ne survienne. Il ne pleut pas encore, le tonnerre gronde, le troupeau gagne le couvert des arbres. Câest un processus dâanticipation, qui sâinstalle gĂ©nĂ©ralement aprĂšs lâĂ©chappement, une fois quâun ou plusieurs stimuli discriminatifs ont Ă©tĂ© appris. Tant que le chien nâa pas compris comment sâĂ©chapper, il ne peut pas installer dâĂ©vitement.
Les évitements que le chien construit contre vous
Câest ici que se joue une grande partie de votre travail de terrain.
Le mĂ©canisme de base : un chien a peur dâun humain, il cherche Ă fuir, ça ne marche pas, alors il grogne, et lâhumain recule. Bingo, il a trouvĂ© la solution. Le jour oĂč le grognement ne suffit plus, dans une ruelle Ă©troite par exemple, il mord, et il constate que ça fonctionne encore mieux. DâoĂč la rĂšgle : quand on ne sait pas faire, on ne fait pas. Si vous nâĂȘtes pas certain de vos compĂ©tences face Ă un chien rĂ©actif, ne lâapprochez pas. Et reculer de cinq mĂštres Ă chaque grognement âpour respecter sa zone de confortâ, câest confirmer au chien que sa solution marche.
MĂȘme chose dans les familles. Un maĂźtre Ă qui on apprend Ă manipuler physiquement son chien en permanence obtiendra tĂŽt ou tard un grognement, qui marchera neuf fois sur dix, et ensuite tout le monde a peur du chien. Câest lĂ quâon comprend lâintĂ©rĂȘt du dressage, mot qui dĂ©plaĂźt Ă certains : mettre des mots sur des situations (âreculeâ, puis on ouvre la porte) Ă©vite de manipuler le chien, Ă©vite de lâattraper au collier, Ă©vite de le mettre en position de combat.
Le cas vĂ©tĂ©rinaire est le classique Ă connaĂźtre. Le chien est tenu fermement sur la table dâexamen, il se dĂ©bat, grogne, montre les dents et mord ; le praticien renonce Ă lâinjection et prescrit un comprimĂ©. Ă la visite suivante, le chien est immĂ©diatement agressif : dĂšs que les signaux associĂ©s (le cabinet, la table, lâodeur) sont prĂ©sents, il produit la conduite qui a supprimĂ© la piqĂ»re. Il Ă©vite.
La rĂ©ponse Ă cela est lâapprentissage de la museliĂšre pour tous les chiens : un apprentissage, pas un mode de vie, fait bien avant et loin du vĂ©tĂ©rinaire. Le chien arrive alors muselĂ© aprĂšs une balade banale, sans quâon ait besoin de le serrer, sans pression, sans que tout le monde sente la peur, et lâinjection se fait tranquillement. Un chien qui a mal peut mordre de douleur, ce nâest pas sa faute ; mais un chien quâon ne peut plus soigner finit par ne plus ĂȘtre soignĂ© du tout.
Les associations dâidĂ©es, et ce quâelles coĂ»tent
Le chien associe toujours le contexte complet : situation, odeur, agissement, résultat. Cela produit aussi des dégùts involontaires.
Lâexemple type : un chiot de deux mois Ă qui on met un Ă -coup pour le faire marcher Ă la jambe, alors quâil est bien trop jeune pour comprendre lâexercice. Si une voiture passe Ă cet instant, il nâassociera pas lâĂ -coup Ă sa position, dont il ne sait rien, mais Ă la voiture. MĂȘme mĂ©canisme avec un chien, un humain, un chat qui passerait au mauvais moment. Câest ainsi quâon fabrique des chiens rĂ©actifs.
DâoĂč la mĂ©thode dâanalyse : ne restez pas sur la problĂ©matique visible, remontez le cheminement. En comprenant comment lâassociation sâest faite, vous pouvez lâinverser.
Deux usages, lâun Ă proscrire, lâautre valable
Le contre-exemple, tirĂ© du manuel : pour apprendre le rapport dâobjet, le conducteur pince lâoreille du chien en disant âprendsâ ; le chien gĂ©mit, entrouvre la gueule, on y place lâobjet, et le pincement cesse. Le chien apprend par renforcement nĂ©gatif Ă Ă©viter le pincement. Ăa marche, et câest Ă bannir : cela dĂ©truit prĂ©cisĂ©ment ce que le rapport dâobjet doit construire, le partage, la rĂ©ponse Ă des patrons moteurs, un lien fort.
Lâusage acceptable, Ă lâinverse : un chien qui connaĂźt parfaitement le rappel et ne revient pas. Longe, rappel, pas de retour, Ă -coup sur la longe ; pour Ă©viter lâĂ -coup, il reviendra au premier appel. Ce type de solution nâest envisageable que si lâordre est rĂ©ellement installĂ©, si lâorganisation familiale est en place, et donc si le chien peut interprĂ©ter son non-retour comme une dĂ©sobĂ©issance.
Un mot sur le matĂ©riel, dans le mĂȘme esprit. Un collier Ă©trangleur mal utilisĂ© dĂšs le dĂ©part, Ă grands coups dâĂ©tranglement, est presque impossible Ă rattraper : dans une famille oĂč cela sâest passĂ© ainsi, retirez-le, mettez un collier plat et interdisez-en lâusage. Ce nâest pas une position de principe contre lâoutil, câest une position contre les sĂ©vices dans lâapprentissage. On peut ĂȘtre ferme et intransigeant avec ceux qui font nâimporte quoi sans pour autant se ranger dans un camp.
Rien nâest jamais interdit par principe, du moment que câest pour le bien-ĂȘtre du chien et du maĂźtre : si lâun des deux est malheureux, ça ne fonctionne pas.