חיזוק דיפרנציאלי — DRO, DRA, DRI: איך להפסיק לחזק בטעות
מאת אייל קליין · קריאה של 8 דקות
אתם לא צריכים להיות מאלפים כדי להשתמש בחיזוק דיפרנציאלי. אתם עושים את זה כל יום. כשהכלב שוכב בשקט לרגליכם ואתם נותנים לו ליטוף - חיזקתם שכיבה על חשבון תנועה. כשהכלב נובח ואתם מסתכלים עליו - חיזקתם נביחה. כשאתם נותנים חטיף על שתיקה - חיזקתם שתיקה. אתם כל הזמן מחזקים התנהגויות, בין אם אתם יודעים את זה ובין אם לא. ההבדל היחיד בין מאלף לבעלים הוא שהמאלף יודע איזה התנהגות הוא מחזק ולמה.
חיזוק דיפרנציאלי הוא בדיוק זה: לחזק התנהגויות מסוימות ולהפסיק לחזק התנהגויות אחרות. לא סלקטיביות, לא להעניש - פשוט להחליט איזה התנהגות מקבלת את תשומת הלב, האוכל, או החופש, ואיזה לא. זה עקרון פשוט, אבל כמו הרבה דברים באילוף, הביצוע הוא המורכב. כי אם זה היה באמת קל, לא היו כלבים שמנביחים שעה על הגדר.
מה זה חיזוק דיפרנציאלי
חיזוק דיפרנציאלי הוא משפחה של פרוטוקולים, לא טכניקה אחת. כל הגרסאות עובדות על אותו עיקרון: אתם מחזקים התנהגות אחת ולא מחזקים (או מחזקים פחות) התנהגות אחרת. ההבדל בין הגרסאות הוא מה בדיוק אתם מחזקים במקום ההתנהגות הבעייתית.
חשוב להבין: חיזוק דיפרנציאלי לא מלמד את הכלב מה *לא* לעשות. הוא מלמד אותו מה *כן* לעשות. בעונש, אתם בעצם אומרים לכלב "תפסיק". בחיזוק דיפרנציאלי, אתם מראים לו "עשה את זה במקום".
המחקר על חיזוק דיפרנציאלי רחב מאוד. פרוטוקולים של DRO/DRA נבדקו מאות פעמים בספרות של מנתחי התנהגות, והתוצאות עקביות: חיזוק דיפרנציאלי הוא אחת השיטות היעילות ביותר לשינוי התנהגות, במיוחד כשהוא משולב עם הכחדה של ההתנהגות הבעייתית. אבל יש מלכודת נסתרת, והיא נקראת רגרסנס (resurgence).
DRO - חיזוק על העדר התנהגות
DRO, או Differential Reinforcement of Other Behavior, הוא הפשוט ביותר במשפחה: אתם מחזקים כל התנהגות חוץ מההתנהגות הבעייתית. זה לא משנה מה הכלב עושה - כל עוד הוא לא עושה את מה שאתם רוצים להפסיק, הוא מקבל חיזוק.
דוגמה: כלב שקופץ על אורחים. הכניסה היא הרגע הכי מרגש ביום שלו, והוא קופץ כי קפיצה = תשומת לב. ב-DRO, קובעים: כל 5 שניות שהכלב לא קופץ - חטיף. לא משנה אם הוא יושב, עומד, שוכב, או סתם מסתכל עליכם - כל עוד ארבע רגליים על הרצפה, הוא מקבל חיזוק. הוא לומד: קפיצה לא עובדת, שקט על הרצפה כן עובד.
DRO עובד מהר כי הוא לא דורש מכם להחליט איזו התנהגות *בדיוק* אתם רוצים לראות. כל מה שזה לא נביחה - נכנס. אבל החולשה של DRO היא בדיוק החוזק שלו: הוא לא מלמד את הכלב מה לעשות במקום. הוא רק מחזק "לא לעשות". וזה אומר שברגע שמפסיקים את ה-DRO, ההתנהגות הבעייתית חוזרת במלוא העוצמה.
בשטח, DRO עובד הכי טוב במקום שההתנהגות הבעייתית היא מתחת ל-threshold. דוגמה: כלב שמקבץ ליד השולחן בזמן האוכל. אתם לא נותנים לו תשומת לב, חטיף, או אוכל מהצלחת. במקום זה, אתם קובעים מרווח של דקה, ואם הוא לא קבצן במשך הדקה - חטיף במיטה שלו. הוא לומד במהירות: המיטה = חטיפים, הקבצנות = כלום. DRO פותח את הדלת, אבל הוא לא הבית.
DRA - חיזוק על התנהגות חלופית
DRA, או Differential Reinforcement of Alternative Behavior, הוא העבודה השוטפת של רוב המאלפים. במקום לחזק סתם "לא לעשות", אתם בוחרים התנהגות חלופית ספציפית ומחזקים אותה. הכלב יכול עדיין לבצע את ההתנהגות הבעייתית (DRA לא דורש אי-תאימות פיזית), אבל אתם משקיעים כל כך הרבה בחיזוק ההתנהגות החלופית, עד שהיא הופכת לבחירה הטבעית.
דוגמה: כלב שנובח על אנשים בחלון. הדרך הלא נכונה: לחכות שהוא ינבח ולתת חטיף כשהוא שותק. זה לא עובד כי כשהוא כבר נובח על החלון הוא מעל threshold ואוכל לא מעניין אותו. הדרך הנכונה: קודם מרחיקים אותו מהחלון עד לנקודה שבה הוא רואה מישהו אבל לא מגיב. שם, מלמדים אותו לבוא כשמישהו עובר, לקבל חטיף גדול. לאט לאט מקרבים לחלון. בהתחלה הוא עדיין מתרגש קצת, אבל החיזוק על החזרה אלי מתחרה בחיזוק של ההתרגשות. בשלב מסוים, הוא רואה מישהו ומסתכל אלי לחטיף במקום לנבוח. ה-DRA יצר התנהגות חלופית שמחליפה את התפקוד של הנביחה.
היתרון הגדול של DRA על פני DRO הוא עמידות. כש-DRA מבוסס על תקשורת פונקציונלית - כלומר, ההתנהגות החלופית נותנת לכלב בדיוק את אותו הדבר שההתנהגות הבעייתית נתנה לו - ההחלפה היא הרבה יותר יציבה. כלב שלומד לנבוח פעם אחת ולהסתכל עליכם במקום לנבוח 20 פעם ברצף לא יחזור לנבוח 20 פעם גם כשהחטיפים ייעלמו. הוא כבר למד דרך טובה יותר להשיג את מה שהוא רוצה.
DRI - חיזוק על התנהגות שאינה תואמת
DRI, Differential Reinforcement of Incompatible Behavior, דורש שההתנהגות שאתם מחזקים לא תוכל להתרחש בו-זמנית עם ההתנהגות הבעייתית. פיזית בלתי אפשרי. כלב לא יכול לקפוץ על אורחים ולשבת בו-זמנית. כלב לא יכול לנבוח עם צעצוע בפה ולנבוח בו-זמנית (נסו - זה נשמע מצחיק אבל לא עובד). כלב לא יכול למשוך ברצועה וללכת לצדכם בו-זמנית.
DRI דורש לדעת מראש איזו התנהגות בדיוק אתם רוצים, ולבנות היסטוריה חזקה של חיזוק לאותה התנהגות לפני שאתם מכניסים אותה למצב הבעייתי.
דוגמה: כלב שקופץ על אנשים בכניסה. אני לא מלמד אותו לשבת ברגע שהדלת נפתחת. קודם אני בונה היסטוריה של שכיבה-בכניסה במצבים רגועים, בלי דלת, בלי אורחים. אחר כך אני מוסיף דלת סגורה. אחר כך דלת שנפתחת. רק אחרי שהכלב יושב 9 מתוך 10 פעמים בתנאים קלים - אני מתחיל לעבוד עם אורחים אמיתיים. ואז, כשהוא קופץ, אני לא נותן לו חטיף על קפיצה (גם לא "די!" - תשומת לב היא חיזוק). אני מחכה שהוא יושב, ואז נותן לו חטיף וחופש לברך את האורח. הוא לא יכול לקפוץ ולשבת. DRI עושה את הבחירה עבורו.
איזה מהם לבחור
ההחלטה בין DRO, DRA ו-DRI תלויה במה הכלב עושה, מה אתם רוצים שיעשה במקום, וכמה זמן יש לכם.
DRO הוא המהיר ביותר להתחלה כי הוא לא דורש תכנון. אתם יכולים להתחיל DRO תוך 30 שניות: מזהים את ההתנהגות הבעייתית, מחכים לרגע שבו היא לא מתרחשת, נותנים חיזוק. הבעיה: DRO הוא הכי פחות עמיד. ברגע שאתם מפסיקים, ההתנהגות חוזרת כי הכלב לא למד שום דבר חדש.
DRA הוא הבחירה הנכונה ברוב המקרים. אתם צריכים לדעת מה ההתנהגות החלופית וממה הכלב מקבל חיזוק בהתנהגות הבעייתית, אבל אתם לא צריכים התנהגות סותרת פיזית. DRA גמיש, עמיד, ומתאים לרוב הבעיות השכיחות: נביחה, קפיצה, משיכה ברצועה, ריאקטיביות מול כלבים או אנשים.
DRI הוא הכי מדויק אבל גם הכי תובעני. הוא דורש התנהגות סותרת, היסטוריה חזקה של חיזוק, ותרגול בתנאים קלים לפני יישום בשטח. כשזה עובד, זה עובד הכי טוב. כשזה לא - כי לא בנו היסטוריה מספקת - אתם נשארים עם כלב שקופץ על אורחים ומאלף מתוסכל.
רגרסנס: המלכודת שכולם שוכחים
רגרסנס (resurgence) היא תופעה שבה התנהגות בעייתית שהוחלפה בהצלחה חוזרת ברגע שהחיזוק להתנהגות החלופית מפסיק. כלומר: עשיתם DRA מושלם. הכלב למד לשבת ליד הדלת במקום לקפוץ. שלושה חודשים של אורחים שנכנסים בלי בעיה. ואז, יום אחד, אתם שוכחים את החטיפים. ומה קורה? לא סתם שכחה - הכלב קופץ פי שלושה, מהר יותר, ובהתמדה שלא ראיתם מאז שהתחלתם לעבוד על זה. לא בגלל שהוא "רשע". בגלל שההתנהגות הישנה קיבלה חיזוק במשך שנים. ההתנהגות החדשה קיבלה חיזוק במשך שלושה חודשים. כשהחיזוק נעלם, ההתנהגות עם ההיסטוריה הארוכה יותר חוזרת.
המחקר של Jones (2020, Northern Michigan University) בדק רגרסנס בכלבים באופן שיטתי. חמישה כלבים השתתפו בניסוי. ארבעה קיבלו אימון DRA מלא, הראו החלפה מושלמת, ואז החיזוק הופסק - ורק אחד הראה רגרסנס ברור. אבל הכלב החמישי, שלקחו אותו מהחיים האמיתיים (בעיה אמיתית של קבצנות ליד השולחן), הראה רגרסנס בדיוק כמו שהספרות חזה: ברגע שהחיזוק לשכיבה במיטה הפסיק, הוא חזר לקבצן.
הממצא המרכזי: גודל הירידה בחיזוק הוא שמנבא רגרסנס, לא משך האימון (Greer et al., 2024, Journal of Applied Behavior Analysis). אם אתם דועכים לאט, צעד אחר צעד, הרגרסנס קטן. אם אתם קופצים ישירות מחטיף כל 30 שניות לאפס חטיפים - ההתנהגות הבעייתית תחזור כמו שהיא לא עזבה אף פעם.
בשטח, אני תמיד מפעיל חיזוק דיפרנציאלי עם תוכנית דעיכה מהיום הראשון. לא "נתחיל בתדירות גבוהה ונדעך אחר כך" - תוכנית דעיכה כתובה, עם צעדים ברורים, מהיום הראשון. ככה הרגרסנס קטן, ואם הוא קורה - אתם יודעים בדיוק באיזה צעד לעשות התאמה.
איך ליישם בבית
רוצים להתחיל חיזוק דיפרנציאלי בבית?
שלב ראשון: תפסו את הכלב עושה משהו טוב. ממש טוב. גם אם זה רק לשנייה. הוא שוכב בשקט? חטיף. הוא מסתכל על אורח בלי לנבוח? חטיף. הוא מטייל לידכם בלי למשוך? חטיף. תפסיקו לחכות לבעיה ותתחילו לחפש את ההזדמנות.
שלב שני: תפסיקו לחזק את הבעיה. פשוט, אבל כמעט בלתי אפשרי: תשומת לב היא חיזוק. "די!" היא חיזוק. מבט כועס הוא חיזוק. נגיעה בכלב בזמן שהוא נובח היא חיזוק. אם אתם רוצים שההתנהגות הבעייתית תיעלם, אתם חייבים להפסיק לחזק אותה. תפסיקו להגיב להתנהגות שאתם לא רוצים, תתחילו להגיב להתנהגות שאתם כן רוצים.
שלב שלישי: דעכו לאט. אל תעברו מחטיף כל 30 שניות לאפס. קבעו תוכנית: היום כל 30 שניות, מחר כל דקה, אחרי זה כל 2 דקות, אחרי זה חטיף אקראי כל 3-5 דקות. כל צעד חייב להיות קטן מספיק שהכלב יצליח. ואם הוא נכשל? חזרתם צעד אחד אחורה. אתם לא נכשלתם - אספת מידע.
אתם עושים חיזוק דיפרנציאלי כל יום, גם בלי שם מקצועי. עכשיו תעשו אותו במודע, ותכינו תוכנית דעיכה מהיום הראשון - ואז הוא באמת עובד לאורך זמן.
למה תדירות החיזוק כל כך קריטית
אחד הדברים שהכי קשה להעביר לבעלים הוא שהתדירות של החיזוק חשובה לפחות כמו סוג החיזוק. גודל הירידה בחיזוק הוא המשתנה היחיד שניבא רגרסנס באופן מובהק סטטיסטית. ככל שהקפיצה בתדירות גדולה יותר, כך הרגרסנס חזק יותר. זה לא משנה כמה שבועות עשיתם DRA מושלם - אם אתם קופצים ישירות מחטיף כל חצי דקה לאפס, אתם רואים רגרסנס.
המסקנה המעשית: דעיכה היא לא תוספת אופציונלית לאילוף. היא חלק בלתי נפרד מהפרוטוקול. כשאתם מתחילים DRA, אתם צריכים לדעת מה התדירות שבה אתם מתחילים, מה התדירות שבה אתם מסיימים, ובאיזה צעדים אתם מגיעים משם לשם.
בשביל כלב שקופץ על אורחים, תוכנית דעיכה יכולה להיראות ככה: היום הראשון, חטיף על כל ישיבה בכניסה, חטיף תוך שנייה מהישיבה. היום השלישי, חטיף על כל ישיבה שנייה. אחרי זה, חטיף אקראי פעם ב-3-5 ישיבות. אחרי זה, חטיפים רק אחרי שהאורח כבר נכנס. כל צעד נשאר עד שהכלב מצליח 8 מתוך 10 פעמים.
הטעויות הנפוצות בבית
הטעות הראשונה שאני רואה שוב ושוב: בעלים מחזקים את ההתנהגות הבעייתית מבלי לשים לב. כלב נובח, בעל אומר "די". החזקת את הנביחה. למה? כי תשומת לב, אפילו תשומת לב שלילית, היא עדיין חיזוק. כשילד צורח ואתם אומרים לו "שקט" - הוא צורח חזק יותר. זה לא כי הוא רע. זה כי תשומת הלב שלכם היא הדבר הכי מעניין שקורה כרגע.
הטעות השנייה: הם בוחרים התנהגות חלופית שלא נותנת לכלב את אותו הדבר. דוגמה קלאסית: כלב קופץ על אורחים בשביל תשומת לב. הבעלים מחליט ללמד אותו "לשבת" במקום לקפוץ, נותן חטיף על ישיבה. אבל הכלב עדיין לא מקבל תשומת לב מהאורח כשהוא יושב. הוא מקבל רק חטיף. אז מה הוא לומד? "אני יושב בשביל חטיף, ואז קופץ בשביל תשומת לב." ההתנהגות החלופית (ישיבה) לא מחליפה את החיזוק שהכלב קיבל מההתנהגות הבעייתית (תשומת לב). ה-DRA הזה לא עובד לא כי הכלב עקשן - אלא כי לא בניתם התנהגות חלופית שמספקת אותו צורך.
הטעות השלישית: שוכחים שהכחדה היא חלק מהמשוואה. חיזוק דיפרנציאלי עובד הכי טוב כשהוא משולב עם הכחדה של ההתנהגות הבעייתית. אבל הכחדה זה קשה. בהתחלה, ההתנהגות הבעייתית מתחזקת לפני שהיא נחלשת - זה נקרא extinction burst. כלב שנובח ומקבל תשומת לב, ומפסיק לקבל תשומת לב, ינבח פי שניים לפני שהוא מוותר. רוב הבעלים נשברים ברגע הזה. "זה לא עובד - עכשיו הוא רק נובח יותר." לא, זה עובד. אתם בעיצומו של extinction burst. תחזיקו מעמד עוד יומיים.
שאלות נפוצות על חיזוק דיפרנציאלי
צריכים עזרה בבניית תוכנית דעיכה שמתאימה לכלב שלכם? אייל קליין, 054-620-4368. אילוף כלבים ברמת השרון והסביבה.
*נכתב על ידי אייל קליין, מאלף כלבים*