← 토픽으로 돌아가기

Why your CORRECTIONS don’t work on your DOG

Why your CORRECTIONS don’t work on your DOG

개인 열람용 전문 번역 · 원문: https://www.youtube.com/watch?v=7IXl4qzsMa8 · 길이 34:34
원저작: Ben Hamilton (@hamiltondogtraining). 이 번역은 개인 학습용이며 원저작권은 원저작자에게 있다.

개를 끊임없이 교정(correct)하는 것 같은데도, 개가 여전히 목줄을 당기고, 다른 개들한테 짖고, 명령을 무시하고, 말을 안 듣는 것처럼 느껴지신 적 있나요? 이 영상에서는 왜 여러분의 교정이 안 통하는지 보여드리겠습니다. 그걸 고치기 위해 정확히 뭘 해야 하는지 알려드리고, 영상 내내 훈련 안 된 개들로 실제 예시를 보여드릴게요. 그래야 영상 끝에는 끊임없는 교정 없이도 말을 잘 듣는 예의 바른 개를 가질 수 있으니까요.

자, 간단한 연습부터 시작하죠. 여러분이 개를 교정하는 모든 가능한 것들을 나열해보세요. 목줄 당기기, 부르면 안 오기, 다른 개들한테 짖기, 엎드려 자세 깨기, 손님 오면 뛰어오르기, 장난감이나 물건을 안 놓기. 이 목록에 여러 가지가 있고, 여러분의 목록은 좀 다를 수도 있어요. 이제 아주 단순한 걸 해보세요. 한 줄 한 줄 짚어가면서, 왜 개를 교정하는지 말해보세요. 왜인지 말해보세요. 이 연습을 하면, 여러분의 답이 뚜렷이 구분되는 두 개의 통(bucket)으로 나뉜다는 결론에 도달하게 됩니다.

첫 번째 통, 이렇게 말하겠죠. "마일스, 저는 제 개가 뭔가를 하길 원해서 교정해요." 개한테 오라고 했는데 안 왔어요. 제가 원해서 교정했어요. 저한테 오길 원하는 거죠. 장난감을 놓길 원해요. 힐(heel) 자세를 유지하길 원해요. 제가 시킨 걸 하길 원해요. 개가 뭔가를 하길 원하는 겁니다. 두 번째 통은, 제 개가 뭔가를 그만하길 원해요. 목줄 당기기를 그만하길, 개들한테 짖는 걸 그만하길, 손님한테 뛰어오르는 걸 그만하길, 쓰레기 먹는 걸 그만하길, 야생동물 쫓는 걸 그만하길 원해요. 보세요, 여러분이 개를 교정할 수 있는 모든 것이 완전히 다른 두 개의 통에 들어갑니다. 섞이지 않아요. 완전히 별개의 것들입니다.

자, 이제 여러분의 개 훈련 패러다임을 완전히 깨부수고 더 명확하게 보게 해줄 아주 단순한 질문을 하나 하겠습니다. 교정(correction)이란 무엇인가? 교정이란 무엇인가? 정말 생각해보세요. 교정이란 무엇인가? 많은 분들이 "교정은 목줄로 개를 톡 치는 거예요. 전자목걸이(e-collar)로 찌릿하게 하는 거예요" 같은 말을 하겠죠. 바로 그게 이유입니다. 이 단어는 여러분의 어휘에서 삭제하고 다시는 이 단어를 쓰지 말아야 합니다. 설명할게요.

여러분이 이 단어를 써온 이유는, 개 트레이너들이 쓰는 걸 들었기 때문입니다. 유튜브의, 인스타그램의, 모두가요. 개를 교정하세요. 교정하세요. 교정. 교정. 개한테 교정을 주세요. 이 단어의 문제는, 이 두 개의 다른 통을 구분하지 못한다는 겁니다. 학습 이론(learning theory) 관점에서 이 두 가지는 서로 이보다 더 다를 수 없어요. 이걸 이해하셔야 합니다. 개 훈련 관점에서, 이 두 통 아래의 모든 행동을 다루는 방식은 서로 이보다 더 다를 수 없습니다. 완전히 다른 것들이에요. 그리고 문제는 이 단어, 이 '교정'이라는 단어입니다. 여러분은 이걸 이 모든 다른 것들에 뭉뚱그린 표현으로 적용해왔는데, 실제로는 완전히 별개예요.

그래서 이제 제가 할 건, 이 두 통의 차이를 이해하도록 돕는 겁니다. 그걸 이해하도록 도와줄 어휘를, 아주 단순하고 이해하기 쉬운 예시로 드리겠습니다. 그래야 실제로 가져가서 여러분 훈련에 적용할 수 있으니까요. 왜냐하면 이걸 보고 나면, 이걸 이해하고 나면, 개 훈련이 훨씬 명확해집니다. 여러분이 실제로 뭘 하고 있는지, 뭘 보고 있는지 이해하게 되니까요.

그래서 여기 정말 두 가지 별개의 일이 벌어지고 있어요. 여기 첫 번째 통은 부적 강화(negative reinforcement). 그리고 여기는 정적 처벌(positive punishment). 이게 우리가 방금 얘기한 이 두 뚜렷한 통의 실제 용어입니다. 아주 날카로우신 분들은 이미 아시겠지만, 이건 조작적 조건화(operant conditioning)의 네 사분면 중 두 개예요. 제 스웨트셔츠 뒤에 있는 게 그겁니다. 자, 제가 화이트보드에 단어를 쓴다고 겁먹으셨다면 걱정 마세요. 다 설명하겠습니다. 이해하고 나면 아주, 아주 단순해요. 예시도 드릴 거예요. 걱정 말고 저를 따라오세요.

조작적 조건화에서 정적(positive)과 부적(negative)은 그냥 더하거나 빼는 걸 의미합니다. 그게 다예요. 좋다 나쁘다를 의미하는 게 아니에요. 그냥 뭔가를 더하거나 뭔가를 빼는 걸 의미합니다. 그게 다예요. 그리고 강화(reinforcement)와 처벌(punishment)은 아주 단순해요. 강화는 그냥 행동이 증가한다는 뜻입니다. 다시 일어날 가능성이 더 커지는 거죠. 처벌은 그냥 행동이 감소한다는 뜻이에요. 다시 일어날 가능성이 더 작아지는 거죠. 그게 다입니다. 이해하고 나면 아주, 아주 단순해요. 지금은 단어가 많다는 거 압니다.

그럼 이제 각각을 정의해보죠. 여기 부적 강화가 있어요. 부적은 그냥 뭔가가 제거된다는 뜻이고, 강화는 그냥 행동이 증가한다는 뜻입니다. 그러니까 뭔가가 제거되고, 그게 행동의 빈도를 증가시키는 거예요. 걱정 마세요, 곧 예시를 드릴게요. 정적은 그냥 뭔가가 더해진다는 뜻이고, 처벌은 그냥 행동이 감소하는 거예요. 그래서 정적 처벌은 그냥 뭔가가 더해지고, 그게 행동의 빈도를 감소시키는 겁니다. 그게 다예요.

이제 각각에 대해 예시를 드릴게요. 인간 예시로 시작해서, 그다음 개 예시, 그다음 실제로 개한테 어떻게 실행하는지 보여드리겠습니다. 각각에 대해 그렇게 할 거예요. 부적 강화부터 시작하죠. 부적 강화는 행동의 빈도를 증가시키는 뭔가의 제거입니다. 인간 예시를 드릴게요. 차에 탔는데 안전벨트 매는 걸 깜빡했다고 상상해보세요. 무슨 일이 일어나죠? 딩딩딩딩딩딩딩딩. 아, 너무 짜증나. 너무 짜증나. 딸깍. 안전벨트를 매면 그 소리, 그 딩딩거리는 게 사라집니다. 그 혐오적 자극(aversive stimulus), 불편했던 것, 짜증났던 것, 싫었던 것이, 그 행동을 하면 사라져요. 다음에 차에 타면 뭘 하죠? 그냥 그런 일이 아예 안 일어나게 안전벨트를 매요. 그냥 그걸 피하는 거죠.

이게 부적 강화 학습의 두 부분입니다. 탈출(escape)과 회피(avoidance). 그래서 부적 강화는 때때로 '탈출·회피 학습'이라고도 불려요. 이게 무슨 뜻이냐면, 싫은 뭔가가 일어나고 있을 때, 불편하고, 혐오적이고, 싫은 뭔가가 일어나고 있을 때, 그걸 탈출할 수 있다는 겁니다. 뭔가를 함으로써 그걸 사라지게 할 수 있어요. 뭔가를 하면 그게 사라지죠. 그리고 미래에는 그냥 그걸 함으로써 그게 일어나는 걸 아예 피할 수 있습니다. 그게 안전벨트랑 똑같은 상황이에요.

다른 예시를 드릴게요. 해변에 간다고 상상해보세요. 덥고 화창한 날에요. 해변에 자주 안 가시잖아요. 해변에 도착했는데 이 멋진 하얀 모래가 있고, 햇빛이 모래에 내리쬐고, 모래에 발을 디뎌요. "세상에, 아무것도 안 보여, 너무 눈부셔서 아플 지경이야." 그럼 뭘 하죠? 주머니에 손을 넣어서 선글라스를 꺼내면, 사라져요. 그 행동, 선글라스 쓰기를 하면, 그 혐오적 자극이 사라집니다. 그걸 탈출하고 "오케이, 좋아. 자리를 찾자" 하죠. 모래를 걷는데 "세상에, 이 모래 뜨거워. 이 모래 뜨거워." 그럼 가방에 손을 넣어서 샌들을 꺼내 바닥에 던지고 신어요. 오, 완벽해. 훨씬 낫네. 혐오적 자극이 사라지고, 샌들 신기 행동을 하니까, 발이 타는 혐오적 자극이 사라져요. 그걸 탈출하는 거죠. 다음에 해변에 가면, 다음 주에 또 해변에 가면, 그냥 선글라스 쓰고 샌들 신고 도착해서 그걸 아예 피합니다.

여러분이 일상에서 하는 모든 것, 여러분이 수행하는 모든 행동을 보면, 다 어떤 식으로든 강화되고 있어요. 그래서 계속하는 거예요. 그리고 대부분의 경우 부적으로 강화됩니다. 나쁜 일이 일어나는 걸 피하려고 하는 거죠. 그래서 밖이 추우면 재킷을 입고 현관을 나서는 거예요. 그걸 배운 거죠. 집 안이 더우면, "아, 덥다" 하고 에어컨을 켜요. 그걸 배운 거죠. 목마르면 물을 마셔요. 그걸 배운 거죠. 이 일이 일어났을 때 뭔가 불편한 게 일어난다는 걸 배운 거예요. "아, 이거 싫어. 싫어. 싫어. 이걸 하니까 사라지네. 오, 완벽해. 다음엔 그냥 이걸 해서 그걸 아예 피해야지." 보세요, 그게 부적 강화 학습입니다.

여러분 자신의 행동에서, 주변 사람들의 행동에서 이걸 어디서나 보기 시작할수록, 여러분 개의 행동에 더 정확하게 영향을 줄 수 있게 됩니다. 그게 부적 강화예요. 탈출·회피 학습이죠. 이걸 보고 나서 세상 어디서나 이걸 보기 시작하시길 바랍니다. 어디서나 보이기 시작할 거예요. 그래서 간단히 말하면, 뭔가가 제거되고 행동이 증가하는 겁니다.

자, 이제 정적 처벌로 넘어가죠. 이건 완전히 달라요. 정적 처벌. 뭔가가 더해지고 행동이 감소합니다. 예시를 드릴게요. 고전적인 예시죠. 어릴 때 부엌에서 돕던 거 기억하시죠. 부엌에서 뭔가 하다가, 오븐에서 막 나와 뜨거운 팬을 실수로 잡았어요. 그걸 깜빡한 거죠. 그냥 잡았어요. 손이랑 손가락을 데었어요. 아프죠. 좋지 않아요. 아주, 아주 나빴어요. 다시는 그런 일이 안 일어나면 좋겠어요. 다음엔 뜨거운 팬을 안 만질 거예요. 뜨거울 때 팬 만지는 걸 피할 거예요.

자, 이게 차이입니다. 뭔가가 더해졌어요. 잡아서 데었죠. 고통이요. 그리고 그게 행동의 감소를 일으킵니다. 이제 저는 뜨거울 때 그 팬을 다시 잡을 가능성이 훨씬, 훨씬 작아졌어요. 그 결과를 피하려고 그 행동을 피할 겁니다. 보세요. 차이가 보이시죠? 이건, 나쁜 일이 일어나고 있는데 뭔가를 하면 사라지는 거예요. 이건, 뭔가를 하면 나쁜 일이 일어나는 거고요. 그러니까 나쁜 일이 일어나고 있는데 빠져나갈 길이 없어요. 미래에 그 결과를 피할 유일한 방법은, 그걸 초래한 그 행동을 피하는 것뿐입니다. 그게 차이예요.

다른 예시를 드릴게요. 여러분이 교실의 아이라고 해봅시다. 선생님이 반 아이들한테 이 문제의 답을 아는 사람 있냐고 물어요. 그리고 여러분은 "그래, 답을 아는 것 같아" 하고 손을 들어요. "알 것 같아요." 반 애들한테 답을 말했는데 완전히 틀렸고, 모두가 여러분을 비웃어서, 그 순간 아주 창피해요. 무슨 일이 일어났죠? 뭔가가 더해졌어요. 다른 애들의 웃음, 창피함이요. 무슨 일이 일어나죠? 여러분은 이제 그 행동, 손 들기를 반복할 가능성이 작아집니다. "답을 안다"고요. 다음엔 그럴 가능성이 작아지죠. 이게 예시예요. 이 예시에서 그 아이가 그 순간 혐오적 자극을 탈출할 방법이 없는 게 보이시죠? 차이가 보이시죠? 그걸 피할 유일한 방법은, 그 결과를 초래한 그 행동을 그냥 피하는 것뿐입니다. 그게 차이예요.

이 두 가지를 이해하기 시작하면, 그 효과를 보여드리려고 마지막 예시를 하나 더 드릴게요. 그다음 개 예시로 들어가겠습니다. 근데 다시, 많은 분들이 지금 댓글을 달고 계세요. 들려요. "아, 마일스, 예시 그만 좀 들고 요점만 말하고 개한테 어떻게 하는지 그냥 보여주세요." 형씨, 이걸 이해했으면 제가 이 영상을 만들 필요도 없었어요. 여러분은 인간 수준에서도 행동이 어떻게 작동하는지 이해 못 하는데, 개 수준은 말할 것도 없죠. 이건 전반적으로 다 똑같아요. 개에서도, 사람에서도 볼 수 있어야 합니다. 그러니까 다시, 이건 이해에 관한 거예요. 그냥 뭘 할지 보여주는 걸로 바로 건너뛰는 게 아닙니다. 바로 그게 애초에 여러분을 이 지경으로 만든 거예요.

자, 여담은 그만하고, 마지막 예시를 드릴게요. 출근길에 과속하고 있다고 상상해보세요. 제한속도보다 시속 20마일 빠르게 운전하고 있어요. 과속이죠. 경찰이 뒤에 붙어요. 경찰이 사이렌을 켜요. 여러분이 속도를 늦추고, 제한속도에 딱 도달하는 순간 경찰이 사이렌을 끄고 평소처럼 계속 운전해요. 여러분도 평소처럼 계속하고요. 응? 이 상황에서 경찰은 여러분이 제한속도로 운전하는 행동을 부적으로 강화한 게 됩니다. 경찰이 그렇게 하나요? 아니요. 절대 아니죠. 그건 경찰이 하는 게 아니에요. 경찰은 그 행동을 정적으로 처벌합니다. 시속 20마일 초과로 잡히면, 차를 세워야 하고, 20분을 기다려야 하고, 출근에 늦고, 300달러짜리 딱지를 내야 하고, 법정에 출두해야 하고, 면허에 벌점이 붙어요. 여기 이 모든 결과가, 여러분이 싫어하고, 원하지 않고, 나쁜 결과가 있는 거죠. 이런 걸 다시 겪지 않을 유일한 방법은, 과속 행동을 아예 피하는 겁니다. 이해되시나요? 이건, 경찰은 여러분이 제한속도로 운전하는 행동을 강화하는 게 아니에요. 아니요, 그들은 여러분이 과속하는 행동을 처벌하는 거예요. 보세요, 이건 완전히 다른 두 가지입니다.

자, 이제 개 예시로 들어가죠. 각각에 대해 한 가지 예시를 드리겠습니다. 실제 개로 보여드리고, 어떻게 적용하는지 보여드리고, 그다음 이 영상에서 가장 중요한 부분, 즉 각각에 대해 돌리는 피드백 루프(feedback loop)를 보여드릴게요.

부적 강화부터 시작하죠. 엎드려 명령 같은 아주 단순한 행동을 택합시다. 아주 단순하죠. 개한테 엎드리라고 했는데 무시하는 상황에서 뭘 하나요? 완전히 무시해요. 그냥 계속 냄새 맡고 뭐 하고요. 그냥 무시해요. 뭘 하죠? 개를 교정하나요? 아니요, 교정 안 합니다. 왜냐하면 그 단어를 어휘에서 삭제했으니까요. 뭘 하죠? 엎드려 명령을 부적으로 강화합니다. 왜냐하면 개가 뭔가를 하길 원하니까요. 개가 뭔가를 하길 원하는 거죠. 아주 중요합니다.

자, 이게 어떤 모습인지 보죠. 개한테 엎드리라고 했는데 무시하면, 압박(pressure)을 만듭니다. 개 훈련 언어에서 우리는 '압박'이라는 단어를, 개가 겪는 혐오적인 뭔가를 묘사할 때 써요. 그게 우리한테서 오는 것 — 우리가 개한테 그 압박을 만드는 것 — 이거나, 아니면 개가 우리가 아닌 다른 어딘가에서 환경적으로 겪는 것이거나요. 아무튼 혐오적인 뭔가입니다. 그러니까 혐오적인 뭔가를 만들어요. 이건 목줄 압박, 프롱 칼라(prong collar, 뾰족한 목걸이) 압박일 수 있어요. 전자목걸이 압박일 수 있어요. 공간적 압박(spatial pressure)일 수 있어요. 언어적 압박(verbal pressure)일 수 있어요. 여러분 개가 혐오적으로 느끼는 뭔가요.

그다음 무슨 일이 일어나죠? 개가 뭔가를 합니다. 왜? 혐오적인 뭔가가 일어나고 있고 그게 싫으니까, 이게 사라지길 원하니까요. 이건 좋지 않아요. 안 좋게 느껴져요. 그리고 지금 당장 사라지길 원하죠. 그럼 뭘 하나요? 앉나요? 빙글빙글 도나요? 긁기 시작하나요? 목줄을 물기 시작하나요? 뭘 하죠? 그리고 뭘 하든, 압박을 푸나요? 자, 이게 결정적입니다. 개가 그런 것들 중 뭘 하든, 압박은 사라지지 않아요. 압박은 개가 원하는 행동을 수행할 때까지 계속됩니다. 이 경우 이 조건에서는 엎드리는 거였죠.

이제 어떤 분들은 궁금하실 거예요. "마일스, 이걸 그냥 교정이라고 부르면 왜 안 돼요? 여기 이걸 왜 교정이라고 못 불러요?" 왜냐하면 이렇게 하다 보면 멍청한 질문을 하기 시작하거든요. "마일스, 제 개한테 엎드리라고 했는데 안 해서 교정했는데도 안 엎드렸어요." 그건 여러분이 하는 게 아니에요. 여러분은 엎드리기를 부적으로 강화하는 거예요. 개가 안 엎드릴 때 개를 교정하는 게 아닙니다. 설명할게요. 여러분이 여기서 목줄로, 전자목걸이로, 목소리로, 공간적 압박으로 만드는 그 압박을, 개는 원하는 행동을 수행함으로써 탈출하는 법을 배웁니다. 이 조건에서, 엎드리라고 했는데 안 하고 이걸 느끼면, 유일한 출구는 엎드리는 거예요. 이해되시나요?

이건 앉아에도, 리콜(recall, 부르면 오기)에도, 힐에도, 플레이스(place, 지정 자리) 명령에도, 개가 하길 원하는 그 모든 행동에 적용됩니다. 여기 적용돼요. 여러분이 만드는 압박은, 개가 하던 걸 계속할 수 없을 만큼 충분히 혐오적이어야 합니다. 이제 개는 이 압박을 탈출하려는 동기를 갖게 돼요. 너무 불편하니까요. "불편해. 사라지길 원해. 아 진짜, 다른 걸 계속할 수가 없네. 이거 사라져야 돼. 사라져야 돼. 사라져야 돼. 이걸 사라지게 하려면 뭔가를 해야 돼." 일단 엎드리면, 사라져요. 이해되시나요?

자, 이것의 다음 조각이 결정적입니다. 왜냐하면 이때 사람들이 "마일스, 제 개가 안 엎드려서 계속 교정해야 돼요. 매번 교정해야 돼요" 하거든요. 이것의 다음 조각이 뭐죠? 회피(avoidance)입니다. 그게 무슨 뜻이죠? 여러분이 만드는 압박이, 개가 미래에 그걸 피하려는 동기를 가질 만큼 충분히 혐오적이어야 한다는 뜻이에요. 그게 실제로 무슨 뜻일까요? 다음에 개한테 엎드리라고 하면, 이 과정을 아예 건너뛰고 그냥 엎드립니다. 그걸 다시 겪고 싶지 않으니까요.

그리고 바로 이게, 개를 훈련하면서 마음속에서 끊임없이 돌려야 하는 피드백 루프입니다. 이게 개가 하길 내가 원하는 행동인가? 그렇다. 좋아. 나는 이걸 부적으로 강화할 거야. 하라고 시킨다. 안 듣는다. 들어가서 압박을 만든다. 그 압박은 충분해야 하고, 개가 그 순간 탈출하고 미래에 피하려는 동기를 가질 만큼 충분히 혐오적이어야 한다. 둘 다 맞춰야 해요. 둘 다요. 그렇지 않으면, 그건 여러분이 만드는 압박을 높여야 한다는 명확한 신호입니다.

이해하셔야 할 게, 이건 아무 상관 없어요. "아, 전자목걸이 몇 레벨이에요?" 프롱 칼라, 플랫 칼라, 슬립 리드... 상관없어요. 완전히 무관합니다. 도구는 무관해요. 도구는 그냥 이걸 하도록 돕는 겁니다. 그게 다예요. 여러분이 쓰는 도구는 중요하지 않아요. 이걸 하고 있는 한요. 도구는 그냥 이걸 더 쉽게 하도록 돕는 거예요. 그게 다입니다. 그게 도구의 전부예요. 도구는 이걸 하도록 돕습니다.

그래서 저는 여러분이 "아, 전자목걸이 몇 레벨이어야 해요?" 같은 멍청한 질문을 하는 걸 보고 싶지 않아요. 여러분 개를 보세요. 여러분 개가 몇 레벨이어야 하는지 알려줍니다. 부르면 오라고 했는데 무시하고, 전자목걸이 60에서 압박으로 들어갔는데도 완전히 무시하고 탈출하려는 동기조차 없으면, 올려야 해요. 올려야 합니다. 60이든 상관없어요. 90으로 올리세요. 90에서 탈출하고 미래에 피하려는 동기가 생겨요. 좋아요, 완벽해요. 다른 개는 5일 수도 있어요. 레벨은 완전히 무관합니다. 중요한 건 개가 그걸 어떻게 지각하느냐, 그 압박을 개별적으로 자기한테 어떻게 지각하느냐뿐이에요.

이제 실제 개로 예시를 드릴게요. 이 모든 것, 부적 강화 학습이 실제로 작동하는 걸 볼 수 있게요. 자, 이제 여러 다른 맥락에서, 훈련의 다른 단계에서 제가 엎드려 명령을 어떻게 부적으로 강화하는지 보여드리겠습니다. 여기 보시는 이 클립은 훈련 초기 단계예요. 스틸(Steel)한테 며칠 전에 엎드리기를 막 가르쳤어요. 그리고 그걸 다 낮은 자극 환경, 집 안이나 차고 진입로 같은 아주 낮은 자극 환경에서 했어요. 그리고 이게 맥락을 바꾸는 첫 번째예요. 처음으로 밖에서, 평소 산책 중에 엎드리라고 할 겁니다. 그리고 실패하겠죠. 그러면 들어가서 부적으로 강화할 거예요. 어떻게 하는지 보세요. 스틸 엎드려. 엎드려. 엎드려. 좋아. 좋아. 잘했어, 친구. 좋아. 좋은 엎드려. 좋아. 잘했어, 친구.

자, 다시 돌려보죠. 엎드리라고 했더니 앉아요. 그래서 압박을 만듭니다. 목줄에 압박을 만들고, 언어적 압박을 만들고, 공간적 압박을 만들어요. 보세요, 이렇게 위에서 덮어씌우듯이 서 있죠. 그다음 엎드리면, 모든 압박을 풀어요. 그렇게 엎드리기를 부적으로 강화합니다. 자, 제가 아주 가벼운 정도의 압박을 쓴 걸 알아채셨을 거예요. 그 이유는, 이 아이가 훈련 초기 단계이기 때문입니다. 이제 막 이 새로운 기술을 배우고 있어요. 그러니까 제가 여기 나와서 처음으로 엎드리라고 하고, 안 엎드린다고 머리를 뜯어버리는 건 말이 안 되잖아요. 그건 말이 안 돼요. 그래서 보시면, 처음엔 아주 가볍게 시작합니다. 좀 봐주는 거죠. 이 새로운 개념을 가르치는 거예요. 그리고 같은 이 산책에서 제가 어떻게 이걸 밀고 나가는지 보게 될 겁니다.

이건 아까 그 산책의 같은 구간이고, 시험해볼게요. 엎드려 명령을 주고 뭘 하는지 보죠. 스틸 엎드려. 좋아. 그냥 냄새에 정신 팔려서 오래 걸리는 거예요. 착하지. 좋은 엎드려, 친구. 자. 좋아요, 제가 보여드린 첫 번째랑 아주 비슷하죠. 하라고 한다. 안 한다. 압박으로 들어간다. 한다. 모든 압박을 푼다.

자, 여기 이번 산책 전체에서 가장 중요한 반복(rep)입니다. 여기서 다시 엎드려 명령을 줄 건데, 압박을 높일 거예요. 보세요. 스틸 엎드려. 좋아. 아니, 그건 놔둬. 엎드려. 엎드려. 엎드려. 좋아. 잘했어. 잘했어. 자. 보세요, 여기. 다시 해보죠. 스틸 엎드려. 좋아. 잘했어, 친구. 잘했어. 자, 다시 돌려보죠. 엎드리라고 하고, 스틸 엎드려. 그리고 저를 무시하니까 압박으로 들어갑니다. 보시면 이번엔 좀 더 압박으로 들어가죠. 그다음 정신 팔려서 땅에서 뭘 먹으려고 해요. 그래서 "야, 그만해. 엎드려 자세로 들어가야지." 하죠. 압박으로 들어가서 엎드리게 하려고요. 팔꿈치가 안 닿았어요. 그게 보여요. 그다음 더 압박으로 들어가서 다시 엎드리게 합니다. 그다음 모든 압박을 풀어요. 자, 거기서 처음 두 번보다 좀 더 압박으로 들어갔죠. 그다음 자세에서 풀어줍니다.

자, 바로 이게 실제로 작동하는 부적 강화 학습입니다. 여기서 명령을 줘요. 스틸 엎드려. 보시면 스스로 합니다. 압박을 아예 피해요. 그럼 제가 하기로 선택한 건, 그냥 들어가서 그걸 정적으로 강화하는 겁니다. 그냥 마킹하고, 음식으로 보상하고, 자세에서 풀어줘요. 그게 훈련 초기 단계에서 실제로 작동하는 부적 강화 학습입니다.

자, 이건 며칠 뒤고, 놀이 중에 다른 맥락에서 엎드리기가 어떤 모습인지 보여드릴게요. 여기서 엎드려 명령으로 세션을 여는데, 스스로 합니다. 엎드려 자세로 압박을 만들거나 할 필요가 없어요. 스스로 하죠. 환상적입니다. 하지만 여기서 제가 엎드려 명령을 주는 걸 보실 거예요. 무시하고, 그러면 제가 들어가서 엎드리기를 부적으로 강화합니다. 엎드려. 좋아. 좋아. 잘했어. 가져와. 가져와. 가져와. 우후. 그러니까 명령을 무시하면 압박으로 들어가서 엎드리기를 부적으로 강화해요. 그리고 여기서 며칠 전 산책 때보다 더 압박으로 들어간 걸 알아채실 거예요. 이유는 아주 단순합니다. 우리가 놀고 있고 이 아이가 흥분하고 각성(arousal)했을 때는, 산책 때보다 압박에 덜 민감해요. 그래서 놀이 중에는 정확히 같은 반응을 이끌어내려면 더 많은 압박을 써야 합니다. 그래서 여러분 개별 개에 맞춰, 맥락에 따라, 시나리오에 따라, 원하는 결과를 이루기 위해 쓰는 압박 수준을 조절(modulate)하는 법을 배우는 게 그렇게 중요한 거예요.

이제 제가 부적 강화를 써서 개한테 엎드려 자세를 유지하도록 가르치는 법을 보여드릴게요. 어어. 엎드려. 좋아. 어어. 엎드려. 좋아. 좋아. 엎드려. 잘했어, 친구. 좋아. 잘했어. 보시면 과정이 아주 단순하죠. 자세를 깰 때마다, 그냥 자세로 다시 압박을 만들어서 부적으로 강화합니다. 자, 질문 하나 드릴게요. 개가 계속 자세를 깨면 어떻게 해야 할까요? 그런 일이 일어나면, 압박을 높여야 한다는 뜻이에요. 회피에 도달하지 못하고 있는 거니까요.

이제 마지막 맥락을 하나 보여드릴게요. 이번엔 놀이 맥락에서, 전자목걸이를 써서 엎드려 명령을 부적으로 강화하는 걸 보여드리겠습니다. 자, 여기 노는 중이에요. 그리고 여기서 엎드리라고 해요. 자세로 들어가는 게 아주 느린 게 보이시죠. 그래서 이걸 마음에 메모하고 "좋아, 다음 반복에선 이걸 빠르게 만들어야지" 합니다. 세상에. 준비됐어? 준비. 엎드려. 엎드려. 좋아. 어, 그거 또 7이었어. 더 낮췄어야 했는데. 좋아. 잘했어. 잘했어. 그래서 거기서 전자목걸이를 써서 엎드리기를 부적으로 강화했어요. 자, 그게 다음 반복에서 엎드리기를 빠르게 하는지 보죠. 잘했어. 잘했어. 오, 그래. 잘했어. 얼마나 빨랐는지 보이시죠? 그 반복에서 훨씬 빠른 게 보여요. 왜냐하면 이제 자세로 빨리 들어가서 압박을 피해야 하는 긴박함이 있으니까요.

그리고 분명히 말하면, 제가 영상에서 이걸 하는 걸 보는 것과, 여러분이 여러분 개랑 성공적으로 이걸 할 수 있는 건 같지 않아요. 완전히 다른 두 가지입니다. 그래서 정확히 뭘 해야 하는지 단계별로 보여드려서 여러분 개별 개한테 적용할 수 있게 하고, 제대로 하고 있는지 확인하도록 저와 제 팀한테서 당일 피드백을 받고 싶으시다면, 바로 그게 해밀턴 도그 트레이닝(Hamilton Dog Training)입니다. 견주를 위한 온라인 개 훈련 학교예요. 두 가지를 가지고 졸업하시죠. 완전한 오프리쉬(목줄 없이) 훈련된 개, 그리고 그 훈련을 평생 유지할 기술이요. 전 세계 850명 넘는 견주를 훈련했습니다. 가입하고 싶으시면 아래 링크를 눌러 다음 코호트 대기자 명단에 등록하세요. 여러분 개랑 이런 결과를 원하신다면 아래 링크를 눌러 대기자 명단에 등록하세요.

그게 부적 강화입니다. 자, 이제 정적 처벌로 넘어가죠. 이것에 대해 아주 단순한 예시를 택합시다. 목줄 당기기를 택하죠. 개가 목줄 당기는 걸 그만하길 원하면 뭘 하나요? 교정하나요? 아니요, 교정 안 합니다. 다시, 그 단어를 어휘에서 삭제했으니까요. 이 경우, 개가 목줄을 당기면, 당기는 행동을 정적으로 처벌합니다. 행동의 감소를 일으키는 혐오적인 뭔가를 더해요. 당기는 행동이 감소합니다. 왜 감소하죠? 왜냐하면 여러분 개가 그걸 다시 겪는 걸 피하고 싶으니까요. 그래서 그걸 다시 겪는 걸 피하려고, 이걸 그만합니다. 그 결과로 이어지는 이 행동을 피하는 거죠. 왜냐하면 매번 그 결과로 이어지니까요. 그래서 그만해요.

자, 여기서 돌리는 피드백 루프는 다릅니다. 이것과 달라요. 이건, 여러분이 행동이 증가하길 원하는 거예요. 엎드리길 원하고, 뭔가를 하길 원하고, 그 행동을 하길 원하죠. 이건, 행동이 감소하는가? 감소하는가? 그대로인가? 증가하는가? 세상에. 그중 뭐라도 하고 있으면, 그 행동은 처벌되고 있지 않은 거예요. 만약 행동의 빈도가 감소하고 있으면, 그건 여러분이 그걸 처벌했다는 뜻입니다. 그렇지 않으면, 쓰는 압박을 높여야 해요. 그게 여러분이 돌리는 피드백 루프입니다.

자, 이걸 분해해서 실제 개 예시를 드릴게요. 이건 이 아이의 첫 느슨한 목줄 걷기(loose leash walking) 세션이고, 아주 단순하게 당기는 행동을 처벌할 겁니다. 그래서 당기면, 나쁜 일이 일어나요. 바로 여기, 당깁니다. 결과. 자, 제가 충분한 압박을 썼는지 어떻게 알죠? 다시 하는지 안 하는지 봐야 합니다. 다시 하면, 더 많은 압박을 쓸 거예요. 아주, 아주 단순하죠. 개한테서 그 피드백을 받는 겁니다. 개가 여러분이 얼마나 많은 압박을 만들어야 하는지 알려줘요. 행동의 감소가 보이는가, 아닌가?

자, 이걸 보세요. 5분 뒤에 뭘 할까요? 목줄을 당깁니다. 그래서 압박을 높여요. 다시, 저는 항상 개를 보고 그 피드백을 받습니다. 행동의 감소가 보이는가, 아닌가? 안 보이면 압박을 높여야 해요. 자, 분명히 말하면, 이건 이 아이의 첫 세션이에요. 그러니까 머리를 뜯어버리지 않습니다. 그건 여기서 말이 안 돼요. 아주 가볍게 시작합니다. 기대가 뭔지 보여주는 거예요. "야, 당기지 마. 당기면 결과가 있어." 그다음 빠르게 끌어올릴 거예요. 프롱 칼라로 영원히 간지럽히지 않을 겁니다. 그게 어떤 모습인지 지금 보여드릴게요.

이건 약 일주일 뒤예요. 여기 보시면 목줄 끝에서 훨씬 편안해요. 이 시점에 프롱 칼라에 덜 민감한데, 느슨한 목줄 걷기 기대는 아주 명확합니다. 이 시점에 당기는 게 허용되지 않아요. 그래서 여기, 냄새를 맡고 있는데 제가 목줄에 압박을 만들고 이 아이가 그 안으로 당기면, 그 냄새로 당긴 것에 대한 큰 결과입니다. 그래서 보시면 저는 프롱 칼라로 개를 영원히 간지럽히지 않아요. 여러분이 보신 그 첫 클립, 그건 이 아이의 첫 세션이었어요. 하지만 저는 거기 머물지 않습니다. 거기 머물면, "마일스, 저는 산책에서 목줄 당기기 때문에 개를 20번 교정해야 돼요" 하는 함정에 빠져요. 형씨, 여러분은 그 행동을 처벌하고 있는 게 아니에요. 보고 있어요? 여러분이 뭘 하고 있는지 이해해요? 이해하나요? 처벌은 행동의 빈도를 감소시킵니다. 감소하지 않으면, 정의상 여러분은 그걸 처벌하고 있는 게 아니에요. 그러니까 실제로 그 행동을 처벌하고 있는지, 그냥 개를 교정하고 있는 게 아닌지 확인하세요.

자, 이해하는 게 아주 중요한데, 제가 방금 여기 펼쳐놓은 모든 건 그냥 정보입니다. 뭘 할지 보는 것과, 실제로 성공적으로 할 수 있는 건 완전히 달라요. 성공적으로 하려면 기술(skill)이 필요합니다. 그리고 기술을 향상시키려면 세 가지가 필요해요. 올바른 것들을, 올바른 방식으로, 올바른 순서로 해야 합니다. 그리고 그 세 가지는 유튜브 영상만으로는 얻을 수 없어요. 그래서 제가 해밀턴 도그 트레이닝을 만든 겁니다. 견주를 위한 온라인 개 훈련 학교예요. 두 가지를 가지고 졸업하시죠. 완전한 오프리쉬 훈련된 개, 그리고 그 훈련을 평생 유지할 기술이요. 학생으로 등록하시고, 구조화된 커리큘럼을 진행하고, 여러분 개와 똑같은 개를 데리고 바로 옆에서 훈련하는 동기(cohort) 급우들과 함께 합니다. 그리고 막히거나 문제가 생길 때마다, 저와 제 팀이 사이드라인에 있다가 들어가서 여러분 훈련에 당일 피드백을 드려요. 등록은 한 달에 한 번 열리니, 아래 대기자 명단에 등록하시면 다음 등록 창이 열릴 때 알려드리겠습니다.

그러니 아래 대기자 명단에 등록하세요. 그리고 저희 전체 훈련 시스템이 어떻게 작동하는지, 훈련 안 되고 아무것도 모르는 개를 어떻게 완전한 오프리쉬 훈련된 개로 만드는지 보고 싶으시면, 다음 이 영상을 보세요.

이 페이지는 원본 영상·자료를 바탕으로 한 한국어 번역 아카이브입니다. 원저작권은 각 원저작자와 출처에 있습니다.