반복게임 (Iterated Game) — tit-for-tat, commitment

처음 실린 날 2026-05-31 · 마지막으로 고친 날 2026-09-27

다른 이름: 반복게임 · Iterated Game · Repeated Game

한 줄 정의

같은 상대와 되풀이해 마주치는 상호작용. 한 번만 하는 죄수의 딜레마에서는 배신이 합리적이지만, 다시 만날 가능성이 충분히 크면 먼저 협력하고, 배신엔 갚고, 돌아오면 용서하는 단순 규칙이 강해진다. Axelrod 의 두 차례 컴퓨터 토너먼트(1980)에서 이런 규칙인 tit-for-tat(받은 대로 갚기: 첫 수는 협력, 그다음부터는 상대가 직전에 한 수를 따라 함)이 두 번 모두 우승했다 [Axelrod 1980a; Axelrod 1980b].

일상 한 줄

다시 안 볼 사람과는 당장의 이익이 크게 보인다. 다시 볼 사람이면 평판이 자산이다. 한 번 보고 말 사람처럼 굴면 두 번째 만남부터 그 값을 치른다.

흔한 장면

통념이 무너지는 순간

### "처음에는 강하게 나가야 만만하게 안 본다" ⚠ 흔한 말: "초장에 잡아야 한다." ✓ 학술: Axelrod 토너먼트에서 상위권 전략은 모두 먼저 배신하지 않는(nice) 전략이었다. 첫수 배신은 그 판에서 몇 점을 더 얻지만, 받은 대로 갚는 상대는 다음 판부터 배신으로 응해 협력이 끊긴다. Axelrod 가 정리한 우승 전략의 속성은 먼저 배신하지 않기(nice)·배신엔 갚기(retaliatory)·돌아오면 용서하기(forgiving)·읽기 쉬움(clear) 네 가지다 [Axelrod 1984].

### "한 번 당하면 평생 갚아야 한다" ⚠ 흔한 말: "복수는 길게." ✓ 학술: tit-for-tat의 forgiving 속성 — 상대가 협력으로 돌아오면 바로 협력으로 응답한다 [Axelrod 1984]. 영구 처벌(grim trigger, 한 번 배신당하면 끝까지 배신)은 실수에 약하다. 실수 한 번에 협력으로 돌아갈 길이 닫힌다. 실수가 섞이는 환경에서는 가끔 용서하는 generous tit-for-tat 이 진화 시뮬레이션에서 더 잘 버텼다 [Nowak & Sigmund 1992; Wu & Axelrod 1995]. tit-for-two-tats(두 번 당해야 한 번 갚기)도 실수에는 강하지만, 이를 노리는 상대에게 착취당해 Axelrod 의 두 번째 토너먼트에서 순위가 낮았다 [Axelrod 1984].

### "장기적 관계에서는 무조건 협력해야 한다" ⚠ 흔한 말: "참고 양보가 미덕." ✓ 학술: Axelrod의 retaliatory 속성 — 배신에는 바로 갚는다. 무조건 협력(always-C)은 착취당한다. tit-for-tat은 "협력하면 협력, 배신하면 배신"이라는 규칙이 읽기 쉬워, 상대가 협력하는 편이 낫다는 것을 금방 알아차리게 만든다 [Axelrod 1984].

### "반복게임이면 commitment는 필요 없다" ⚠ 흔한 말: "관계만 길면 알아서 협력하게 된다." ✓ 학술: 끝나는 판이 정해진 반복게임에서 이론은 마지막 판부터 거꾸로 따져(역진귀납) 첫 판부터 배신을 예측한다. 그런데 상대가 협력형일 가능성이 조금만 있어도 합리적 참가자가 거의 끝까지 협력하는 균형이 생긴다 [Kreps et al. 1982]. 실제 실험에서는 초반엔 협력하다 끝 무렵에 무너지고, 경험이 쌓일수록 무너지는 시점이 앞당겨졌다 [Selten & Stoecker 1986]. 관계가 길다는 것만으로는 부족하고, 끝이 불확실하거나 평판이 걸려 있어야 협력이 버틴다. 이와 별도로 Schelling (1960)은 계약·공개 약속처럼 자기 선택지를 일부러 묶는 약속(commitment)이 상대의 신뢰를 산다고 보았다.

왜 강한가 (메커니즘)

빠져나오는 법 / 적용 단계

1. 이 관계가 한 번인지 반복인지 적어 본다: 다시 만날 가능성이 높고, 배신으로 얻는 추가 이익이 작을수록 협력 쪽이 낫다. 협력이 이론상 가능한 조건이어도 사람들은 협력이 전략적 불확실성에 충분히 강할 때만 높은 비율로 협력했다 [Dal Bó & Fréchette 2018]. — 근거: 실험 메타 자료 [Dal Bó & Fréchette 2018], 통제 실험 [Dal Bó 2005] 2. 첫수는 협력: 새 관계의 첫 거래는 가벼운 협력 신호로 연다. 먼저 배신하면 평판이 바로 상한다. — 근거: 컴퓨터 토너먼트 [Axelrod 1980a; 1980b] (먼저 배신하지 않는 전략이 상위권). 사람 관계로 옮긴 것은 유추 3. 배신에는 같은 크기로 갚되 한 번에 그친다: 영구 처벌은 실수에 약하다. 한 번 갚은 뒤 상대가 협력하면 바로 협력으로 돌아간다 [Axelrod 1980b]. 실수·오해가 섞이는 환경에서는 첫 배신은 넘기는 편이 성과가 좋았다 [Fudenberg, Rand & Dreber 2012]. — 근거: 컴퓨터 토너먼트 [Axelrod 1980b], 잡음 있는 사람 실험 [Fudenberg, Rand & Dreber 2012] 4. 실수 가능성이 있으면 한 번 더 기회: 오해·실수가 잦은 환경에서는 가끔 먼저 용서한다(generous tit-for-tat). — 근거: 잡음 토너먼트 [Wu & Axelrod 1995], 진화 모형 [Nowak & Sigmund 1992] 5. 약속을 보이게 만든다: 계약·공개 약속·환불 불가 조건으로 자기 행동을 묶어 상대의 신뢰를 산다 [Schelling 1960]. — 근거 수준: 이론 [Schelling 1960] (효과를 잰 실험은 이 카드의 문헌에 없음)

1~5 가운데 1과 3은 실험실 반복게임 결과, 2·4·5는 토너먼트·이론을 사람 관계로 옮긴 유추다. 연인·가족·친구 관계에 이 절차를 적용해 효과를 시험한 연구는 이 카드의 문헌에 없다.

함께 쓰기 좋은 도구

1차 출처

원문 핵심 인용

"The results of the tournament demonstrate that there are subtle reasons for an individualistic pragmatist to cooperate as long as the other side does, to be somewhat forgiving, and to be optimistic about the other side's responsiveness." — Axelrod (1980a), J. Conflict Resolution 24(1), 3 (abstract)

"Deductions from the model, and the results of a computer tournament show how cooperation based on reciprocity can get started in an asocial world, can thrive while interacting with a wide range of other strategies, and can resist invasion once fully established." — Axelrod & Hamilton (1981), Science 211, 1390 (abstract)

"However, the fact that cooperation can be supported in equilibrium does not imply that most subjects will cooperate." — Dal Bó & Fréchette (2018), J. Economic Literature 56(1), 60 (abstract)

verbatim 검증: 2026-09-27, 세 인용 모두 CrossRef/OpenAlex 에 실린 출판사 초록과 대조.

핵심 정의·메커니즘

원전 정의

작동 기제

1. 오늘의 배신이 내일의 보복을 부른다 → 상대가 조건부로 협력하면, 배신으로 얻는 한 번의 이득(T−R)과 이후 잃는 협력의 흐름을 비교하게 된다. 2. 미래가 충분히 무거우면 협력이 계산에 맞는다 → 다음 판이 이어질 확률(할인인자 δ)이 크면 협력이 균형 중 하나가 된다(folk theorem). 협력이 유일한 균형은 아니고 배신만 하는 균형도 남는다 [Fudenberg & Maskin 1986]. 방아쇠 전략 기준으로 δ ≥ (T−R)/(T−P) 이다. 3. 균형이 여럿이면 실제로 무엇이 나올지는 전략적 불확실성이 정한다 → 상대가 협력할지 모를 때 협력이 손해를 덜 보는 조건이어야 사람들이 협력한다. 실험에서 협력은 균형으로 가능할 때 늘었지만, 높은 협력률은 협력이 전략적 불확실성에 매우 강한 조건에서만 나왔다 [Dal Bó & Fréchette 2011; 2018]. 4. 읽기 쉬운 규칙이 상대의 학습을 돕는다 → tit-for-tat 은 규칙이 단순해 상대가 금방 패턴을 알아채고 협력하는 편이 낫다는 것을 배운다 [Axelrod 1984]. 두 번째 토너먼트 분석은 먼저 배신하지 않기, 어느 정도 용서하기, 그리고 배신에 반응하기(provocable)의 가치를 보였다 [Axelrod 1980b]. 5. 잡음이 메아리를 만든다 → 한쪽의 실수 한 번에 두 tit-for-tat 이 배신을 번갈아 주고받는다. 너그러움(가끔 용서)이나 뉘우침(자기 실수 뒤 한 번 참기)을 더하면 이를 줄인다 [Wu & Axelrod 1995]. 사람 실험에서도 잡음이 있을 때 성공한 전략은 첫 배신에 보복하지 않는 "관대한(lenient)" 전략, 보복 뒤 협력으로 돌아가는 "용서하는(forgiving)" 전략이었다 [Fudenberg, Rand & Dreber 2012].

반복게임의 핵심 변수

| 변수 | 협력에 주는 영향 | 근거 | |---|---|---| | 다음 판의 무게(δ, 계속될 확률) | 클수록 협력 가능. 방아쇠 전략 기준 δ ≥ (T−R)/(T−P) | Fudenberg & Maskin 1986; Dal Bó 2005 | | 협력의 견고함(전략적 불확실성에 대한) | 클수록 실제 협력률이 높다 | Dal Bó & Fréchette 2018 | | 잡음(실수·오해) | 순수 tit-for-tat 을 약하게 만든다. 관대하고 용서하는 변형이 낫다 | Wu & Axelrod 1995; Fudenberg, Rand & Dreber 2012 | | 평판·상대 유형 불확실성 | 끝이 정해진 반복에서도 협력을 가능하게 한다 | Kreps et al. 1982; Andreoni & Miller 1993 | | 끝나는 판이 알려짐 | 이론상 첫 판부터 붕괴. 실험에서는 끝 무렵 붕괴, 경험이 쌓일수록 붕괴 시점이 앞당겨짐 | Selten & Stoecker 1986; Embrey, Fréchette & Yuksel 2018 | | 배신 유혹(temptation)의 크기 | 유한 반복 게임의 협력률 차이를 가장 잘 설명 | Mengel 2018 | | 참가자 수 | 많아질수록 호혜만으로 협력을 유지하기 어렵다 | Boyd & Richerson 1988 |

언제 강해지고 언제 약해지나

어떻게 재나

헷갈리는 개념과의 차이

| 개념 | 누가 갚나 | 필요한 조건 | 근거 | |---|---|---|---| | 직접 호혜(반복게임) | 도움받은 그 사람이 나중에 갚는다 | 같은 상대와 다시 만날 확률이 충분히 큼(w c/b) | Nowak 2006 | | 간접 호혜(평판) | 제3자가 갚는다. "내가 너를 도우면 다른 누군가가 나를 돕는다" | 남의 과거 행동을 보거나 전해 들어 평판이 퍼져야 함 | Nowak & Sigmund 2005; Nowak 2006 | | 이타적 처벌(강한 호혜) | 배신자를 자기 비용을 들여 벌한다. 물질적 이득 없음 | 다시 볼 일이 없거나 평판 이득이 작아도 작동 | Fehr & Gächter 2002 | | 약속 장치(commitment) | 갚는 사람이 없다. 자기 선택지를 미리 묶는다 | 상대가 그 묶임을 확인할 수 있어야 함 | Schelling 1960 |

주요 후속 연구·메타분석

### Axelrod (1980b) — 두 번째 토너먼트에서도 tit-for-tat 우승 Journal of Conflict Resolution, 24(3), 379–403. DOI: 10.1177/002200278002400301

### Dal Bó (2005) — 미래의 그림자가 협력을 늘린다는 통제 실험 American Economic Review, 95(5), 1591–1604. DOI: 10.1257/000282805775014434

### Dal Bó & Fréchette (2018) — 무한 반복 실험 메타 자료 분석 Journal of Economic Literature, 56(1), 60–114. DOI: 10.1257/jel.20160980

### Embrey, Fréchette & Yuksel (2018) — 유한 반복에서 협력은 끝 무렵부터 무너진다 Quarterly Journal of Economics, 133(1), 509–551 (온라인 2017). DOI: 10.1093/qje/qjx033

### Mengel (2018) — 위험과 유혹이 협력률을 설명한다 Economic Journal, 128(616), 3182–3209 (온라인 2017). DOI: 10.1111/ecoj.12548

### Fudenberg, Rand & Dreber (2012) — 잡음이 있으면 늦게 화내고 빨리 용서하는 쪽이 이긴다 American Economic Review, 102(2), 720–749. DOI: 10.1257/aer.102.2.720

비판·한계

재현성

대표 반론

쓰면 안 되는 상황

관련 모델

사고 도구 다른 글