스틸맨 (Steelmanning)
처음 실린 날 2026-05-31 · 마지막으로 고친 날 2026-09-27
다른 이름: 스틸매닝 · 스틸맨 논증 · Steelmanning
한 줄 정의
상대 주장을 반박하기 전에, 상대가 말한 것보다 더 강한 버전으로 재구성한 뒤 그 강화된 버전을 상대한다. 허수아비(strawman)의 정반대로, 상대 주장의 가장 강한 형태를 만들어 그것을 공격한다 [Muehlhauser 2011].
일상 한 줄
토론에서 이기고 싶으면, 상대 말을 깎아내리지 말고 상대보다 더 그럴듯하게 대신 정리해준 다음 그걸 반박하라. "당신 말은 결국 X 아니냐"로 비틀면(허수아비) 이겨도 상대는 승복하지 않는다. 반대로 "당신 주장을 가장 강하게 보면 X·Y·Z인데, 그래도 Z가 안 맞는다"로 가면, 상대가 들을 자세가 된다 [Dennett 2013].
이 카드는 "스틸맨"이 대중·합리주의 커뮤니티에서 출발한 개념이라 직접적인 학술 검증이 약하다는 점을 명시합니다(confidence C). 다만 인접 학술(관점 수용 Galinsky 2000·Eyal 2018, 적극적 청취 Rogers 1952, 철학의 관용 원칙 Wilson 1959/Davidson 1973, 논증 이론 Mercier & Sperber 2011)로 보강합니다. 검증 안 된 처방은 표시합니다.
흔한 장면
- 온라인 논쟁: 상대 댓글에서 제일 허술한 한 문장만 골라 캡처·조롱. 이기는 것처럼 보이지만 상대 핵심 논거는 그대로 살아 있음.
- 회의 반대: 동료 제안을 "그건 비용을 무시한 거잖아요"로 가장 약한 해석으로 받음. 동료는 "비용도 고려했다"며 방어 모드로 전환, 논의가 진흙탕.
- 부부·가족 갈등: 상대 불만을 최악으로 해석("결국 내가 나쁜 놈이라는 거지"). 실제 상대 요지는 더 좁고 합리적인데 과장해서 받음.
- 정치·이념 대화: 반대 진영을 가장 멍청한 지지자의 말로 대표시켜 통째로 반박. 실제로 강한 반대 논거는 건드리지도 못한다.
- 설득 실패 후: "논리로 이겼는데 왜 안 바뀌지?" → 반박당한 것은 상대가 한 말이 아닌 비틀린 버전이라 상대 입장은 그대로 남는다. Dennett은 이런 쉬운 표적이 "대개 실제 쟁점과 무관하고 모두의 시간과 인내만 쓴다"고 적었다 [Dennett 2013]. 반박이 오히려 믿음을 강하게 만든다는 역효과(backfire)는 대규모 실험에서 드물게만 나타났다 [Wood & Porter 2019].
- 자기 검토(steelman solitaire): 내 결정의 반대 입장을 내가 가장 강하게 세워보고 그걸 못 깨면 결정 보류.
왜 빠지나 (메커니즘)
- 허수아비가 만들기 쉽다(가설) [Muehlhauser 2011] — 상대의 가장 약한 버전은 만들기 쉽고 반박도 쉽다. 강한 버전은 상대 입장을 제대로 이해해야 만들 수 있어 노력이 든다. 이 "노력 절약" 설명을 직접 잰 실험은 없다.
- 평가 충동(tendency to evaluate) [Rogers & Roethlisberger 1952] — Rogers는 소통의 가장 큰 장벽으로 "상대 말을 끝까지 듣기 전에 옳다/그르다 판단하려는 경향"을 지목. 이 충동이 이해보다 반박을 앞세우게 만든다.
- 추론이 내 편 논거를 찾는다 [Mercier & Sperber 2011] — 논증 이론에 따르면 사람의 추론은 진실보다 자기 견해를 지지할 논거를 찾도록 작동하고, 방어할 입장이 있으면 평가가 비틀린다. 같은 정보를 내 편일 때 더 후하게 평가하는 편향은 51개 실험에서 r = .245였다 [Ditto et al. 2019].
- 이기는 것과 이해하는 것의 혼동 [Dennett 2013] — 토론의 목표를 "상대 굴복"으로 두면 약한 버전을 치는 게 효율적이다. 목표가 "진실에 접근"이면 강한 버전을 쳐야만 의미가 있다.
빠져나오는 법
1. Rapoport's rules 순서대로 [Dennett 2013] — (1) 상대 입장을 상대가 "그래, 그렇게 정리해줘서 고맙다"고 할 만큼 명확·생생·공정하게 재진술. (2) 동의하는 지점을 먼저 나열. (3) 상대에게서 배운 점을 언급. (4) 그제서야 비로소 반박 한 마디를 허용. — 근거 수준: 경험칙(이 순서 자체를 시험한 연구 없음). 가까운 근거로, 반대 논거를 언급하고 반박까지 하는 메시지는 반대 논거를 빼는 메시지보다 신뢰도·설득력이 높았다 [O'Keefe 1999, 메타분석] 2. 재진술을 상대에게 확인받기 [Rogers & Roethlisberger 1952] — 반박 전에 "내가 이해한 당신 주장은 X인데 맞나?"로 되돌려주고 상대 승인을 받는다(reflective listening). 승인 못 받으면 아직 스틸맨이 아니다. — 근거: 실험 [Eyal, Steffel & Epley 2018] - 근거: 상대 입장을 머릿속으로 상상하는 것(관점 수용)은 25개 실험에서 상대 마음을 읽는 정확도를 높이지 못했고, 대화로 직접 물어 확인하는 것(perspective-getting, 관점 얻기)만 정확도를 높였다 [Eyal, Steffel & Epley 2018]. 3. 상대 입장에서 가장 강한 근거 1개를 내가 추가 — 상대가 미처 안 댄 더 좋은 논거를 내가 보태본다. 그래도 내 반박이 서면 그 반박은 견고하다(steelman solitaire) [Muehlhauser 2011]. 비슷한 실험 절차인 "반대 가능성 생각하기(consider the opposite)"는 "공정하게 판단하라"는 지시보다 편향된 증거 해석을 더 잘 줄였다 [Lord, Lepper & Preston 1984]. — 근거 수준: 경험칙(스틸맨 솔리테어 자체는 시험된 적 없음). 비슷한 절차의 실험 [Lord, Lepper & Preston 1984]이 있다 4. 관점 수용 명시적 지시 [Galinsky & Moskowitz 2000] — 상대 처지에서 하루를 적어 보게 한 실험에서 스테레오타입 표현·내집단 편애가 줄었다. 다만 상대를 이해한다고 느끼는 것과 실제로 정확히 이해하는 것은 다르다(→2번 근거). — 근거: 실험 [Galinsky & Moskowitz 2000] (편향 감소). 정확도는 오르지 않았다 [Eyal, Steffel & Epley 2018] 5. 말투로 수용성을 드러내기 [Yeomans et al. 2020] — 상대 입장을 인정하는 표현("말씀하신 X는 일리가 있다"), 동의하는 부분 명시, 부정어 줄이기를 담은 "수용성 레시피"를 따라 쓴 글은 협업 상대로 더 선호되고 더 설득력 있게 평가됐다. Rapoport 규칙 2(동의점 나열)와 겹친다. — 근거: 실험 [Yeomans et al. 2020]
함께 쓰기 좋은 도구
- perspective-taking — 스틸맨의 심리적 엔진. 상대 입장에 서야 강한 버전이 보임 [Galinsky & Moskowitz 2000].
- biased-assimilation — 같은 증거를 자기 쪽에 유리하게 해석하는 편향. 스틸맨은 이걸 의도적으로 거스르는 훈련.
- agreement-vs-understanding — 스틸맨의 목표는 이해다. 동의하지 않아도 이해는 끝까지 밀 수 있다.
- nvc(비폭력 대화) — 평가·판단을 분리하고 상대 욕구를 먼저 듣는 점에서 Rapoport rule 1·2와 짝.
통념이 무너지는 순간
"토론은 상대 허점을 파고들어 이기는 것이다"
⚠ 흔한 말: "약한 데를 찔러야 이기지. 굳이 상대 논리를 강화해줄 이유가 없다." ✓ 학술: Dennett은 상대를 희화화하려는 경향의 "가장 좋은 해독제"로 Rapoport's rules를 제시한다 [Dennett 2013]. 쉬운 표적은 대개 실제 쟁점과 무관해서, 이겨도 상대의 핵심 논거는 남는다. 규칙대로 하면 "상대 입장을 상대만큼 이해했다"는 것을 먼저 보여 주게 되어 상대가 비판을 들을 자세가 된다고 Dennett은 쓴다. 이 효과를 직접 잰 실험은 없고, 가장 가까운 근거는 상대 입장을 인정하는 말투가 협업 평가를 높인 실험이다 [Yeomans et al. 2020].
"상대를 이해하면 내 입장이 약해진다 / 설득당한다"
⚠ 흔한 말: "상대 말을 좋게 정리해주면 내가 지는 거 아니냐." ✓ 학술: 철학의 관용 원칙(principle of charity) — Wilson(1959)이 명명, Quine·Davidson이 발전시킴 [Wilson 1959; Davidson 1973]. 상대 발언을 "가장 합리적·정합적인 버전으로 해석"하는 것은 이해의 전제 조건이다. Davidson은 상대 믿음이 대체로 참이고 일관된다고 가정하지 않으면 상대 말을 해석할 수조차 없다고 봤다. 이 원칙은 해석 이론이라 논쟁에서 이기는 효과를 말하지는 않는다. 비틀린 버전을 깨면 상대의 실제 입장에 대해서는 배우는 것이 없다.
"내 논리가 옳으면 상대는 설득된다"
⚠ 흔한 말: "팩트로 누르면 결국 인정하게 돼 있다." ✓ 학술: Rogers는 소통의 최대 장벽을 "상대 말을 듣기 전에 평가하려는 경향"으로 봄 [Rogers & Roethlisberger 1952]. 평가가 앞서면 상대는 방어 모드가 된다. Rogers는 상대 생각을 상대가 만족할 만큼 요약해 되돌려준 뒤에야 자기 말을 하게 하는 규칙을 제안했다. 반대 의견을 받아들일 자세(수용성) 점수가 높은 사람은 찬반 정책 논거를 더 치우침 없이 평가했다(연구 4, 초록 기준) [Minson, Chen & Tinsley 2020]. 논리가 옳아도 상대가 듣지 않으면 설득은 일어나지 않는다.
"스틸맨은 그냥 예의 바르게 말하는 거다"
⚠ 흔한 말: "결국 친절하게 말하라는 자기계발 아니냐." ✓ 학술: 스틸맨을 가르는 기준은 공격 대상의 강도다 [Muehlhauser 2011]. steel man은 "상대가 처음 말한 것보다 깨기 더 어려운 개선된 버전"이다. 친절해도 약한 버전을 치면 허수아비, 무뚝뚝해도 가장 강한 버전을 치면 스틸맨이다.
1차 출처
- Muehlhauser, L. (2011). "Better Disagreement." LessWrong, 2011-10-24. "steel man" 용어의 대표적 초기 정식화. 글 각주가 "이 용어가 때때로 쓰인다(Sometimes the term … is used)"고 적어, 용어 자체는 이 글 이전부터 있었다.
- Dennett, D. C. (2013). Intuition Pumps and Other Tools for Thinking. W. W. Norton. — 3장 "Rapoport's Rules"(1부 A Dozen General Thinking Tools)에서 Anatol Rapoport의 비판 규칙을 소개. ISBN 978-0393082067. Dennett 각주에 따르면 이 문구는 자기 기억에 의한 재정리이고, 원전은 Rapoport의 Fights, Games, and Debates(1960)와 아래 1961년 논문이다.
- Rapoport, A. (1961). Three modes of conflict. Management Science, 7(3), 210-218. DOI: 10.1287/mnsc.7.3.210 — Dennett에 따르면 규칙 1을 Carl Rogers에게서 가져왔다고 밝힌 원전.
- Rogers, C. R., & Roethlisberger, F. J. (1952). Barriers and gateways to communication. Harvard Business Review, July-August 1952. — 상대 말을 상대가 만족할 만큼 되돌려준 뒤에 말하라는 규칙. 규칙 1의 뿌리.
- Wilson, N. L. (1959). "Substances without Substrata." The Review of Metaphysics, 12(4):521-539. — 관용 원칙(principle of charity) 명명.
- Davidson, D. (1973). "Radical Interpretation." Dialectica, 27(3-4):313-328. DOI: 10.1111/j.1746-8361.1973.tb00623.x — 관용 원칙을 해석의 구성 조건으로 형식화.
출처 성격 주의: "스틸맨/스틸매닝"은 합리주의 온라인 커뮤니티(LessWrong, 2011~)에서 나온 대중 개념이고, 학술 용어로 정의된 적은 없다. 직접적인 RCT·효과 크기 연구가 없다. Muehlhauser·Dennett(Rapoport)가 개념 출처이고, Rogers·Wilson·Davidson 및 아래 후속 연구는 인접 학술 보강(관용 원칙·관점 수용·적극적 청취·대화 수용성)이다. 이 한계가 confidence C의 이유.
원문 핵심 인용
"A 'steel man' is an improvement of someone's position or argument that is harder to defeat than their originally stated position or argument." — Muehlhauser (2011), "Better Disagreement" "You should attempt to re-express your target's position so clearly, vividly, and fairly that your target says, 'Thanks, I wish I'd thought of putting it that way.'" — Rapoport's rule 1, in Dennett (2013), Intuition Pumps and Other Tools for Thinking "The best antidote I know for this tendency to caricature one's opponent is a list of rules promulgated many years ago by the social psychologist and game theorist Anatol Rapoport" — Dennett (2013), 3장 "Rapoport's Rules" verbatim 검증: 2026-09-27. Muehlhauser 인용은 LessWrong 원글 각주 2에서 글자 대조. Dennett 두 인용은 단행본 본문(3장) 텍스트에서 글자 대조.
핵심 정의·메커니즘
원전 정의
| 개념 | 정의 | 출처 | |---|---|---| | 허수아비(strawman) | 상대 주장을 약하게·비틀어 만든 뒤 그것을 반박 | (대조 개념) | | 스틸맨(steelman) | "상대가 처음 말한 것보다 깨기 더 어려운 개선된 버전"을 만들어 상대함 | Muehlhauser 2011 | | 관용 원칙(principle of charity) | 상대 발언을 가장 합리적·정합적인 버전으로 해석 | Wilson 1959; Davidson 1973 | | Rapoport 규칙 | 재진술 → 동의점 → 배운 점 → 그제서야 반박 | Dennett 2013 (Rapoport) |
- 스틸맨은 관용 원칙을 한 걸음 더 민다. 관용 원칙은 "가장 합리적으로 해석"(이해)에서 멈추고, 스틸맨은 "더 강하게 개선"(보강)까지 간다.
- "스틸맨"은 학술 용어로 정의된 적이 없다. 논증 이론에서는 허수아비를 여러 형태로 나눠 다룬다 — Aikin & Casey(2011)의 논문 제목이 허수아비·약한 사람·빈 사람 세 형태를 든다(본문은 확인하지 못했다). 스틸맨은 그 반대편에 놓인다.
작동 기제
스틸맨 자체를 시험한 실험은 없어, 아래는 인접 연구로 짠 인과 사슬이다.
- 왜 허수아비가 생기나 — 추론은 내 편 논거를 찾도록 작동한다: Mercier & Sperber (2011)의 논증 이론에 따르면 사람의 추론은 진실을 찾기보다 남을 설득할 논거를 만들고 평가하도록 진화했다. 그래서 자기 입장을 지지하는 논거를 찾는 쪽으로 기울고(확증 편향), 방어할 입장이 있을 때 평가가 비틀린다. 상대 주장의 약한 버전을 고르는 것은 이 경향의 한 모습으로 볼 수 있다(이 연결은 이 카드의 해석).
- 편향의 크기: 같은 정보를 내 정치 성향에 맞을 때 더 후하게 평가하는 편향은 51개 실험·1만 8천여 명에서 r = .245였고, 진보(.235)와 보수(.255)가 같았다 [Ditto et al. 2019].
- 교정 1 — 반대 쪽을 일부러 떠올리기: "반대 결과였다면 어떻게 평가했을지" 생각하게 하면 "공정하게 판단하라"는 지시보다 편향된 증거 해석이 더 줄었다 [Lord, Lepper & Preston 1984].
- 교정 2 — 상상하지 말고 확인하기: 상대 입장을 상상하는 것(관점 수용)은 상대 마음을 읽는 정확도를 높이지 못했고, 대화로 직접 물어 얻은 경우(관점 얻기)만 정확도가 올랐다 [Eyal, Steffel & Epley 2018]. Rapoport 규칙 1의 기준("상대가 '그렇게 정리해 줘서 고맙다'고 말할 만큼")은 상대 확인을 요구해 이 조건을 채운다.
- 교정 3 — 관계 신호: 상대 입장을 인정하는 말투는 상대의 공격을 줄이고 협업 평가를 높였다 [Yeomans et al. 2020].
언제 강해지고 언제 약해지나
- 상상만 할 때 약해진다: 관점 수용 지시는 정확도를 올리지 못하고 확신만 올리기도 했다 [Eyal, Steffel & Epley 2018]. "상대 입장을 상상하라" 지시는 공감도 유의하게 올리지 못했다 [McAuliffe et al. 2020].
- 자기 위협이 있을 때 역효과: 상대가 나와 너무 다르다고 느끼거나 상대 입장을 떠올리는 일이 자기 평가를 위협하면 관점 수용이 역효과를 낼 수 있다 [Sassenrath, Hodges & Pfattheicher 2016].
- 평가를 내가 하느냐, 상대가 하느냐: 정부 간부 실험에서 수용성은 알고리즘과 상대의 평가로는 좋은 결과를 예측했지만, 자기 평가로는 예측하지 못했다 [Yeomans et al. 2020]. 내가 공정하게 정리했다는 느낌은 기준이 되지 못한다.
- 상대의 의견이 혐오스러울 때: 강한 버전을 만들어 주는 일이 혐오스러운 견해를 그럴듯해 보이게 할 수 있다는 철학적 비판이 있다 [Erez 2026].
어떻게 재나
- 이념 튜링 테스트(Ideological Turing Test): 반대편 입장의 논거를 쓰게 하고 반대편이 채점한다. Brand, Brady & Stafford (2025)는 영국의 세 쟁점에서 각 쪽 200명씩 1,200명을 모아 찬반 논거를 쓰게 했고, 반대편 사람이 실제 지지자의 논거만큼 동의하면 "통과"로 봤다. 경제학자 Bryan Caplan이 블로그에서 제안한 개념이다.
- 대화 수용성 척도: 자기보고 18문항 척도 [Minson, Chen & Tinsley 2020]와 글의 말투를 기계학습으로 채점하는 알고리즘 [Yeomans et al. 2020].
- 관점 이해 정확도: 표정·몸짓으로 감정 맞히기, 진짜·가짜 미소 구별, 거짓말 판별, 배우자의 활동 선호 예측처럼 정답이 있는 과제로 상대 마음을 얼마나 맞히는지 잰다 [Eyal, Steffel & Epley 2018].
- 반박 전 재진술 확인: Rogers식 규칙. 상대가 요약을 승인해야 다음 발언으로 넘어간다 [Rogers & Roethlisberger 1952].
헷갈리는 개념과의 차이
| 개념 | 무엇을 하나 | 스틸맨과의 차이 | |---|---|---| | 허수아비(straw man) | 상대 주장을 비틀어 약하게 만든 뒤 반박 | 정반대 방향 | | 약한 사람 고르기(weak man) | 실제로 존재하는 가장 약한 논자·논거를 골라 그 진영 전체를 대표시킴 | 왜곡 없이 "골라치기"만 한다. 스틸맨은 그 진영의 가장 강한 논거를 고른다. 용어는 Aikin & Casey(2011) 제목에서 왔고, 정의는 이 카드가 쓰는 뜻(논문 본문 미확인) | | 빈 사람(hollow man) | 아무도 주장하지 않는 입장을 만들어 반박 | 상대가 없다. 스틸맨은 실제 상대 입장에서 출발한다. 정의는 이 카드가 쓰는 뜻(논문 본문 미확인) | | 관용 원칙 | 가장 합리적인 해석을 고름 | 해석에서 멈춘다. 스틸맨은 상대가 대지 않은 논거까지 보탠다 | | 관점 수용 | 상대 처지를 상상함 | 머릿속 상상. 스틸맨의 강화판은 상대 확인을 받아야 정확해진다 [Eyal, Steffel & Epley 2018] |
주요 후속 연구·메타분석
### Eyal, Steffel & Epley (2018) — 상대를 이해하려면 상상하지 말고 물어라 Journal of Personality and Social Psychology, 114(4), 547-571. DOI: 10.1037/pspa0000115
- 설계: 실험 25개. "상대의 관점을 취하라"는 지시가 상대의 생각·감정·태도를 맞히는 정확도를 높이는지 검증했다. 과제는 표정·몸짓으로 감정 맞히기, 진짜·가짜 미소 구별, 거짓말 판별, 배우자의 활동 선호·소비 태도 예측 등이었고, 자기중심 편향과 정확도를 분리해 쟀다.
- 결과: 예비 조사 참가자 대다수는 관점 수용이 정확도를 높일 것이라 믿었지만, 일관된 효과는 없었다. 실험 1~15를 묶으면 관점 수용 조건이 통제 조건보다 오히려 덜 정확했고(d = -0.26, 95% CI [-0.40, -0.12]), 25개 실험 전체로도 작은 부정 효과였다(d = -0.23, [-0.32, -0.13]). 관점 수용은 자기중심 편향을 줄였지만 그 자리를 채운 정보가 더 정확하지 않았다. 마지막 실험(실험 25)에서 상대와 설문 항목 전부를 대화로 나눈 "관점 얻기" 조건은 통제 조건보다 상대 답을 훨씬 많이 맞혔다(맞힌 항목 수 d = 1.50). 같은 실험의 관점 수용 조건은 통제와 차이가 없었고 방향은 오히려 낮았다(d = -0.52, p = .20).
- 의미와 한계: "내가 만든 강화판"이 상대 실제 입장과 어긋날 수 있다는 가장 직접적인 근거다. 스틸맨은 상대 확인을 거쳐야 한다. 과제 대부분이 감정·선호 맞히기라 논증 재구성 과제와는 거리가 있다. (전문 읽음)
### Yeomans, Minson, Collins, Chen & Gino (2020) — 상대를 인정하는 말투는 측정·훈련할 수 있다 Organizational Behavior and Human Decision Processes, 160, 131-148. DOI: 10.1016/j.obhdp.2020.03.011
- 설계: 연구 1A에서 온라인 참가자 1,102명에게 반대 입장 글에 수용적으로/평소대로 답하게 하고, 1B에서 평가자 1,322명이 이를 채점해 수용성을 알아보는 기계학습 알고리즘을 만들었다. 연구 2는 정부 간부 238명(119쌍)의 쟁점 대화, 연구 3은 위키백과 편집자 토론 현장 자료, 연구 4는 "수용성 레시피" 개입 실험.
- 결과: 알고리즘과 상대가 수용적이라 평가한 간부는 더 나은 팀원·조언자·대표로 평가됐지만, 본인의 자기 평가는 이를 예측하지 못했다(연구 2). 첫 글이 수용적인 편집자는 나중에 반대 편집자에게 개인 공격을 덜 받았다(연구 3). 레시피를 따른 글은 협업 상대로 더 선호되고 더 설득력 있게 평가됐다(연구 4). 효과 크기: 연구 1에서 "수용적으로 답하라"는 지시를 받은 사람의 글은 평가자에게 더 수용적으로 보였다(Cohen's d = .47). 연구 4에서 레시피 조건은 평가자가 매긴 수용성(표준화 β = .57)과 함께 일하고 싶은 정도(β = .28)를 모두 올렸다.
- 의미와 한계: Rapoport 규칙 2(동의점 먼저)에 가장 가까운 실험 근거다. 효과를 말투 차원에서 쟀고, "가장 강한 버전을 상대했나"는 재지 않았다. (전문 읽음)
### Ditto 외 (2019) — 내 편에 후한 편향은 진보·보수 똑같다 Perspectives on Psychological Science, 14(2), 273-291. DOI: 10.1177/1745691617746796
- 설계: 같은 정보를 내 정치 신념을 지지할 때 더 후하게 평가하는 편향을 다룬 51개 실험(1만 8천여 명) 메타분석. 보수 쪽이 더 편향됐다는 비대칭 가설과 양쪽이 같다는 대칭 가설을 비교.
- 결과: 전체 편향 r = .245. 진보 r = .235, 보수 r = .255로 차이가 없었다. 방법·주제를 바꿔도 같은 양상이었다.
- 의미와 한계: 허수아비를 만드는 배경 편향이 한쪽 진영의 문제가 아님을 보여 준다. 스틸맨은 나도 이 편향을 가진다는 전제에서 출발한다. (초록 기준)
### McAuliffe 외 (2020) — "상상하라" 지시는 공감을 뚜렷하게 올리지 못했다 Personality and Social Psychology Review, 24(2), 141-162. DOI: 10.1177/1088868319887599
- 설계: 괴로워하는 사람의 관점을 상상하라("imagine-self/other"), 또는 객관적으로 보라("remain-objective")는 글 지시를 준 뒤 공감적 관심을 잰 실험들을 메타분석. 지시 없는 통제 조건과 비교.
- 결과: "객관적으로 보라"는 지시 없는 조건보다 공감을 표준편차 절반 가까이 줄였다(g = 0.45, 95% CI [0.35, 0.55]). "상대를 상상하라"는 지시 없는 조건보다 조금 높았지만 유의하지 않았다(g = .08, [-0.02, 0.17]). 흔히 쓰는 "상상하라 대 객관적으로" 비교(g = 0.68)는 대부분 "객관적으로" 쪽이 공감을 깎아서 생긴 차이다. 편향 보정 대부분에서 결과가 유지됐다.
- 의미와 한계: 사람들은 이미 저절로 공감하고 있어, 상상 지시로 더 올리기 어렵다. 스틸맨을 "상대 입장을 상상해 보라"로만 가르치면 효과가 작을 수 있다. 주요 조절 변수는 아직 충분히 연구되지 않았다. (전문 읽음)
### Brand, Brady & Stafford (2025) — 이념 튜링 테스트: 반대편 논거를 얼마나 잘 쓰나 Cognitive Science, 49(10). DOI: 10.1111/cogs.70126
- 설계: 2020년대 초 영국에서 양극화 가능성이 있는 세 쟁점마다 양쪽 각 200명, 총 1,200명을 모집. 각자 자기 입장의 찬반 논거를 쓰게 하고, 반대편 참가자가 채점했다. 반대편 사람이 실제 지지자의 논거만큼 이상 동의하면 "통과".
- 결과: 세 쟁점 모두에서 상호 이해 수준이 높았다. 반대편 논거의 통과율은 코로나19 백신 약 54%, 브렉시트 약 64%, 채식주의 약 71%였고, 쟁점 안에서 어느 한쪽이 더 잘 통과하지는 않았다. 통과한 사람은 상대를 무지·비도덕·비합리하다고 덜 평가했다. 상대가 무지하다는 데 동의하지 않는 비율은 채식주의 쟁점에서 44%(탈락)에서 70%(통과)로 크게 달랐고, 브렉시트에서는 38%에서 41%로 작게 달랐다.
- 의미와 한계: 스틸맨이 성공했는지를 자기보고가 아닌 상대 채점으로 재는 도구다. 영국 세 쟁점에 한정되고, 상관 결과라 "통과해서 열린 마음"인지 "열린 마음이라 통과"인지는 알 수 없다. (전문 읽음)
### O'Keefe (1999) — 반대 논거를 꺼내고 반박하는 메시지가 더 설득한다 Annals of the International Communication Association, 22(1), 209-249. DOI: 10.1080/23808985.1999.11678963
- 설계: 내 주장만 펴는 일면 메시지와 반대 논거도 다루는 양면 메시지의 효과를 비교한 연구들의 무선효과 메타분석. 양면 메시지를 반대 논거를 반박하는 것(반박형)과 언급만 하는 것(비반박형)으로 나누고, 광고와 광고 아닌 주제를 갈랐다.
- 결과: 광고 아닌 주제에서 반박형 양면 메시지는 일면 메시지보다 신뢰도와 설득력이 모두 유의하게 높았다. 비반박형은 신뢰도 차이가 없고 설득력은 오히려 낮았다. 광고에서는 반박형이 두 지표 모두 차이가 없었고(관련 연구가 적음), 비반박형은 신뢰도만 높았다. 흔히 거론되는 조절 변수(청중의 처음 입장·교육 수준)는 효과를 크게 바꾸지 않았다.
- 의미와 한계: 스틸맨의 "상대 논거를 먼저 꺼낸 다음 반박" 순서에 가장 가까운 정량 근거다. 반대 논거를 꺼내기만 하고 답하지 않으면 설득력이 떨어진다. 다만 여기서 다룬 반대 논거가 "가장 강한 버전"이었는지는 재지 않았다. 초록에 효과크기 수치가 없어 적지 않는다. (초록 기준)
### Mercier & Sperber (2011) — 추론은 이기려고 진화했다 Behavioral and Brain Sciences, 34(2), 57-74. DOI: 10.1017/S0140525X10000968
- 설계: 이론 논문. 추론·의사결정 심리학의 여러 결과를 "추론의 기능은 설득할 논거를 만들고 평가하는 것"이라는 가설로 다시 해석했다.
- 결과: 표준 추론 과제의 낮은 성적은 논쟁 맥락이 없어서이고, 논쟁 상황에 놓이면 사람은 능숙하게 논증한다. 그러나 능숙한 논증가는 진실보다 자기 견해를 지지할 논거를 찾는다. 이것이 확증 편향을 설명하고, 자기 의견을 방어해야 한다고 생각할 때 평가와 태도가 비틀린다.
- 의미와 한계: 허수아비가 "게으름"만이 아닌 추론의 기본 방향에서 나온다는 대안 설명이다. 같은 이론은 제대로 된 논쟁 맥락에 놓이면 추론 성적이 좋아진다고 보는데, 스틸맨은 반대편의 논쟁 상대 역할을 혼자서 해 보는 절차로 볼 수 있다(이 카드의 해석). (초록 기준)
그 밖의 문헌
- Galinsky, A. D., & Moskowitz, G. B. (2000). Perspective-taking: Decreasing stereotype expression, stereotype accessibility, and in-group favoritism. Journal of Personality and Social Psychology, 78(4), 708-724. DOI: 10.1037/0022-3514.78.4.708. 실험 3개. 관점 수용은 의식·무의식 과제 모두에서 고정관념 편향을 줄였고, 최소 집단 과제에서 외집단 평가를 높여 내집단 편애를 줄였다.
- Lord, C. G., Lepper, M. R., & Preston, E. (1984). Considering the opposite: A corrective strategy for social judgment. Journal of Personality and Social Psychology, 47(6), 1231-1243. DOI: 10.1037/0022-3514.47.6.1231. "반대 결과였다면 어떻게 평가했을지" 생각하게 한 조건이 "공정하게 판단하라"는 지시보다 편향된 증거 해석을 더 줄였다.
- Minson, J. A., Chen, F. S., & Tinsley, C. H. (2020). Why won't you listen to me? Measuring receptiveness to opposing views. Management Science, 66(7), 3069-3094. DOI: 10.1287/mnsc.2019.3362. 18문항 수용성 척도.
- Sassenrath, C., Hodges, S. D., & Pfattheicher, S. (2016). It's all about the self: When perspective taking backfires. Current Directions in Psychological Science, 25(6), 405-410. DOI: 10.1177/0963721416659253.
- Wood, T., & Porter, E. (2019). The elusive backfire effect: Mass attitudes' steadfast factual adherence. Political Behavior, 41(1), 135-163. DOI: 10.1007/s11109-018-9443-y. 52개 쟁점, 1만여 명 실험에서 사실 교정이 믿음을 오히려 강화하는 경우는 드물었다.
- Aikin, S. F., & Casey, J. (2011). Straw men, weak men, and hollow men. Argumentation, 25(1), 87-105. DOI: 10.1007/s10503-010-9199-y. 제목이 허수아비의 세 형태를 든 논증 이론 논문. 초록·본문에 접근하지 못해 서지·제목만 확인했고, 카드의 약한 사람·빈 사람 정의를 이 논문에 귀속하지 않는다.
- Talisse, R., & Aikin, S. F. (2006). Two forms of the straw man. Argumentation, 20(3), 345-352. DOI: 10.1007/s10503-006-9017-8. (서지만 확인)
- Erez, L. (2026). Steelmanning in the shadow of iron swords. Moral Philosophy and Politics (온라인 선게재). DOI: 10.1515/mopp-2025-0040. 깊은 갈등 속 비자유주의 사회에서는 상대의 가장 강한 논거와 씨름하는 일이 지나치게 관대해져 혐오스러운 견해를 혐오스럽지 않게 보이게 할 수 있다고 비판. 그러면서도 그런 견해와 씨름할 책무는 이런 상황에서 더 커진다고 주장.
비판·한계
재현성
- "스틸매닝이 설득·합의를 높인다"는 직접 무작위 대조 실험은 없다. 가까운 실험은 대화 수용성 연구로, 효과를 말투 차원에서 쟀다 [Yeomans et al. 2020].
- 인접 결과의 규모: 관점 수용 지시의 무효는 실험 25개에서 반복됐고 [Eyal, Steffel & Epley 2018], "상상하라" 지시가 공감을 올리지 못한다는 결과는 메타분석이다 [McAuliffe et al. 2020]. 반대 논거를 반박하는 양면 메시지가 설득에 유리하다는 결과도 메타분석이다 [O'Keefe 1999]. 당파 편향은 51개 실험 메타분석이다 [Ditto et al. 2019].
대표 반론
- 강화판이 상대의 실제 주장을 밀어낸다: 스틸맨은 상대가 하지 않은 말을 보태는 작업이라, 강화판이 상대 실제 입장과 다르면 방향만 반대인 또 하나의 왜곡이 된다. 상상한 관점은 정확도를 높이지 못하고 확신만 올리기도 했다 [Eyal, Steffel & Epley 2018]. 옹호 쪽의 응답은 Rapoport 규칙 1이다 — 상대가 "그렇게 정리해 줘서 고맙다"고 승인할 때까지는 스틸맨이 끝나지 않았다고 본다 [Dennett 2013].
- 지나친 관용: 상대의 가장 강한 버전과 씨름하는 일이, 깊은 갈등 상황에서는 혐오스러운 견해를 그럴듯하게 보이게 한다는 비판이 있다 [Erez 2026]. 같은 저자는 그래도 그런 견해와 씨름할 책무는 오히려 커진다고 봐, "강화"와 "씨름"을 구분한다.
- 허수아비의 원인은 게으름인가: 카드의 "허수아비가 싸다"는 설명은 가설이다. 대안 설명은 추론 자체가 내 편 논거를 찾도록 작동한다는 논증 이론이다 [Mercier & Sperber 2011]. 이 설명이 맞다면 노력만 더 들이라는 처방으로는 부족하고, 상대에게 확인받는 절차가 필요하다.
- "반박하면 역효과"라는 통념도 약하다: 반박이 믿음을 오히려 강화하는 역효과는 52개 쟁점·1만여 명 실험에서 드물었다 [Wood & Porter 2019]. 허수아비 반박의 문제는 역효과보다 쟁점을 비껴간다는 데 있다.
쓰면 안 되는 상황
- 상대가 의도적 기만·선동을 할 때: 무한정 강화해 주면 거짓에 신뢰를 빌려준다. Dennett도 "어떤 상대는 이런 존중을 받을 자격이 없다"고 적었다 [Dennett 2013].
- 상대 확인 없이 강화판을 "당신 주장"이라 부를 때: 새 허수아비가 된다 [Eyal, Steffel & Epley 2018].
- 자기 위협이 큰 주제: 관점 수용이 역효과를 낼 수 있다 [Sassenrath, Hodges & Pfattheicher 2016].
- 모든 주장에: 시간·노력 비용이 크다. 신뢰와 이해관계가 큰 대화에 골라 쓴다.
관련 모델
- perspective-taking (관점 수용, Galinsky 2000) — 스틸맨의 인지적 전제
- biased-assimilation (편향 동화, Lord et al. 1979) — 스틸맨이 거스르려는 편향
- agreement-vs-understanding (동의 vs 이해) — 스틸맨의 목표 구분
- nvc (비폭력 대화) — 평가 분리·욕구 청취의 실천 도구
- confirmation-bias (확증 편향) — 약한 버전만 보게 만드는 상위 편향
사고 도구 다른 글