권세혁HOME
  • SDV(데이터 가치화)
  • 강의노트
    • 기초수학·수리통계·조사방법
    • 기초통계·회귀·다변량분석
    • 머신러닝·딥러닝
    • AI·감성분석
  • 통계챗봇
  • 오늘의 검색 트렌드
  • 통계, 다르게 읽기
  • 통계로 보는 세상(티스토리 e책방)
  • AI_플랫폼(주식 매수 점수)
  • 유튜브
  1. 📖 (숫자를 대표하는 방법) 같은 평균, 전혀 다른 세상
  • 📋 전체 목록

  • 📖 (비율과 백분율의 함정) 인구 1만 명당 범죄율을 사용하는 이유
  • 📖 (비율과 백분율의 함정) 위험이 두 배 증가했다는 뉴스는 얼마나 위험한가?
  • 📖 (비율과 백분율의 함정) 지지율 3% 상승인가, 3%포인트 상승인가?
  • 📖 (비율과 백분율의 함정) 매출이 50% 늘었다는 말에 속지 않는 법
  • 📖 (숫자를 대표하는 방법) 같은 평균, 전혀 다른 세상
  • 📖 (숫자를 대표하는 방법) 연봉은 평균보다 중앙값으로 보아야 하는 이유
  • 📖 (숫자를 대표하는 방법) 우리 반 평균이 올랐는데 학생들은 왜 불만일까?
  • 📖 (숫자를 대표하는 방법) 별점 4.5점짜리 식당은 믿을 만한가?
  • 📖 (숫자를 대표하는 방법) 내 체온 36.5도는 정말 정상인가?
  • 📖 지각하는 사람들의 비밀
  • 📖 대기 시간의 비밀
  • 📖 평균의 함정
  • 📖 p-값은 왜 0.05인가?
  • 📖 카톡 답장 속도와 호감도의 통계학
  • 📖 (그래프는 어떻게 우리를 속이는가) 막대그래프의 축을 자르면 차이가 커진다
  • 📖 (그래프는 어떻게 우리를 속이는가) 두 개의 세로축이 만드는 가짜 상관관계
  • 📖 (그래프는 어떻게 우리를 속이는가) 누적그래프는 왜 항상 좋아 보일까?
  • 📖 (그래프는 어떻게 우리를 속이는가) 선형 눈금과 로그 눈금은 무엇이 다른가?
  • 📖 (그래프는 어떻게 우리를 속이는가) 좋은 그래프는 무엇을 숨기지 않는가?
  • 📖 (사람의 직관은 왜 통계와 충돌하는가) 농구에서 ’슛 감각이 올랐다’는 말은 사실일까?
  • 📖 (사람의 직관은 왜 통계와 충돌하는가) 동전이 다섯 번 앞면이면 다음은 뒷면일까?
  • 📖 (사람의 직관은 왜 통계와 충돌하는가) 성공한 사람만 보면 성공법이 보이지 않는다
  • 📖 (사람의 직관은 왜 통계와 충돌하는가) 시험을 망친 다음 점수가 오르는 이유
  • 📖 (사람의 직관은 왜 통계와 충돌하는가) 기억에 잘 남는 사건이 더 자주 일어난다고 느끼는 이유
  • 📖 (기록의 착시, 대표값의 재발견) 연승과 연패, 우연일까 실력일까
  • 📖 (기록의 착시, 대표값의 재발견) 작은 표본이 만드는 큰 착각 — 야구 타율 3할의 의미
  • 📖 (기록의 착시, 대표값의 재발견) 세대별 평균이 말해주는 진짜 의미 — 평균 키가 자라는 이유
  • 📖 (기록의 착시, 대표값의 재발견) 평균으로 설명되지 않는 데이터들 — 최빈값이 필요한 순간
  • 📖 (기록의 착시, 대표값의 재발견) 평균의 함정 총정리 — 평균 수심 1m 강물이 위험한 이유
  • 📖 (흩어짐과 역설) “보통”의 폭을 재는 법 — 표준편차란 무엇인가
  • 📖 (흩어짐과 역설) 재벌 총수가 낀 동네 평균 소득 — 이상치 하나가 바꾸는 평균
  • 📖 (흩어짐과 역설) 입시에서 표준점수를 쓰는 이유 — 편차값의 비밀
  • 📖 (흩어짐과 역설) 단위가 다른 두 집단을 견주는 법 — 변동계수로 비교하기
  • 📖 (흩어짐과 역설) 부분에서 이기고도 전체에서 지는 이유 — 심슨의 역설
  • 📖 (숫자로 사람을 줄 세우는 법) 숫자 하나로 사회를 요약하기 — 지니계수로 읽는 불평등
  • 📖 (숫자로 사람을 줄 세우는 법) 어느 쪽이 더 공정할까 — 상대평가 vs 절대평가
  • 📖 (숫자로 사람을 줄 세우는 법) 1점 차이가 갖는 진짜 무게 — 순위의 착시
  • 📖 (숫자로 사람을 줄 세우는 법) 5.0과 4.8 사이, 표본크기의 문제 — 별점 평균의 함정
  • 📖 (숫자로 사람을 줄 세우는 법) 별점 대신 순위를 매기는 이유 — 넷플릭스 평점 시스템
  • 📖 (공식 통계 숫자 읽는 법) 평균수명 60세 시대의 오해 — 기대수명이라는 숫자의 함정
  • 📖 (공식 통계 숫자 읽는 법) 나만의 장바구니 물가지수 — 체감 물가와 통계 물가
  • 📖 (공식 통계 숫자 읽는 법) 누구를 세고 누구를 빼는가 — 실업률의 숨은 정의
  • 📖 (공식 통계 숫자 읽는 법) 분모가 다르면 결론도 다르다 — 치명률 숫자 읽는 법
  • 📖 (공식 통계 숫자 읽는 법) 인과추론 감각을 기르는 법 — 미신적 상관관계 모음

목차

  • 두 펀드, 똑같이 “연평균 수익률 7%”
  • 평균은 ’가운데’만 말해줄 뿐이다
  • 15년간의 수익률을 나란히 보면
  • 같은 평균인데 결과는 왜 달라질까 — 복리의 배신
  • 결론: “평균”만 보고 상품을 고르지 말자

(숫자를 대표하는 방법) 같은 평균, 전혀 다른 세상

통계기초
기술통계
연평균 수익률이 똑같은 두 펀드, 15년 뒤 결과도 똑같을까? 평균 뒤에 숨어 있는 ’분산’이라는 숫자를 들여다봅니다.
Author

권세혁

Published

July 31, 2026

두 펀드, 똑같이 “연평균 수익률 7%”

퇴직연금이나 개인연금 상품을 고를 때, 나는 늘 안내장의 “연평균 수익률”란을 가장 먼저 본다. 그런데 이 숫자만으로는 절대 판단하지 말라고 학생들에게 강조한다. 은행 창구에서 펀드 두 개를 추천받았다고 해보자. A펀드도 연평균 수익률 7%, B펀드도 연평균 수익률 7%. 안내 자료의 숫자만 보면 완전히 같은 상품처럼 보인다. 둘 중 아무거나 골라도 상관없을까?

평균은 ’가운데’만 말해줄 뿐이다

평균은 데이터를 대표하는 값이지만, 데이터가 평균 주위에 얼마나 흩어져 있는지는 전혀 알려주지 않는다. 이 흩어진 정도를 재는 것이 바로 분산(variance)과 표준편차(standard deviation)다.

분산과 표준편차

\[\text{분산} = \frac{1}{n}\sum_{i=1}^{n}(x_i - \bar{x})^2, \qquad \text{표준편차} = \sqrt{\text{분산}}\]

각 값이 평균에서 얼마나 떨어져 있는지를 제곱해서 평균 낸 것이 분산이다. 표준편차는 그 값을 다시 제곱근으로 되돌려, 원래 데이터와 같은 단위로 “흩어진 정도”를 나타낸다.

표준편차가 작다 = 평균 근처에 옹기종기 모여 있다. 표준편차가 크다 = 평균에서 멀리, 넓게 흩어져 있다.

15년간의 수익률을 나란히 보면

두 펀드의 15년간 연도별 수익률. 산술평균은 둘 다 정확히 7.0%(주황 점선)지만, A펀드(초록)는 평균 근처에 얌전히 모여 있고 B펀드(회색)는 -8%에서 +36%까지 요동친다.

A펀드의 표준편차는 약 2.1%p, B펀드는 약 13.5%p다. 평균은 완전히 같지만, 흩어진 정도는 6배 넘게 차이난다. A펀드에 넣어두면 어느 해든 “대략 7% 안팎이겠거니” 예상할 수 있지만, B펀드는 어느 해에 –8%가 될지, +36%가 될지 짐작하기 어렵다.

같은 평균인데 결과는 왜 달라질까 — 복리의 배신

여기서 끝이 아니다. “평균이 같으니 15년 뒤 자산도 비슷하겠지”라고 생각하면 오산이다.

100만 원을 투자했을 때 15년간 자산 변화. 두 펀드의 산술평균 수익률은 똑같이 7%였지만, 변동성이 큰 B펀드는 손실이 난 해의 타격을 만회하지 못해 최종 자산이 더 적다.

100만 원을 넣었다면, A펀드는 15년 뒤 약 275만 원, B펀드는 약 248만 원이 된다. 분명 “연평균 7%”로 안내받은 두 상품인데, 실제로 손에 쥐는 돈은 다르다.

산술평균과 기하평균은 다르다

안내 자료의 “연평균 수익률 7%”는 대개 산술평균이다. 그러나 실제로 자산이 불어나는 속도를 결정하는 것은 기하평균(복리수익률)이다.

  • A펀드: 산술평균 7.0% → 기하평균 약 7.0%
  • B펀드: 산술평균 7.0% → 기하평균 약 6.2%

변동성이 클수록 산술평균과 기하평균의 차이는 벌어진다. 대략 기하평균 ≈ 산술평균 − 분산/2로 근사된다. 손실 난 해의 타격이 이후 이득으로도 완전히 메워지지 않기 때문이다 (–20%를 만회하려면 +20%가 아니라 +25%가 필요하다).

분산이 클수록, 같은 산술평균이라도 실제로 불어나는 돈은 더 적다.

더 깊이: 분산·표준편차와 기하평균의 정의

이 글에서 쓴 분산, 표준편차, 기하평균의 정확한 공식은 강의노트 〈기초통계 2. 데이터와 통계 — 측정형 데이터〉에 정리되어 있다. 특히 기하평균은 강의노트에서도 “비율 자료나 성장률 분석에 적합”하다고 소개되는데, 이 글의 복리수익률이 정확히 그 사례다.

결론: “평균”만 보고 상품을 고르지 말자

평균 뒤에 분산을 함께 보는 법
  1. “연평균 수익률”이라는 말을 들으면 “변동성(표준편차)은 얼마인가”를 함께 묻는다.
  2. 평균이 같다면 분산이 작은 쪽이 더 안정적으로 그 평균에 가깝다.
  3. 변동성이 큰 자산은 산술평균보다 실제 복리 성과가 낮아진다는 점을 기억한다.
  4. 평균 하나로 요약된 숫자는 항상 “이 평균이 얼마나 흩어진 데이터에서 나왔는가”와 함께 읽어야 한다.

두 펀드는 안내장 위에서는 똑같은 “7%”였다. 그러나 분산이라는 두 번째 숫자를 더하는 순간, 완전히 다른 두 개의 세상이 드러난다. 평균은 이야기의 절반일 뿐이다.

내 퇴직연금 명세서를 볼 때마다 나는 수익률 옆의 작은 글씨, “표준편차”나 “위험등급”을 함께 확인하는 습관이 생겼다. 은퇴 이후의 삶은, 평균이 아니라 그 평균이 실제로 어떻게 흔들렸는지에 달려 있기 때문이다.

 
 

방문자 수 since 2026.08.08