최빈값 = 가장 자주 나오는 값. 3, 7, 3, 9, 7, 3, 12에서 최빈값은 3입니다.
최빈값을 찾으려면 각 값이 몇 번 나오는지 세어 가장 많이 나온 값을 고르면 됩니다. 평균과 달리 더하거나 나누는 과정이 전혀 없어서, 숫자가 아닌 것에도 최빈값을 쓸 수 있습니다. 예를 들어 가장 많이 팔린 신발 사이즈나 설문조사에서 가장 많이 나온 답이 그렇습니다.
최빈값은 어떻게 찾나요?
1) 값을 정렬하거나 개수를 셉니다. 2) 각 값의 개수를 셉니다. 3) 가장 많이 나온 값이 최빈값입니다. 2, 4, 4, 5, 5, 5, 7에서 4는 두 번, 5는 세 번 나오므로 최빈값은 5입니다.
두 숫자가 같은 횟수로 나오면 어떻게 되나요?
그러면 최빈값이 두 개가 되며, 이런 데이터를 쌍봉(최빈값이 2개인 분포)이라고 합니다. 1, 2, 2, 3, 3, 4에서는 2와 3이 각각 두 번씩 나오므로 최빈값은 2와 3입니다. 최빈값이 세 개 이상이면 다봉(최빈값이 3개 이상)이라고 합니다.
반복되는 숫자가 하나도 없으면 어떻게 되나요?
그러면 최빈값이 없습니다. 4, 8, 15, 16, 23, 42에서는 모든 값이 정확히 한 번씩만 나오므로 어느 것도 "가장 흔한 값"이 아닙니다. "최빈값 = 0"이라고 쓰는 것은 흔한 오답이며, 정답은 최빈값이 없다는 것입니다.
최빈값은 평균과 같은 말인가요?
최빈값은 대표값의 한 종류일 뿐입니다. 사람들이 별다른 설명 없이 "평균"이라고 말할 때는 거의 항상 평균(mean)(모두 더해서 개수로 나눈 값)을 가리킵니다. 중앙값은 정렬했을 때 가운데 오는 값입니다. 세 가지 모두 "전형적인" 값을 나타내지만, 조금씩 다른 질문에 답합니다.
| 1, 2, 2, 9의 경우 | 값 | 계산 방법 |
|---|---|---|
| 평균 | 3.5 | (1 + 2 + 2 + 9) ÷ 4 |
| 중앙값 | 2 | 정렬한 목록의 가운데 값 |
| 최빈값 | 2 | 가장 자주 나옴 |
최빈값을 쓰기에 가장 좋은 경우는 언제인가요?
데이터가 범주형(색상, 브랜드, 예/아니오 응답)일 때, 수학적인 중간값보다 가장 흔한 값 하나가 필요할 때(재고를 채울 가장 흔한 옷 사이즈처럼), 또는 데이터에 뚜렷한 봉우리가 있을 때 적합합니다. 값이 하나도 반복되지 않는 소규모 측정 데이터에는 적합하지 않습니다.