Summary Statistics Task의 구조: SAS Enterprise Guide에서 기술통계를 생성하는 원리
앞선 글들에서는 Mean, Median, Standard Deviation, Quartile, IQR, Skewness처럼 Data를 이해하기 위한 다양한 Descriptive S…
전체 21개의 글

앞선 글들에서는 Mean, Median, Standard Deviation, Quartile, IQR, Skewness처럼 Data를 이해하기 위한 다양한 Descriptive S…

통계분석에서 Mean, Standard Deviation, p-value 같은 숫자를 계산하는 것은 중요합니다. 하지만 숫자만으로 Data의 전체 모습을 이해할 수는 없습니다. 예…

데이터를 분석할 때 Mean이나 Median만으로는 각 Observation이 전체 Distribution에서 어느 위치에 있는지 알기 어렵습니다. 예를 들어 시험점수가 85점이라…

데이터의 중심을 Mean이나 Median으로 설명했다면 다음으로 확인해야 할 것은 Data가 얼마나 넓게 퍼져 있는가입니다. 이를 나타내는 개념이 Dispersion, 즉 산포입니…

데이터를 요약할 때 가장 먼저 확인하는 값은 보통 Mean입니다. 하지만 Mean이 같다고 해서 두 Dataset이 같은 특성을 가진 것은 아닙니다. 예를 들어 다음 두 Datas…

데이터의 중심을 설명할 때 가장 자주 사용하는 통계량은 Mean, Median, Mode입니다. 세 값은 모두 Data의 대표적인 위치를 설명한다는 공통점이 있지만, 계산 방식과 …

통계분석을 시작하면 많은 사람이 가장 먼저 p-value나 Regression Coefficient를 확인하려고 합니다. 하지만 실제 분석에서는 그 전에 반드시 해야 할 단계가 있…

통계분석에서는 Population과 Sample을 구분하는 것만큼 중요한 개념이 하나 더 있습니다. 바로 Parameter와 Statistic의 차이입니다. Population에는…

통계분석에서 Sample Size가 크면 결과도 자동으로 신뢰할 수 있다고 생각하기 쉽습니다. 하지만 1,000명을 조사했더라도 특정 특성을 가진 사람들만 집중적으로 선택했다면 그…