반응형

상관계수 3

[기초통계학] 산포도와 상관계수, 그리고 상관관계

산포도와 상관계수(상관관계)산포도 (Scatter plot)두 변수 사이의 관계를 살펴보기 위해 산포도를 이용한다. 설명변수는 x로 표기하고 가로축에 표시 피설명변수는 y로 표기하고 세로축에 표시설명변수와 피설명변수간 관계가 약한경우변수 사이의 관계가 약하면 한 변수 값으로 다른 변수 값을 예측하기 어려움위 산포도에서 중간고사에서 150점 받은 학생들의 기말고사 성적은 55점에서 175점  사이에 분포하므로 중간고사 점수로 기말고사 점수를 예측하기 어려움 설명변수와 피설명변수간 관계가 강한경우 변수 사이의 관계가 강하면 한 변수 값으로 다른 변수 값을 예측하는것이 가능해짐 아래 산포도에서 중간고사에서 150점 받은 학생들의 기말고사 성적은 105점에서 175점 사이에 분포함 (위 케이스보다 예측 범위가..

[회귀분석] 단순선형회귀분석(Linear Regression)(1) - 단순선형회귀분석과 가정

회귀분석 회귀분석이란 독립변수(=설명변수)라 불리우는 하나(또는 둘 이상)의 변수에 기초하여 종속변수(=피설명 변수)라 불리우는 다른 한 변수의 값을 설명하고 예측하는 추측통계이다. 상관분석 : 두 변수 모두 확률변수로 가정, 두 변수간의 선형성 전도를 추정하는 것이 목적 회귀분석 : 독립변수는 확정변수로 가정하고 종속변수는 확률변수로 가정, 독립변수의 주어진 값으로 종속변수의 평균값을 추정, 예측하는 것이 목적 단순선형회귀분석 만약 X값이 [1,2,3,4,5] 이고 Y가 [1,3,5,7,9] 이라고 가정합니다. 예를들어 X가 2일 때 Y는 3인 것입니다. 그렇다면 X가 6일때 Y는 얼마일까요? 바로 아시겠지만 Y는 11입니다. 이를 함수로 만든다면 F(X) = 2X -1 인 것입니다.위의 예제는 간단해..

[통계분석] 상관분석 (피어슨, 스피어만, 켄달타우)

상관분석해당 포스팅에서는 Python을 이용하여 상관분석을 하는 방법을 알아봅니다.상관계수에 대한 설명은 아래 포스팅 참고 바랍니다https://ysyblog.tistory.com/403 [기초통계학] 산포도와 상관계수, 그리고 상관관계산포도와 상관계수(상관관계)산포도 (Scatter plot)두 변수 사이의 관계를 살펴보기 위해 산포도를 이용한다. 설명변수는 x로 표기하고 가로축에 표시 피설명변수는 y로 표기하고 세로축에 표시설ysyblog.tistory.com데이터 세팅import seaborn as snstitanic = sns.load_dataset("titanic")titanic=titanic.iloc[:,0:7]titanic.tail()titanic.dropna(axis=0, inplace=T..

반응형