Page 1 of 1
[통계] 회귀분석
이름
*
회귀분석의 주된 목적은 무엇인가요?
*
A
데이터를 여러 그룹으로 분류하는 것
B
데이터의 차원을 축소하는 것
C
독립변수를 이용하여 연속형 종속변수를 예측하거나 설명하는 것
D
변수들 간의 단순한 연관성 정도를 파악하는 것
회귀분석에서 선형 모형 y = wx + b에서 y가 의미하는 것은 무엇입니까?
*
회귀분석에서 선형 모형 y = wx + b에서 w가 의미하는 것은 무엇입니까?
*
회귀분석에서 선형 모형 y = wx + b에서 x가 의미하는 것은 무엇입니까?
*
회귀분석에서 선형 모형 y = wx + b에서 b가 의미하는 것은 무엇입니까?
*
최소제곱법(Ordinary Least Squares, OLS)은 회귀 모델의 계수를 추정하기 위해 무엇을 최소화하는 것을 목표로 하나요?
*
A
결정계수
B
잔차 분산
C
사용된 독립변수의 개수
D
독립변수와 종속변수 간의 상관계수
statsmodels 라이브러리에서 ols("Mortality ~ Latitude", data=df)와 같이 모형을 설정할 때, ~ 기호 왼쪽에 오는 변수(Mortality)는 무엇을 의미하나요?
*
A
독립변수
B
종속변수
C
절편 항
D
모형 이름
회귀계수에 대한 가설 검정 결과, 특정 독립변수의 p-value가 0.002 (유의수준 α = 0.05)로 나왔습니다. 이에 대한 올바른 해석은 무엇인가요?
*
A
귀무가설(해당 계수=0)을 기각할 수 없다.
B
해당 독립변수는 종속변수를 설명하는 데 통계적으로 유의미하지 않다.
C
해당 회귀계수는 0과 통계적으로 유의하게 다르다고 볼 수 있다.
D
모형의 설명력(R 제곱)이 매우 낮다.
회귀분석에서 결정계수(R-squared) 값이 0.7이라면, 이는 무엇을 의미하는 것으로 해석하는 것이 가장 적절한가요?
*
A
독립변수가 종속변수 값의 70%를 정확히 맞춘다.
B
독립변수와 종속변수 간의 상관계수가 0.7이다.
C
회귀 모형이 종속변수의 분산 중 70%를 설명한다.
D
예측 오차(잔차)의 평균 크기가 0.7이다.
회귀분석에서 실제 관측값과 회귀 모형에 의해 예측된 값 사이의 차이를 무엇이라고 하나요?
*
회귀 모형의 설명력을 나타내는 R 제곱 값은 어떤 통계량의 제곱과 동일한 값을 가지나요?
*
safety.xlsx에서 length를 독립변수(x)로, risk를 종속변수(y)로 회귀분석을 하려고 합니다. 관계식은 어떻게 세워야 합니까? (힌트: y = f(x))
*
A
risk ~ length
B
length ~ risk
위의 회귀분석에서 R제곱은 얼마입니까?
*
length의 기울기(또는 가중치)는 얼마입니까?
*
위의 기울기에 대한 p-value를 해석해보세요
*
A
length는 risk에 통계적으로 유의한 영향이 있다
B
length는 risk에 통계적으로 유의한 영향이 없다
Submit