Page 1 of 1
[통계] 범주형 독립변수
📛이름
*
범주가 4개인 명목형 변수를 다중 회귀분석에 포함시키기 위해 더미 코딩을 사용할 때, 일반적으로 몇 개의 더미 변수가 생성되나요?
*
A
1개
B
2개
C
3개
D
4개
범주형 변수 model(값이 'Avante', 'K3' 두 종류)을 statsmodels를 이용해 회귀분석(ols('price ~ model', df)) 했을 때, 자동으로 'Avante'가 기준 범주로 설정되었다고 가정합니다. 결과표에 나타나는 model[T.K3] 더미 변수의 회귀계수는 무엇을 의미하나요?
*
A
K3 모델의 평균 가격 예측치
B
Avante 모델의 평균 가격 예측치 (절편과 동일)
C
K3 모델의 평균 가격과 Avante 모델의 평균 가격 간의 차이
D
모델 종류가 가격에 미치는 전반적인 영향력 크기 (R 제곱과 유사)
statsmodels에서 회귀 모형을 설정할 때, model 변수의 기준 범주를 기본값(알파벳 순 첫번째) 대신 'K3'로 명시적으로 지정하고 싶을 때 올바른 관계식 문법은 무엇인가요?
*
A
price ~ model - K3
B
price ~ reference(model, "K3")
C
price ~ C(model, Treatment("K3"))
D
price ~ set_reference(model, "K3")
hiring.xlsx 데이터를 이용하여 관계식 test ~ gpa + hire 으로 다중 회귀 분석을 실시하세요. R제곱은 얼마입니까?
*
gpa의 계수를 해석해보세요
*
A
gpa가 높을 수록 test 점수가 통계적으로 유의하게 *높아진다*
B
gpa와 test 점수는 통계적으로 유의한 관계가 *없다*
C
gpa가 높을 수록 test 점수가 통계적으로 유의하게 *낮아진다*
이 분석 결과에서 절편은 무엇을 나타냅니까?
*
A
gpa가 0인 경우
B
hire 변수가 F인 경우
C
hire 변수가 P인 경우
D
gpa가 0이고 hire 변수가 F인 경우
E
gpa가 0이고 hire 변수가 P인 경우
분석 결과에서 계수 중에 21.8506는 무엇을 의미합니까?
*
A
hire=P인 경우 hire=F인 경우보다 test 점수가 평균적으로 21.8506점 높다
B
hire=P인 경우 test 점수의 평균이 21.8506점이다
제출