다중회귀분석에서의 종속변수 설정 관련해서 문의드립니다. 꼭 부탁드립니다.
안녕하십니까, 교수님.
“배달음식 이용정도와 총 매출액 대비 배달의 비중이 외식비중에 미치는 영향 연구”라는 주제로 학사 졸업 논문을 준비하고 있는데
데이터는 2022-2023 한국농촌경제연구원(KREI)의 원시자료 음식점 데이터 2547개를 확보했고
독립변수를 1일 평균 배달 수, 총 매출액 대비 배달의 비중으로 설정했고,
종속변수를 1일 평균 외식 비중
1일 평균 외식 비중 = 1일 평균 방문 고객수 / (1일 평균 방문 고객 수 + 1일 평균 배달 수)으로 설정하였는데,
종속변수에 독립변수가 포함되어, 신뢰성에 문제가 생기는지 궁금합니다.
위와 같은 방식으로 spss분석결과 수정결정계수 0.57, 표준화회귀계수와 상관계수는 모두 음수로 연구가설과 일치했고, 표준화 회귀계수와 상관계수 유의확률은 모두 <0.001 나왔습니다.
회귀모형 유의확률은 <0.001, VIF = 1.089로 다중공선성에 문제는 없었습니다.
결론적으로 위의 방식이 문제가 있는지 확인 부탁드립니다.. 있다면 제가 어떻게 해야 할까요.. 답변 기다리겠습니다..
Existing replies
이일현 (2024-10-08 14:40:20)
다중공선성은 독립변수들 사이의 문제입니다.
지금 독립변수인 1일 평균 배달 수와 총 매출액 대비 배달의 비중 간에는 어느 정도의 상관관계는 있겠지만 다중공선성이 발생할 정도로 매우 높은 상관을 가지고 있지 않기 때문에 상관계수나 VIF 값이 지금과 같은 결과가 나온 것입니다.
문제는
Y : 1일 평균 외식 비중
X : 1일 평균 배달 수
의 두 변수간의 관계입니다.
사실상 Y 는 X 에 의해서 생성된 변수이기 때문에 이 두 변수 간에는 매우 높은 상관이 나올 수 밖에 없고 회귀분석에서도 유의하게 나올 것이며, 결정계수도 높게 나올 것입니다.
이렇게 나오는 것은 당연한 결과입니다.
문제는 그럼 이걸 회귀모형으로 분석하는 것이 의미가 있느냐? 이겠죠.
통계적으로는 문제가 있습니다.
하지만 경영학 관점에서 이렇게 모형을 만들어서 분석하는 것이 의미가 있느냐? 를 판단해야 할 것입니다.
Legacy document_srl: 303341 / Legacy URL: http://www.statedu.com/QnA/303341

댓글