[re] 예측(추정)에 관하여
상당히 까다로운 경우네요.
일단 정리를 하면 2000개의 데이터가 있으며, 그 데이터의 범위는 1억을 기준으로 위, 아래로 분포되어 있습니다. 그러나, 최소값과 최대값이 얼마다라고 할 수 있는 규칙은 없는 것이죠.
여기서 1억의 +-2%(+- 200 만원) 이내에서 15개를 추출합니다. 결국 9800만원 ~ 1억 200만원 사이에서 추출하는 것이 되네요. 이 경우 9800만~1억(A로 표시) 사이에 몇개의 data가 있을지는 알 수 없을 것이고, 1억~1억 200만(B로 표시) 사이에도 몇개가 있을지 알 수 없겠지만, B에서 8개를 난수 발생키켜 추출하고, A에서도 난수를 발생시켜 7개를 추출합니다.
그리고 다시 15개의 data에서 사람이 2개, 컴퓨터가 또 2개를 다시 추출합니다.
이때, 사람이 추출할 때는 15개의 data를 확인하는 것이 아니라, 임의로 뽑는 것이겠죠. 물론 컴퓨터도 그렇고요.
이 경우 근사하게 예측하고자 하시는 것이 4개의 data 각각을 예측하고자 하는 것인지? 아니면 4개 data의 평균 등을 예측하고자 하는 것인지 알 수 없네요.
우선 전자의 경우라면, 특별한 방법이 없을 것으로 생각됩니다. 후자의 경우라면 분포의 성질하면 될지도 모르겠네요.
그러나, 만약 제가 위에서 설명드린 것이 다이고, 다른 조건 등의 없다면 예측하는 것 자체가 의미가 없을 것으로 생각되어 집니다. 이것은 예측의 정확도가 상당히 안 좋다는 것을 의미하는 것이되겠죠.
... 언제나 최선을 다하는 StatEdu가 되길 빌며 ...
>안녕하세요?
>분석좀 부탁드리려구요.
>
>업무상 필요한 것이긴 한데 이것을 통계학으로 접근이 가능한지 부터가 확신이 안서네요.
>대학시절 통계학강의를 들었건만 어떻게 해야할지 여기 사이트에 나와 있는 용어조차도 잘
>모르겠으니....에고..
>
>문의내용은 아래와 같습니다.
>주어진 금액에서 특정 금액을 15개 추출하여 그중 4개를 선택하는 경우 그 4개를 예측 가능할까
>하는것이 궁금합니다.
>
>자세히 설명드리면...
>
>주어진 금액이 있습니다.
>예를 들어 100,000,000원이라는 금액이 주어졌습니다.
>그 다음 주어진 금액의 +-2%범위내에서 특정금액(소수점이하는 없습니다. 정수입니다.) 15개를 추출
>하는거지요. 15개는 컴퓨터가 임의로 위의 기준으로 추출해냅니다. 여기서 컴퓨터는 난수발생을 원칙
>으로 하고 다만 +에서 8개 -에서 7개를 추출하는 것은 원칙으로 합니다.
>그렇게 해서 만들어진 15개를 다시 사람이 2개 컴퓨터가 2개를 선택합니다.
>여기서 사람은 특별한 규칙에 의해서 선택하는것은 아닙니다. 임의로 선택하는것이지요.
>+에서 선택하든 -에서 선택하든 상관이 없다는 얘기입니다.
>컴퓨터도 동일합니다.
>
>질문입니다.
>위에서 사람과 컴퓨터가 각각 2개씩 4개의 금액을 선택한다고 말씀을 드렸는데
>이부분을 통계적으로 근사하게 예측할 수 있을까 하는 겁니다.
>참고로. 특정금액 ..위에서 말씀드린 100,000,000원이라는 금액은 미리 알 수 있습니다.
>
>물론 과거의 자료, 즉 특정금액과 15개의 숫자, 그리고 선택된 4개의 금액은 데이터로서
>2000개 이상 가지고 있습니다. 단, 선택된 4개의 금액은 사람과 컴퓨터가 각각 2개씩 선택한것이지만
>누가 선택했는지는 알 수 없습니다.
>
>너무 난해한가요?
>죄송하지만 답변좀 부탁드리겠습니다.
>
Legacy document_srl: 78573 / Legacy URL: http://www.statedu.com/QnA/78573

댓글