본문 바로가기

추천 검색어

실시간 인기 검색어

학술논문

앙상블 비모수적 변수 선택 방법

이용수 56

영문명
Ensemble nonparametric variable selection method
발행기관
한국자료분석학회
저자명
신웅섭(WoongSeob Shin) 조형준(HyungJun Cho)
간행물 정보
『Journal of The Korean Data Analysis Society (JKDAS)』Vol.25 No.2, 523~536쪽, 전체 14쪽
주제분류
자연과학 > 통계학
파일형태
PDF
발행일자
2023.04.30
4,480

구매일시로부터 72시간 이내에 다운로드 가능합니다.
이 학술논문 정보는 (주)교보문고와 각 발행기관 사이에 저작물 이용 계약이 체결된 것으로, 교보문고를 통해 제공되고 있습니다.

1:1 문의
논문 표지

국문 초록

앙상블 기법은 다수의 개별 모델을 조합하여 하나의 최적 모델로 일반화하는 방법으로, 높은 예측 성능을 보인다. 회귀 및 분류 문제에서 모두 활용 가능하다는 장점이 있으나 블랙박스(black-box)적인 특성으로 모델의 해석이 어렵다는 단점이 있다. 이러한 단점을 변수중요도라는 척도를 제시하여 설명력을 보완하고 있으나 이는 설명변수 간의 상대적인 수치일 뿐, 각 변수의 유의성 여부는 확인할 수 없다는 한계가 존재한다. 반면, 회귀모형의 경우 p-value, 벌점화 등을 통해 변수의 유의성 검정이 가능하다. 본 연구는 앙상블 기법에서 주어지는 변수중요도를 기반으로 유의한 설명변수를 선택하는 비모수적 변수 선택 방법을 제안하였다. 모의실험은 8가지 모형으로 진행하였으며 민감도, 특이도 결과를 방법론별로 비교하였다. 모의실험 결과, 앙상블 비모수적 변수 선택 방법은 8가지 모형에서 기존 회귀모형에서의 변수 선택 방법들보다 우수한 분류 성능을 보여주었다. 또한, 사례 분석을 통해 랜덤포레스트 비모수적 변수 선택 방법이 설명변수 간 강한 상관관계가 있는 경우에도 유의하다고 판단되는 변수를 올바르게 선택한다는 것을 확인하였다.

영문 초록

Ensemble techniques are a method of generalizing multiple individual models to one optimal model, showing high predictive performance. It has the advantage of being available in both regression and classification problems, but it has the disadvantage that it is difficult to interpret the model due to its black-box characteristics. These shortcomings are supplemented by presenting a measure of variable importance, but this is only a relative value between explanatory variables, and there is a limit that the significance of each variable cannot be confirmed. On the other hand, in the case of the regression model, it is possible to test the significance of the variable through p-value and penalty. This study proposed a nonparametric variable selection method that tests the significance of explanatory variables based on the variable importance given in the ensemble technique. The simulation was conducted with eight models, and the results of sensitivity and specificity were compared by methodology. As a result of the simulation, the ensemble nonparametric variable selection showed better classification performance than the variable selection in the existing regression model in eight models. In addition, through case analysis, it was confirmed that the random forest nonparametric variable selection showed excellent performance even when there was a strong correlation between variables.

목차

1. 서론
2. 변수유의성
3. 모의실험
4. 사례 분석
5. 결론
References

키워드

해당간행물 수록 논문

참고문헌

교보eBook 첫 방문을 환영 합니다!

신규가입 혜택 지급이 완료 되었습니다.

바로 사용 가능한 교보e캐시 1,000원 (유효기간 7일)
지금 바로 교보eBook의 다양한 콘텐츠를 이용해 보세요!

교보e캐시 1,000원
TOP
인용하기
APA

신웅섭(WoongSeob Shin),조형준(HyungJun Cho). (2023).앙상블 비모수적 변수 선택 방법. Journal of The Korean Data Analysis Society (JKDAS), 25 (2), 523-536

MLA

신웅섭(WoongSeob Shin),조형준(HyungJun Cho). "앙상블 비모수적 변수 선택 방법." Journal of The Korean Data Analysis Society (JKDAS), 25.2(2023): 523-536

결제완료
e캐시 원 결제 계속 하시겠습니까?
교보 e캐시 간편 결제