학술논문
앙상블 비모수적 변수 선택 방법
이용수 65
- 영문명
- Ensemble nonparametric variable selection method
- 발행기관
- 한국자료분석학회
- 저자명
- 신웅섭(WoongSeob Shin) 조형준(HyungJun Cho)
- 간행물 정보
- 『Journal of The Korean Data Analysis Society (JKDAS)』Vol.25 No.2, 523~536쪽, 전체 14쪽
- 주제분류
- 자연과학 > 통계학
- 파일형태
- 발행일자
- 2023.04.30
4,480원
구매일시로부터 72시간 이내에 다운로드 가능합니다.
이 학술논문 정보는 (주)교보문고와 각 발행기관 사이에 저작물 이용 계약이 체결된 것으로, 교보문고를 통해 제공되고 있습니다.
국문 초록
앙상블 기법은 다수의 개별 모델을 조합하여 하나의 최적 모델로 일반화하는 방법으로, 높은 예측 성능을 보인다. 회귀 및 분류 문제에서 모두 활용 가능하다는 장점이 있으나 블랙박스(black-box)적인 특성으로 모델의 해석이 어렵다는 단점이 있다. 이러한 단점을 변수중요도라는 척도를 제시하여 설명력을 보완하고 있으나 이는 설명변수 간의 상대적인 수치일 뿐, 각 변수의 유의성 여부는 확인할 수 없다는 한계가 존재한다. 반면, 회귀모형의 경우 p-value, 벌점화 등을 통해 변수의 유의성 검정이 가능하다. 본 연구는 앙상블 기법에서 주어지는 변수중요도를 기반으로 유의한 설명변수를 선택하는 비모수적 변수 선택 방법을 제안하였다. 모의실험은 8가지 모형으로 진행하였으며 민감도, 특이도 결과를 방법론별로 비교하였다. 모의실험 결과, 앙상블 비모수적 변수 선택 방법은 8가지 모형에서 기존 회귀모형에서의 변수 선택 방법들보다 우수한 분류 성능을 보여주었다. 또한, 사례 분석을 통해 랜덤포레스트 비모수적 변수 선택 방법이 설명변수 간 강한 상관관계가 있는 경우에도 유의하다고 판단되는 변수를 올바르게 선택한다는 것을 확인하였다.
영문 초록
Ensemble techniques are a method of generalizing multiple individual models to one optimal model, showing high predictive performance. It has the advantage of being available in both regression and classification problems, but it has the disadvantage that it is difficult to interpret the model due to its black-box characteristics. These shortcomings are supplemented by presenting a measure of variable importance, but this is only a relative value between explanatory variables, and there is a limit that the significance of each variable cannot be confirmed. On the other hand, in the case of the regression model, it is possible to test the significance of the variable through p-value and penalty. This study proposed a nonparametric variable selection method that tests the significance of explanatory variables based on the variable importance given in the ensemble technique. The simulation was conducted with eight models, and the results of sensitivity and specificity were compared by methodology. As a result of the simulation, the ensemble nonparametric variable selection showed better classification performance than the variable selection in the existing regression model in eight models. In addition, through case analysis, it was confirmed that the random forest nonparametric variable selection showed excellent performance even when there was a strong correlation between variables.
목차
1. 서론
2. 변수유의성
3. 모의실험
4. 사례 분석
5. 결론
References
해당간행물 수록 논문
- 온라인 학습 기반 LDA 모형을 이용한 이미지 주석 군집화에 대한 연구
- BK21 사업단의 연구 성과물에 대한 서울과 지방대학 비교 분석
- 민영화와 효율성
- COVID-19 환자를 간호하는 중환자실 간호사의 소진 영향요인
- 직무도전성이 학습민첩성을 매개로 주관적 경력성공에 미치는 영향
- 효율적인 물류 운송 배차를 위한 최적 프로세스 연구
- 공간자료에 대한 통계적 위험 경계선 결정 방법에 대한 연구
- 공공도서관의 수요특성에 대한 연구
- CNN 기반 주간 위성 이미지를 활용한 격자 단위 인구추정
- 앙상블 비모수적 변수 선택 방법
- 경영컨설턴트의 셀프리더십이 혁신행동에 미치는 영향
- 면적속도 기반 DTW를 이용한 이탈 항적 탐지
- 시험불안, 사회불안이 간호대학생의 섭식 태도에 미치는 영향
- 민영치매보험의 현물급부에 대한 이용 및 이용 의향에 대한 영향요인 분석
- PIN 추정을 위한 최적모형에 관한 연구
- 증권산업의 NCR제도 개정과 회계정보의 가치관련성
- 연속적 간격법의 타당성
- 비정규직의 일자리 이동성 분석
- 정보전이지수를 이용한 원자재가격과 산업별 주식수익률의 연계성에 대한 Covid-19과 러우전쟁의 영향 분석
- 태풍에 따른 기상요소와 사과의 낙과 피해율 분석
- 코스닥 기업의 ESG 활동이 기업 위험에 미치는 영향
- 시뮬레이션 방법에 의한 보조재생함수의 근사
- 미세먼지의 야외 여가활동 수요에 대한 효과
- 기술분석보고서 발간이 주가급락위험에 미치는 영향에 대한 연구
- 금융 분야의 범주 불균형 문제 해결을 위한 성과 최적화 기반의 부스팅 학습
- 은닉 마르코프 모델을 이용한 적응형 학습경로 생성에 관한 연구
- 한국 가계부채의 결정요인에 대한 실증분석
- 결핵 치료 중 사망에 대한 다수준 분석
- 영구적·일시적 현금흐름 뉴스와 할인율 뉴스에 따른 모멘텀 수익률 분석
- 일반학교와 혁신학교 교사의 마을학습 교육과정에 대한 인식 차이
- Journal of The Korean Data Analysis Society (JKDAS) Vol.25 No.2 목차
참고문헌
교보eBook 첫 방문을 환영 합니다!
신규가입 혜택 지급이 완료 되었습니다.
바로 사용 가능한 교보e캐시 1,000원 (유효기간 7일)
지금 바로 교보eBook의 다양한 콘텐츠를 이용해 보세요!