본문 바로가기

추천 검색어

실시간 인기 검색어

학술논문

토큰 크기 및 출현 빈도에 기반한 웹 페이지 유사도

이용수 21

영문명
Web Page Similarity based on Size and Frequency of Tokens
발행기관
한국IT서비스학회
저자명
이은주(Eun-Joo Lee) 정우성(Woo-Sung Jung)
간행물 정보
『한국IT서비스학회지』한국IT서비스학회지 제11권 제4호, 263~275쪽, 전체 13쪽
주제분류
경제경영 > 경영학
파일형태
PDF
발행일자
2012.12.31
4,360

구매일시로부터 72시간 이내에 다운로드 가능합니다.
이 학술논문 정보는 (주)교보문고와 각 발행기관 사이에 저작물 이용 계약이 체결된 것으로, 교보문고를 통해 제공되고 있습니다.

1:1 문의
논문 표지

국문 초록

영문 초록

It is becoming hard to maintain web applications because of high complexity and duplication of web pages. However, most of research about code clone is focusing on code hunks. and their target is limited to a specific language. Thus, we propose GSIM, a language-independent statistical approach to detect similar pages based on scarcity and frequency of customized tokens. The tokens, which can be obtained from pages splitted by a set of given separators, are defined as atomic elements lor calculating similarity between two pages. In this paper, the domain definition for web applications and algorithms for collecting tokens, making matrics, calculating similarity are given. We also conducted experiments on open source codes for evaluation, with our GSIM tool. The results show the applicability of the proposed method and the effects of parameters such as threshold, toughness, length of tokens, on their quality and performance.

목차

Abstract
1. 서론
2. 관련 연구
3. GSIM 정의
4. 실험 결과
5. 결론
참고문헌
저자소개

키워드

해당간행물 수록 논문

참고문헌

교보eBook 첫 방문을 환영 합니다!

신규가입 혜택 지급이 완료 되었습니다.

바로 사용 가능한 교보e캐시 1,000원 (유효기간 7일)
지금 바로 교보eBook의 다양한 콘텐츠를 이용해 보세요!

교보e캐시 1,000원
TOP
인용하기
APA

이은주(Eun-Joo Lee),정우성(Woo-Sung Jung). (2012).토큰 크기 및 출현 빈도에 기반한 웹 페이지 유사도. 한국IT서비스학회지, 11 (4), 263-275

MLA

이은주(Eun-Joo Lee),정우성(Woo-Sung Jung). "토큰 크기 및 출현 빈도에 기반한 웹 페이지 유사도." 한국IT서비스학회지, 11.4(2012): 263-275

결제완료
e캐시 원 결제 계속 하시겠습니까?
교보 e캐시 간편 결제