본 연구의 목적은 광역 네트워크로 연결된 다수의 봇을 활용하여 단일처리 방식의 시간 지연의 문제점과 병렬처리 방식의 비용증가, 인력낭비에 대한 문제점을 해결할 수 있는 큐를 이용한 ...
http://chineseinput.net/에서 pinyin(병음)방식으로 중국어를 변환할 수 있습니다.
변환된 중국어를 복사하여 사용하시면 됩니다.
https://www.riss.kr/link?id=A103104126
2017
Korean
웹 크롤링 ; 다중스레드 ; 큐 ; ERD ; URL ; Web Crawling ; Entity-Relationship Diagram ; Multi-threaded ; Bot ; Uniform Resource Locator
KCI등재후보
학술저널
43-51(9쪽)
4
0
상세조회0
다운로드국문 초록 (Abstract)
본 연구의 목적은 광역 네트워크로 연결된 다수의 봇을 활용하여 단일처리 방식의 시간 지연의 문제점과 병렬처리 방식의 비용증가, 인력낭비에 대한 문제점을 해결할 수 있는 큐를 이용한 ...
본 연구의 목적은 광역 네트워크로 연결된 다수의 봇을 활용하여 단일처리 방식의 시간 지연의 문제점과 병렬처리 방식의 비용증가, 인력낭비에 대한 문제점을 해결할 수 있는 큐를 이용한 다중스레드 방식의 웹 크롤링을 연구한다. 본 연구는 큐를 이용한 다중스레드 방식의 시스템 구성을 바탕으로 독립된 시스템에서 실행하는 어플리케이션을 설계하고 분석한다. 큐를 이용하여 다중 스레드 방식의 웹 크롤러 설계를 제안한다. 또한, 웹 문서의 처리량을 수식에 따라 클라이언트와 스레드 별로 나누어 분석하고, 각각 효율성 비교를 통해 최적의 클라이언트의 개수와 스레드의 개수를 확인 할 수 있다. 제안하는 시스템의 설계 방식은 분산처리를 기반으로 각각의 독립된 환경에서의 클라이언트는 큐와 스레드를 이용하여 빠르고 신뢰성이 높은 웹 문서를 제공한다. 특정 사이트를 대상으로 하는 웹 크롤러 설계가 아닌 범용 웹 크롤러에 큐와 다중 스레드를 적용하여 다양한 웹 사이트를 빠르고 효율적으로 탐색 및 수집하는 시스템이 필요하다.
다국어 초록 (Multilingual Abstract)
The purpose of this study is to propose a multi-threaded web crawl using queues that can solve the problem of time delay of single processing method, cost increase of parallel processing method, and waste of manpower by utilizing multiple bots connect...
The purpose of this study is to propose a multi-threaded web crawl using queues that can solve the problem of time delay of single processing method, cost increase of parallel processing method, and waste of manpower by utilizing multiple bots connected by wide area network Design and implement. This study designs and analyzes applications that run on independent systems based on multi-threaded system configuration using queues. We propose a multi-threaded web crawler design using queues. In addition, the throughput of web documents can be analyzed by dividing by client and thread according to the formula, and the efficiency and the number of optimal clients can be confirmed by checking efficiency of each thread. The proposed system is based on distributed processing. Clients in each independent environment provide fast and reliable web documents using queues and threads. There is a need for a system that quickly and efficiently navigates and collects various web sites by applying queues and multiple threads to a general purpose web crawler, rather than a web crawler design that targets a particular site.
목차 (Table of Contents)
참고문헌 (Reference)
1 김대유, "자바스크립트 함수 처리 기능을 포함한 분산처리 방식의 웹 수집 로봇의 설계" 한국정보통신학회 13 (13): 2595-2602, 2009
2 조완섭, "웹크롤러의 수집주기 최적화" 한국콘텐츠학회 13 (13): 30-39, 2013
3 김광영, "웹 자원 아카이빙을 위한 웹 크롤러 연구 개발" 한국콘텐츠학회 11 (11): 9-16, 2011
4 김광현, "웹 로봇의 성능 평가를 위한 방법론" 한국정보처리학회 11 (11): 563-570, 2004
5 서동민, "빅데이터 분석 서비스 지원을 위한 지능형 웹 크롤러" 한국콘텐츠학회 13 (13): 575-584, 2013
6 H. W. Kim, "Web Crawler Design for the ARANES Search Engine" 2 (2): 294-299, 2001
7 H. Garcia-Molina, "Parallel Crawler" 124-135, 2002
8 Allan Heydon, "Mercator:A Scalable:Extensible Web Crawler" Springer Nature 2 (2): 219-229, 1999
9 M. Najork, "High-Performance Web Crawling" Compaq Systems Research Center 2001
10 고석범, "FDC-TCT를 이용한 웹 문서 클러스터링 성능 개선 기법" 한국정보처리학회 12 (12): 637-646, 2005
1 김대유, "자바스크립트 함수 처리 기능을 포함한 분산처리 방식의 웹 수집 로봇의 설계" 한국정보통신학회 13 (13): 2595-2602, 2009
2 조완섭, "웹크롤러의 수집주기 최적화" 한국콘텐츠학회 13 (13): 30-39, 2013
3 김광영, "웹 자원 아카이빙을 위한 웹 크롤러 연구 개발" 한국콘텐츠학회 11 (11): 9-16, 2011
4 김광현, "웹 로봇의 성능 평가를 위한 방법론" 한국정보처리학회 11 (11): 563-570, 2004
5 서동민, "빅데이터 분석 서비스 지원을 위한 지능형 웹 크롤러" 한국콘텐츠학회 13 (13): 575-584, 2013
6 H. W. Kim, "Web Crawler Design for the ARANES Search Engine" 2 (2): 294-299, 2001
7 H. Garcia-Molina, "Parallel Crawler" 124-135, 2002
8 Allan Heydon, "Mercator:A Scalable:Extensible Web Crawler" Springer Nature 2 (2): 219-229, 1999
9 M. Najork, "High-Performance Web Crawling" Compaq Systems Research Center 2001
10 고석범, "FDC-TCT를 이용한 웹 문서 클러스터링 성능 개선 기법" 한국정보처리학회 12 (12): 637-646, 2005
11 H. C. Kim, "Design and Implementation of a High Performance Web Crawler" 4 (4): 127-137, 2003
12 D. K. Jung, "A study of Client Response Time Collection Method by changing the Dynamic HTML in the Web Application Server System" 39 (39): 305-307, 2012
13 H. H. Kim, "A Method of GridIR System Configuration over Distributed Experiment of Web Crawler" 8 (8): 281-286, 2007
회계정보 공급자와 회계정보이용자간의 정보비대칭이 정보이용자 의사결정에 미치는 영향
청소년의 직업훈련만족도가 중소기업 진로적응에 미치는 영향
Measures of Real Estate Taxation in the Classify Income
학술지 이력
연월일 | 이력구분 | 이력상세 | 등재구분 |
---|---|---|---|
2025 | 평가예정 | 신규평가 신청대상 (신규평가) | |
2022-06-01 | 평가 | 등재학술지 취소 | |
2021-01-01 | 평가 | 등재학술지 유지 (재인증) | |
2018-01-01 | 평가 | 등재학술지 선정 (계속평가) | |
2017-02-02 | 학술지명변경 | 한글명 : 중소기업융합학회논문지 -> 융합정보논문지외국어명 : Journal of Convergence Society for SMB -> Journal of Convergence for Information Technology | |
2016-01-01 | 평가 | 등재후보학술지 선정 (신규평가) |
학술지 인용정보
기준연도 | WOS-KCI 통합IF(2년) | KCIF(2년) | KCIF(3년) |
---|---|---|---|
2016 | 0 | 0 | 0 |
KCIF(4년) | KCIF(5년) | 중심성지수(3년) | 즉시성지수 |
0 | 0 | 0 | 0 |