모르는 단어

web crawling

예쁜꽃이피었으면 2015. 6. 9. 18:03

http://ko.wikipedia.org/wiki/%EC%9B%B9_%ED%81%AC%EB%A1%A4%EB%9F%AC

웹 크롤러

위키백과, 우리 모두의 백과사전.

이 문서의 내용은 출처가 분명하지 않습니다.
지금 바로 이 문서를 편집하여, 참고하신 문헌이나 신뢰할 수 있는 출처를 각주 등으로 표기해 주세요. 검증되지 않은 내용은 삭제될 수도 있습니다. 내용에 대한 의견은 토론 문서에서 나누어 주세요. (2013년 1월 26일에 문서의 출처가 요청되었습니다.)

웹 크롤러(web crawler)는 조직적, 자동화된 방법으로 월드 와이드 웹을 탐색하는 컴퓨터 프로그램이다. 웹 크롤러에 대한 다른 용어로는 앤트(ants), 자동 인덱서(automatic indexers), 봇(bots), 웜(worms), 웹 스파이더(web spider), 웹 로봇(web robot) 등이 있다.

웹 크롤러가 하는 작업을 웹 크롤링(web crawling) 혹은 스파이더링(spidering)이라 부른다. 검색 엔진과 같은 여러 사이트에서는 데이터의 최신 상태 유지를 위해 웹 크롤링한다. 웹 크롤러는 대체로 방문한 사이트의 모든 페이지의 복사본을 생성하는 데 사용되며, 검색 엔진은 이렇게 생성된 페이지를 보다 빠른 검색을 위해 인덱싱한다. 또한 크롤러는 링크 체크나 HTML 코드 검증과 같은 웹 사이트의 자동 유지 관리 작업을 위해 사용되기도 하며, 자동 이메일 수집과 같은 웹 페이지의 특정 형태의 정보를 수집하는 데도 사용된다.

웹 크롤러는 봇이나 소프트웨어 에이전트의 한 형태이다. 웹 크롤러는 대개 시드(seeds)라고 불리는 URL 리스트에서부터 시작하는데, 페이지의 모든 하이퍼링크를 인식하여 URL 리스트를 갱신한다. 갱신된 URL 리스트는 재귀적으로 다시 방문한다.

저작자표시 비영리 (새창열림)

'모르는 단어' 카테고리의 다른 글

표준화지침 (0)	2015.11.12
cordova (0)	2015.01.13
TypeScript (0)	2014.12.03
모바일 앱 개발 플랫폼 (0)	2014.11.18
컴퓨팅 플랫폼 (0)	2014.11.18

현재글web crawling

개인 공부를 위한 블로그입니다.

10951, AWS, 인증문자, 패스트캠퍼스후기, 10952, 패캠챌린지, docker, 직장인자기계발, nginx, 패스트캠퍼스, 직장인인강, 한 번에 끝내는 코딩테스트 369 Java편 초격차 패키지 Online., 백준, vuejs, 10953, MYSQL, Gunicorn, ubuntu, Django, 자바,

Today :
Yesterday :

내 인생에도 예쁜 꽃이 피었으면 좋겠다

web crawling

웹 크롤러

'모르는 단어' 카테고리의 다른 글

'모르는 단어'의 다른글

티스토리툴바

« 2025/06 »
일	월	화	수	목	금	토
1	2	3	4	5	6	7
8	9	10	11	12	13	14
15	16	17	18	19	20	21
22	23	24	25	26	27	28
29	30

web crawling

웹 크롤러

'모르는 단어' 카테고리의 다른 글

'모르는 단어'의 다른글

관련글

티스토리툴바