Skip to content
web crawler

File:WebCrawlerArchitecture.svg · Wikimedia Commons · See Wikimedia Commons

EntityQ45842· pop 50· linked from 307 articles

web crawler

Sign in to save

Also known as ant, automatic indexer, web spider, web scutter, web crawlers, spider, search engine spider

internet bot that systematically browses the World Wide Web, typically for the purpose of Web indexing (web spidering)

Wikidata facts

Subclass of
Internet bot
Image
Robots(dot)txt.png
Show 2 more facts
topic's main category
Category:Web crawlers
P13411
sulfur
Sources (2)

via Wikidata · CC0

Article · Português

Um rastreador da rede, em inglês web crawler, é um programa de computador que navega pela rede mundial de uma forma metódica e automatizada. Outros termos para rastreadores da rede são indexadores automáticos, robôs, aranhas da rede, robô da rede ou escutador da rede. (em inglês: bots, web spiders, web robot e web scutter). A Google tentou patentear esta ferramenta em 1998 sem sucesso. O processo que um rastreador da rede executa é chamado de rastreamento da rede ou indexação. Muitos sítios, em particular os motores de busca, usam rastreadores para manter uma base de dados atualizada. Os rastreadores da rede são principalmente utilizados para criar uma cópia de todas as páginas visitadas para um pós-processamento por um motor de pesquisa que irá indexar as páginas baixadas para prover pesquisas mais rápidas. Os rastreadores também podem ser utilizados para as tarefas de manutenção automatizadas em um sítio da rede, como verificar as ligações ou validar o código HTML. Os rastreadores também podem ser usados para obter tipos específicos de informações das páginas da rede, como minerar endereços de correio eletrónico (mais comumente para spam). Um rastreador da rede é um tipo de robô da rede ou agente de programa. Em geral, ele começa com uma lista de endereços para visitar (também chamado em inglês de seeds). À medida que o rastreador visita esses endereços, ele identifica todas as ligações na página e as adiciona na lista de endereços para visitar. Tais endereços são visitados recursivamente de acordo com um conjunto de regras.

Abstract from DBpedia / Wikipedia · CC BY-SA

Gallery (2)