File:WebCrawlerArchitecture.svg · Wikimedia Commons · See Wikimedia Commons
web crawler
Sign in to saveAlso known as ant, automatic indexer, web spider, web scutter, web crawlers, spider, search engine spider
internet bot that systematically browses the World Wide Web, typically for the purpose of Web indexing (web spidering)
Wikidata facts
- Instance of
- software category
- Subclass of
- Internet bot
- Image
- Robots(dot)txt.png
- Has use
- web scraping
Show 2 more facts
- topic's main category
- Category:Web crawlers
- P13411
- sulfur
Sources (2)
via Wikidata · CC0
Article · Português
Um rastreador da rede, em inglês web crawler, é um programa de computador que navega pela rede mundial de uma forma metódica e automatizada. Outros termos para rastreadores da rede são indexadores automáticos, robôs, aranhas da rede, robô da rede ou escutador da rede. (em inglês: bots, web spiders, web robot e web scutter). A Google tentou patentear esta ferramenta em 1998 sem sucesso. O processo que um rastreador da rede executa é chamado de rastreamento da rede ou indexação. Muitos sítios, em particular os motores de busca, usam rastreadores para manter uma base de dados atualizada. Os rastreadores da rede são principalmente utilizados para criar uma cópia de todas as páginas visitadas para um pós-processamento por um motor de pesquisa que irá indexar as páginas baixadas para prover pesquisas mais rápidas. Os rastreadores também podem ser utilizados para as tarefas de manutenção automatizadas em um sítio da rede, como verificar as ligações ou validar o código HTML. Os rastreadores também podem ser usados para obter tipos específicos de informações das páginas da rede, como minerar endereços de correio eletrónico (mais comumente para spam). Um rastreador da rede é um tipo de robô da rede ou agente de programa. Em geral, ele começa com uma lista de endereços para visitar (também chamado em inglês de seeds). À medida que o rastreador visita esses endereços, ele identifica todas as ligações na página e as adiciona na lista de endereços para visitar. Tais endereços são visitados recursivamente de acordo com um conjunto de regras.
Abstract from DBpedia / Wikipedia · CC BY-SA