Skip to content
crawler

File:WebCrawlerArchitecture.svg · Wikimedia Commons · See Wikimedia Commons

EntityQ45842· pop 50· linked from 307 articles

Also known as ant, automatic indexer, web spider, web scutter, web crawlers, spider, search engine spider

internet bot that systematically browses the World Wide Web, typically for the purpose of Web indexing (web spidering)

Wikidata facts

Subclass of
Internet bot
Image
Robots(dot)txt.png
Show 2 more facts
topic's main category
Category:Web crawlers
P13411
sulfur
Sources (2)

via Wikidata · CC0

Article · Italiano

Un crawler (detto anche web crawler, spider o robot), è un software che analizza i contenuti di una rete (o di un database) in un modo metodico e automatizzato, in genere per conto di un motore di ricerca. Nello specifico, un crawler è un tipo di bot (programma o script che automatizza delle operazioni), che solitamente acquisisce una copia testuale di tutti i documenti presenti in una o più pagine web creando un indice che ne permetta, successivamente, la ricerca e la visualizzazione. Un uso estremamente comune dei crawler viene effettuato sul Web; esso si basa su una lista di URL da visitare fornita dal motore di ricerca (il quale, inizialmente, si basa a sua volta sugli indirizzi suggeriti dagli utenti o su una lista precompilata dai programmatori stessi). Durante l'analisi di una URL, identifica tutti i collegamenti ipertestuali presenti nel documento e li aggiunge alla lista di URL da visitare. Il processo può essere concluso manualmente o dopo che un determinato numero di collegamenti è stato seguito. Inoltre i crawler attivi su Internet hanno la facoltà di essere indirizzati da quanto indicato nel file "robots.txt" posto nella root del sito. All'interno di questo file, è possibile indicare quali pagine non dovrebbero essere analizzate. Il crawler ha la facoltà di seguire i consigli, ma non l'obbligo.

Abstract from DBpedia / Wikipedia · CC BY-SA

Gallery (2)