Skip to content
rastreador web

File:WebCrawlerArchitecture.svg · Wikimedia Commons · See Wikimedia Commons

EntityQ45842· pop 50· linked from 307 articles

rastreador web

Sign in to save

Also known as ant, automatic indexer, web spider, web scutter, web crawlers, spider, search engine spider

programa que inspecciona las páginas del World Wide Web de forma metódica y automatizada

Wikidata facts

Subclass of
Internet bot
Image
Robots(dot)txt.png
Show 2 more facts
topic's main category
Category:Web crawlers
P13411
sulfur
Sources (2)

via Wikidata · CC0

Article · Español

Un rastreador web, indexador web, indizador web o araña web es un programa informático que inspecciona las páginas del World Wide Web de forma metódica y automatizada.​ Uno de los usos más frecuentes que se les da consiste en crear una copia de todas las páginas web visitadas para su procesado posterior por un motor de búsqueda que indexa las páginas proporcionando un sistema de búsquedas rápido. Las arañas web suelen ser bots.​ Las arañas web comienzan visitando una lista de URL, identifica los hiperenlaces en dichas páginas y los añade a la lista de URL a visitar de manera recurrente de acuerdo a determinado conjunto de reglas. La operación normal es que se le da al programa un grupo de direcciones iniciales, la araña descarga estas direcciones, analiza las páginas y busca enlaces a páginas nuevas. Luego descarga estas páginas nuevas, analiza sus enlaces, y así sucesivamente. Entre las tareas más comunes de las arañas de la web tenemos: * Crear el índice de una máquina de búsqueda. * Analizar los enlaces de un sitio para buscar links rotos. * Recolectar información de un cierto tipo, como precios de productos para recopilar un catálogo.

Abstract from DBpedia / Wikipedia · CC BY-SA

Gallery (2)