File:WebCrawlerArchitecture.svg · Wikimedia Commons · See Wikimedia Commons
rastreador web
Sign in to saveAlso known as ant, automatic indexer, web spider, web scutter, web crawlers, spider, search engine spider
programa que inspecciona las páginas del World Wide Web de forma metódica y automatizada
Wikidata facts
- Instance of
- software category
- Subclass of
- Internet bot
- Image
- Robots(dot)txt.png
- Has use
- web scraping
Show 2 more facts
- topic's main category
- Category:Web crawlers
- P13411
- sulfur
Sources (2)
via Wikidata · CC0
Article · Español
Un rastreador web, indexador web, indizador web o araña web es un programa informático que inspecciona las páginas del World Wide Web de forma metódica y automatizada. Uno de los usos más frecuentes que se les da consiste en crear una copia de todas las páginas web visitadas para su procesado posterior por un motor de búsqueda que indexa las páginas proporcionando un sistema de búsquedas rápido. Las arañas web suelen ser bots. Las arañas web comienzan visitando una lista de URL, identifica los hiperenlaces en dichas páginas y los añade a la lista de URL a visitar de manera recurrente de acuerdo a determinado conjunto de reglas. La operación normal es que se le da al programa un grupo de direcciones iniciales, la araña descarga estas direcciones, analiza las páginas y busca enlaces a páginas nuevas. Luego descarga estas páginas nuevas, analiza sus enlaces, y así sucesivamente. Entre las tareas más comunes de las arañas de la web tenemos: * Crear el índice de una máquina de búsqueda. * Analizar los enlaces de un sitio para buscar links rotos. * Recolectar información de un cierto tipo, como precios de productos para recopilar un catálogo.
Abstract from DBpedia / Wikipedia · CC BY-SA