File:WebCrawlerArchitecture.svg · Wikimedia Commons · See Wikimedia Commons
クローラ
Sign in to saveAlso known as ant, automatic indexer, web spider, web scutter, web crawlers, spider, search engine spider
ウェブ上の文書や画像などを周期的に取得し、自動的にデータベース化するプログラム
Wikidata facts
- Instance of
- software category
- Subclass of
- Internet bot
- Image
- Robots(dot)txt.png
- Has use
- web scraping
Show 2 more facts
- topic's main category
- Category:Web crawlers
- P13411
- sulfur
Sources (2)
via Wikidata · CC0
Article · 日本語
クローラもしくはクローラー (Crawler) とは、ウェブ上の文書や画像などを周期的に取得し、自動的にデータベース化するプログラムである。「ボット」 (bot)、「スパイダー」、「ロボット」などとも呼ばれる。 主に検索エンジンのデータベース、インデックス作成に用いられているほか、統計調査などの目的にも利用されている。近年では、電子メールアドレス収集業者などもクローラを利用してスパムの送信効率を上げている。 一般にクローラは、既知のHTML文書の新しいコピーを要求して文書中に含まれるリンクをたどり、別の文書を収集するという動作を繰り返す。新しい文書を見つけた場合はデータベースに登録するほか、既知のファイルが存在しないことを検出した場合はデータベースから削除する。
Abstract from DBpedia / Wikipedia · CC BY-SA