Skip to content
EntityQ773196· pop 27· linked from 245 articles

Also known as Apache Lucene Core, Lucene Core, Java Lucene

Java library for full-text search

Described at

Link to a page describing this subject · 2,569 chars · not written by Vinony

Source code

1. Install JDK 25 using your package manager or download manually from OpenJDK, Adoptium, Azul, Oracle or any other JDK provider. 2. Clone Lucene's git repository (or download the source distribution). 3. Run gradle launcher script ( gradlew ). We'll assume that you know how to get and set up the JDK - if you don't, then we suggest starting at and learning more about Java, before returning to this README. Bug fixes, improvements and new features are always welcome! Please review the Contributing to Lucene Guide for information on contributing. Additional Developer Documentation: dev-docs/ Discussion and Support Users Mailing List Developers Mailing List IRC: lucene and lucene-dev on freenode.net

Excerpt from the source-code README · 3,053 chars · not written by Vinony

Wikidata facts

Official website
lucene.apache.org
Show 10 more facts
programmed in
Java
software version identifier
10.4.0
Commons category
Apache Lucene
inception
2000-03-30
operating system
cross-platform
native label
Apache Lucene
source code repository URL
github.com/apache/lucene
Sources (5)

via Wikidata · CC0

Article · Русский

Lucene — свободная библиотека для высокопроизводительного полнотекстового поиска фонда Apache, используемая в качестве основы в двух самых популярных по состоянию на середину 2010-х годов тиражируемых поисковых системах — Elasticsearch и Solr. Написана на Java. Разработана (англ. Doug Cutting) в 1999 году, изначально была выложена автором на SourceForge.net. В 2001 году передана в фонд Apache, где вначале развивалась в рамках проекта Jakarta, и перешла в 2005 году в статус проекта верхнего уровня фонда. В рамках проекта верхнего уровня Lucene породила ряд подпроектов, ставших самостоятельными, среди них — Hadoop (инициированный Каттингом и сформировавшим обширную экосистему продуктов), Nutch и Solr (считающийся частью экосистемы Hadoop). Кроме того, библиотека используется в качестве внутреннего механизма в ряде проектов, среди которых YaCy (децентрализованная поисковая система), (документоориентированная СУБД с поддержкой SQL), (тиражируемая поисковая система для организаций), DocFetcher (локальный поисковик). Основная функциональная особенность библиотеки — обеспечение масштабируемой и достаточно высокоскоростной индексации (порядка 100 Гбайт в час на сервере массового класса). Создаваемый индекс занимает примерно 20—30 % от размера исходного текста. Поисковый алгоритм поддерживает ранжированный поиск (лучшие результаты показываются первыми), , реализовано множество различных типов запросов (запрос фразы, запросы с символами подстановки, поиск интервалов и другие), поиск по значениям метаданных (таких как заголовок, автор, текст). Поддерживается поиск по нескольким индексам с возможностью объединения результатов, реализована сортировка результатов поиска по различным полям. Поиск возможен одновременно с процессом обновления индекса. Логическая архитектура библиотеки представляет любой документ как набор текстовых полей, что позволяет ей функционировать вне зависимости от форматов, как только текстовая информация из них может быть получена. Портирована на многие другие языки программирования: Си (Lucene4c), C++ (CLucene), Node.js, Go, Delphi (MUTIS), Perl (PLucene), Ruby (Ferret и RubyLucene), PHP (в рамках фреймворка Zend), Lisp (Montezuma), C# (Lucene.Net), Python (PyLucene).

Abstract from DBpedia / Wikipedia · CC BY-SA