文本挖掘
Sign in to saveAlso known as text data mining, textmining, text-mining, text analytics, text analysis, automatic text analysis
process of analysing text to extract information from it
Wikidata facts
- Subclass of
- natural language processing
- Image
- Tripletsnew2012.png
- Has use
- digital humanities
Show 3 more facts
- exact match
- edamontology.org/operation_0306
- Stack Exchange tag
- stackoverflow.com/tags/text-mining
- Commons category
- Text mining
via Wikidata · CC0
Article · 中文
文本挖掘(Text mining)有时也被称为文字探勘、文本数据挖掘等,大致相当于文字分析,一般指文本处理过程中产生高质量的信息。高质量的信息通常通过分类和预测来产生,如模式识别。文本挖掘通常涉及输入文本的处理过程(通常进行分析,同时加上一些衍生语言特征以及消除杂音,随后插入到数据库中) ,产生结构化数据,并最终评价和解释输出。'高品质'的文本挖掘通常是指某种组合的相关性,新颖性和趣味性。典型的文本挖掘方法包括,,概念/实体挖掘,生产精确分类,,和实体关系模型(即,学习之间的关系) 。文本分析包括了信息检索与词典分析来研究词语的频数分布、模式识别、标签\注释、信息抽取,数据挖掘技术包括链接和关联分析、可视化和预测分析。本质上,首要的任务是,通过自然语言处理(NLP)和分析方法,将文本转化为数据进行分析。
Abstract from DBpedia / Wikipedia · CC BY-SA