特征选择
Sign in to saveAlso known as attribute selection, variable selection
procedure in machine learning and statistics
Wikidata facts
- Subclass of
- dimensionality reduction
Show 2 more facts
- Stack Exchange tag
- stackoverflow.com/tags/feature-selection
- Commons category
- Feature selection
Sources (3)
via Wikidata · CC0
Article · 中文
在机器学习和统计学中,特征选择(英語:feature selection)也被称为变量选择、属性选择 或变量子集选择 。它是指:为了构建模型而选择相关特征(即属性、指标)子集的过程。使用特征选择技术有三个原因: * 简化模型,使之更易于被研究人员或用户理解, * 缩短训练时间, * 改善通用性、降低过拟合(即降低方差 ) 要使用特征选择技术的关键假设是:训练数据包含许多冗余 或无关 的特征,因而移除这些特征并不会导致丢失信息。 冗余 或无关 特征是两个不同的概念。如果一个特征本身有用,但如果这个特征与另一个有用特征强相关,且那个特征也出现在数据中,那么这个特征可能是冗余的。 特征选择技术与特征提取有所不同。特征提取是从原有特征的功能中创造新的特征,而特征选择则只返回原有特征中的子集。特征选择技术的常常用于许多特征但样本(即数据点)相对较少的领域。特征选择应用的典型用例包括:解析书面文本和微阵列数据,这些场景下特征成千上万,但样本只有几十到几百个。
Abstract from DBpedia / Wikipedia · CC BY-SA