Skip to content
EntityQ446488· pop 17· linked from 111 articles

特征选择

Sign in to save

Also known as attribute selection, variable selection

procedure in machine learning and statistics

Wikidata facts

Show 2 more facts
Commons category
Feature selection
Sources (3)

via Wikidata · CC0

Article · 中文

在机器学习和统计学中,特征选择(英語:feature selection)也被称为变量选择、属性选择 或变量子集选择 。它是指:为了构建模型而选择相关特征(即属性、指标)子集的过程。使用特征选择技术有三个原因: * 简化模型,使之更易于被研究人员或用户理解, * 缩短训练时间, * 改善通用性、降低过拟合(即降低方差 ) 要使用特征选择技术的关键假设是:训练数据包含许多冗余 或无关 的特征,因而移除这些特征并不会导致丢失信息。 冗余 或无关 特征是两个不同的概念。如果一个特征本身有用,但如果这个特征与另一个有用特征强相关,且那个特征也出现在数据中,那么这个特征可能是冗余的。 特征选择技术与特征提取有所不同。特征提取是从原有特征的功能中创造新的特征,而特征选择则只返回原有特征中的子集。特征选择技术的常常用于许多特征但样本(即数据点)相对较少的领域。特征选择应用的典型用例包括:解析书面文本和微阵列数据,这些场景下特征成千上万,但样本只有几十到几百个。

Abstract from DBpedia / Wikipedia · CC BY-SA