随笔分类 -  数据挖掘概念与技术

摘要:3.1 数据预处理 数据质量的三个要素:准确性、完整性和一致性。 3.1.2 数据预处理的主要任务 数据清理:填写缺失的值,光滑噪声数据,识别或删除离群点,并解决不一致性来”清理“数据。 数据集成: 数据归约: 3.2 数据清理 3.2.1 缺失值 1.忽略元组 2.人工填写缺失值 3.使用一个全局 阅读全文
posted @ 2016-02-14 21:22 地表最强队队员 阅读(2185) 评论(0) 推荐(0)
摘要:2.1 数据对象与属性类型2.1.1 什么是属性2.1.2 标称属性:其值是一些符号或事物的名称。每个值代表某种类别、编码或状态,因此标称属性又被看作是分类的。 标称属性不是定量的,找出它的均值或中位数没有意义,有意义的是找到众数,是一种中心趋势度量。2.1.3 二元属性:是一种标称属性,只有两个... 阅读全文
posted @ 2016-01-24 18:13 地表最强队队员 阅读(1404) 评论(0) 推荐(0)