《scikit-learn机器学习常用算法原理及编程实战》—1.4.2 数据清洗
【摘要】 本书摘自《scikit-learn机器学习常用算法原理及编程实战》一书中的第1章,第1.4.2节,编著是黄永昌 .
1.4.2 数据清洗
假设我们采集到的数据里,关于房子面积,有按平方米计算的,也有按平方英尺计算的,这时需要对面积单位进行统一。这个过程称为数据清洗。数据清洗还包括去掉重复的数据及噪声数据,让数据具备结构化特征,以方便作为机器学习算法的输入。
【版权声明】本文为华为云社区用户转载文章,如果您发现本社区中有涉嫌抄袭的内容,欢迎发送邮件进行举报,并提供相关证据,一经查实,本社区将立刻删除涉嫌侵权内容,举报邮箱:
cloudbbs@huaweicloud.com
- 点赞
- 收藏
- 关注作者
评论(0)