数据生命周期中y可以通过数据质量管理的方法和手段y在数据生成

使用消亡的过程里y及时发现有缺陷的数据y然后借助数据管理手

段y将数据正确化和规范化y从而达到符合要求的数据质量标准总

体而言y数据质量管理覆盖质量评估数据去噪数据监控数据探

查数据清洗数据诊断等方面y而在这个过程中y数据清洗是决定

数据质量好坏的重要因素。

数据清洗按照实现方式y可以分为手工清洗和自动清洗

??

1??手工清洗x手工清洗是通过人工方式对数据进行检查y发现数据中

的错误这种方式比较简单y只要投入足够的人力物力财力y也能