Python数据预处理(汪静 微课版)-习题答案 单元5 课后习题答案.docx

Python数据预处理(汪静 微课版)-习题答案 单元5 课后习题答案.docx

Python数据预处理(汪静微课版)-习题答案

单元5 课后习题答案 填空题 缺失值处理 重复值处理 异常值处理 格式不一致数据处理 duplicated() 最大最小值法 标准差法 箱线图法 to_datetime() 二、判断题 1、错。在pandas中,缺失值一般用NaN表示。 2、 错。 dropna()方法的参数inplace默认为False不改变原数据,inplace=True,才表示删除操作直接修改原数据。 3、对。 4、错。异常值不处理会影响后续数据分析的结果。 5、对。 6、对。 7、错。箱线图中任何在上限和下限之间的数据是正常值,任何高于上限或低于下限的数据认为是异常值。 三、单选题 1、C 2、B 3、A 4、D 5、A 四、编程题 import pandas as pd scores = pd.read_excel(data/scores.xls) #1.缺失值处理 scores[scores.isnull().T.any()] #查看包含缺失值的行 # 通过loc定位缺失值,并填充 scores.loc[1,gender] = female scores.loc[7,gender] = male #2.重复值处理 scores.duplicated().sum() #统计重复值的数量 #ignore_index=True重新分配行标签 scores.drop_duplicates(in

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档