2026年数据分析员Python与数据清洗原创模拟题.docxVIP

  • 1
  • 0
  • 约5.64千字
  • 约 8页
  • 2026-08-06 发布于湖北
  • 举报

2026年数据分析员Python与数据清洗原创模拟题.docx

2026年数据分析员Python与数据清洗原创模拟题

一、单项选择题(每题2分,共20分)

1.在使用Pandas读取CSV文件时,若数据中存在缺失值,以下哪个参数组合可以在读取时自动处理?

A.pd.read_csv(file,skiprows=True)

B.pd.read_csv(file,na_values=[NA,N/A,],keep_default_na=True)

C.pd.read_csv(file,drop_na=True)

D.pd.read_csv(file,fillna=0)

答案:B

解析:na_values参数可以指定哪些字符串应被识别为缺失值,keep_default_na=True保留默认的缺失值标识符。A选项skiprows是跳过行而非处理缺失值;C选项drop_na不是read_csv的有效参数;D选项fillna是DataFrame方法而非read_csv参数。

2.某数据分析员需要检测数据集中的异常值,以下哪种方法对极端值最为敏感?

A.中位数绝对偏差(MAD)

B.Z-Score标准化法(|Z|3判定为异常)

C.四分位距法(IQR)

D.基于箱线图的Tukey法

答案:B

解析:Z-Score法基于均值和标准差,而均值和标准差对极端值非常敏感,一个极端值就能显著拉高标准差。MAD基于中位数,IQR

文档评论(0)

1亿VIP精品文档

相关文档