论文数据处理与统计分析(完整版).docxVIP

  • 2
  • 0
  • 约9.71千字
  • 约 12页
  • 2026-08-29 发布于山东
  • 举报

论文数据处理与统计分析(完整版).docx

论文数据处理与统计分析(完整版)

第一章论文原始数据归集与初筛

一、原始数据的分类归集标准

1.量化类数据归集规则

所有从问卷、数据库、传感器等渠道采集的连续数值、分类编码类数据,归集时优先保留原始采集的全部有效数字,连续变量有效数字保留位数不低于4位,后续处理阶段再统一调整输出精度。分类变量的编码规则从1开始按顺序赋值,比如性别变量1代表男性,2代表女性,3代表其他,禁止使用0、99等容易和缺失值混淆的编码。样本量低于30的小样本数据集要单独标注数据来源标识,所有归集操作符合GB/T31779-2015科技计划项目数据元规范的相关要求。归集完成后生成原始数据备份文件,设置只读属性,禁止后续任何修改操作,备份文件的命名规则为“项目名称_原始数据_版本V0.0”。

2.质性类数据归集规则

访谈转录、开放问卷文本、田野笔记等质性类数据,归集时逐字转写原始音频或手写内容,删除无意义的语气词、重复冗余表述后,保留的有效内容占原始内容的比例不低于95%。所有文本数据按语义标签预先归类,每类标签下的有效样本量不低于5个,避免出现单类样本量过少无法进行语义分析的问题。归集完成后给每条质性数据分配唯一关联ID,和对应的量化类数据ID保持一致,实现同一研究对象的所有数据一一匹配。

3.衍生类数据归集规则

通过原始数据计算得到的指数、差值、比值等衍生数据,归集时同步保留所有中间计算步骤的数

文档评论(0)

1亿VIP精品文档

相关文档