处理大批量文本数据9.docxVIP

  • 3
  • 0
  • 约7.77千字
  • 约 7页
  • 2018-11-26 发布于江苏
  • 举报
处理大批量文本数据9

如何批量处理文本文件 最近数据堂为了弄数据挖掘比赛提供了一批用户行为日志数据。对于以前没玩过的数据,我是特别的好奇。处理这批文本文件确实花了不少时间。数据以不同的日期作文件夹分别存放,每个文件夹中又有近一千个文本文件,每个文件都是一个用户的行为日志。为了分析这些数据,首先需要将这两万个文本文件读入R中,再用字符串函数进行处理成结构化的数据。处理方法如下: library( HYPERLINK /packages/cran/stringr stringr) HYPERLINK /r-doc/base/setwd setwd(D:\\kaggle\\tang\\data) HYPERLINK /r-doc/utils/data data - HYPERLINK /r-doc/utils/read.table read.table(data.csv,T,sep=,) ? # 读入文档地址 path - D:\\kaggle\\tang\\data\\behavior - HYPERLINK /r-doc/base/dir dir(D:\\kaggle\\tang\\data\\behavior) - HYPERLINK /r-doc/base/list list() fre - HYPERLINK /r-doc/base/numeric numeric() for (i

文档评论(0)

1亿VIP精品文档

相关文档