- 3
- 0
- 约7.77千字
- 约 7页
- 2018-11-26 发布于江苏
- 举报
处理大批量文本数据9
如何批量处理文本文件
最近数据堂为了弄数据挖掘比赛提供了一批用户行为日志数据。对于以前没玩过的数据,我是特别的好奇。处理这批文本文件确实花了不少时间。数据以不同的日期作文件夹分别存放,每个文件夹中又有近一千个文本文件,每个文件都是一个用户的行为日志。为了分析这些数据,首先需要将这两万个文本文件读入R中,再用字符串函数进行处理成结构化的数据。处理方法如下:
library( HYPERLINK /packages/cran/stringr stringr)
HYPERLINK /r-doc/base/setwd setwd(D:\\kaggle\\tang\\data)
HYPERLINK /r-doc/utils/data data - HYPERLINK /r-doc/utils/read.table read.table(data.csv,T,sep=,)
?
# 读入文档地址
path - D:\\kaggle\\tang\\data\\behavior
- HYPERLINK /r-doc/base/dir dir(D:\\kaggle\\tang\\data\\behavior)
- HYPERLINK /r-doc/base/list list()
fre - HYPERLINK /r-doc/base/numeric numeric()
for (i
原创力文档

文档评论(0)