- 1
- 0
- 约9.76千字
- 约 10页
- 2026-08-12 发布于北京
- 举报
frompyspark.sqlimportSparkSession
frompyspark.sql.typesimport*
spark=SparkSession.builder.appName(file).getOrCreate()员工=[
(1,John,25),(2,Ray,35),(3,Mike,24),(4,Jane,28),(5,Kevin,26),(6,Vincent,35),(7,James,38),(8,
Shane,32),(9,Larry,29),(10,Kimberly,29),(11,Alex,28),(12,Garry,25),(13,Max,31)]模式=
_
StructType([StructField(empid,IntegerType(),True),StructField(name,StringType(),True),
StructField(age,IntegerType(),True)])df=spark.createDataFrame(employees,schema=schema)
#查看字段名称及数据类型
df.dypes
#打印数据
df.show()
#打印数据前两行
df.head(2)
#打印数据第一行
df.firs
您可能关注的文档
最近下载
- 妊娠期心肺复苏中国急诊专家共识.pptx VIP
- 马工程-中国古代文学史(第二版)上册第一编先秦文学全套PPT课件-50109.pptx
- 2026中国医疗旅游服务市场现状供需分析及投资评估规划分析研究报告.docx
- [青海]青海省省检察机关第七批检察官入额遴选66人笔试历年常考点试题专练附带答案详解.docx VIP
- [安庆项目资料库]污水4、污水规划.pdf
- 液体洗涤剂护色的解决方案.pdf VIP
- 食品配送车辆清洁消毒管理.docx VIP
- TCAPE-10001-2017-《设备管理体系要求》-20170601(1).pdf VIP
- 2022年山西高考语文真题及答案.pdf VIP
- ISO14001-2026环境管理体系要求及使用指南中文版.docx VIP
原创力文档

文档评论(0)