- 374
- 0
- 约1.37千字
- 约 2页
- 2021-02-14 发布于山西
- 举报
六六 DATA
过采样与欠采样之sklearn 实现-解决机器学习之样本不均衡
问题
#查看各个标签的样本量--有多不均衡
from collections import Counter
Counter(y_old.loss_judge)
y_old.shape
y_()
y_old.describe()
######随机过采样######
# 使用imblearn 进行随机过采样
from imblearn.over_sampling import RandomOverSampler
ros = RandomOverSampler(random_state=0)
X_resampled, y_resampled = ros.fit_resample(X_old, y_old)
#查看结果
Counter(y_resampled.loss_judge)
######过采样代表性算法-SMOTE######
# SMOTE 过采样
from imblearn.over_sampling import SMOTE
X_resampled, y_resampled = SMOTE().fit_resamp
您可能关注的文档
最近下载
- 22G610-1 建筑隔震构造详图.pdf VIP
- 煤矿职工应急救援培训内容.pdf VIP
- EASTMAN聚酯与共聚聚酯介绍.ppt VIP
- 2025重庆垫江县鹤游镇本土人才选拔1人备考题库附答案解析.docx VIP
- 编码1《生活中的编码》课件-2026-2027学年四年级上册数学北师大版.pptx VIP
- 人教版数学一年级上册《位置:左右》真题同步练习6(含答案和解析40题).docx VIP
- 2026年浙江生物安全证考试题库及答案解析.docx VIP
- 《中职语文基础知识手册》 专题七 语言表达.pptx
- LNG加气站质量管理体系文件.pdf VIP
- 大学课程《C语言程序设计》PPT教学课件:第2章 顺序结构程序设计.pptx VIP
原创力文档

文档评论(0)