博客
关于我
【数据分析与预处理】 ---- 数据的提取与筛选
阅读量:328 次
发布时间:2019-03-04

本文共 707 字,大约阅读时间需要 2 分钟。

读取数据

使用 pd.read_csv 读取数据文件:

data = pd.read_csv("G:\Projects\pycharmeProject\大数据比赛\data\mysql.csv")print(data.shape)

数据的提取与筛选

增加某一列

以原数据的索引添加列
data['index'] = data.index
以国家数据添加列
data['country'] = data['国家']

删除特定列

data_drop = data.drop(columns='index')

删除特定行

data_drop_index = data.drop(index=1, axis=1)data_drop_mulIndex = data.drop(index=[1,2,3,4,5], axis=1)

删除特定值的记录

方法一:基于索引删除
data_condition = data['城市'] == '阿坝'data_target = data.loc[data_condition]data_target_index = data_target.indexdata_drop_target_index = data.drop(index=data_target_index, axis=1)
方法二:使用 loc~ 进行筛选
data_condition = data['城市'].isin(['阿坝'])data_without_target = data.loc[~data_condition]

结论

通过以上方法,我们可以对数据进行必要的提取和筛选,确保数据的完整性和准确性。

转载地址:http://bzeq.baihongyu.com/

你可能感兴趣的文章
pcie握手机制_【博文连载】PCIe扫盲——Ack/Nak 机制详解(一)
查看>>
pcm转wav的方法及代码示例
查看>>
PC史上最悲剧的16次失败
查看>>
PC端恶意代码分析Lab1.1-5.1,从零基础到精通,收藏这篇就够了!
查看>>
PC端稳定性测试探索
查看>>
PC端编辑 但能在PC端模拟移动端预览的富文本编辑器
查看>>
PDB文件:每个开发人员都必须知道的
查看>>
springMVC学习(二)
查看>>
Pdfkit页眉和页脚
查看>>
PDF中的Pandoc语法突出显示不起作用
查看>>
pdf从结构新建书签_在PDF文件中怎样创建书签
查看>>
pdf做成翻页电子书_第一弹:常见BOOX电子书阅读器问题解答,这些技能你都会吗?...
查看>>
PDF工具箱-分割提取合并
查看>>
pdf打印骑缝章
查看>>
PDF文字识/编辑?这个工具真的很强大!
查看>>
pdf文档出现乱码如何修改
查看>>
pdf根据模板导出
查看>>
PDF调出本来存在的书签面板
查看>>
pdf转图片
查看>>
pdf转图片、提取pdf文本、提取pdf图片
查看>>