博客
关于我
【数据分析与预处理】 ---- 数据的提取与筛选
阅读量:328 次
发布时间:2019-03-04

本文共 827 字,大约阅读时间需要 2 分钟。


文章目录


1.读取数据

data = pd.read_csv("G:\Projects\pycharmeProject\大数据比赛\data\mysql.csv")print(data.shape)

2.数据的提取与筛选

2.1 增加某一列

2.1.1 以原数据的索引添加列

data['index'] = data.index

在这里插入图片描述

2.1.2 以国家数据添加列

data['country'] = data['国家']

在这里插入图片描述


2.2 删除特定列 drop(columns=’?’)

data_drop = data.drop(columns='index')

在这里插入图片描述


2.3 删除特定行 — 根据索引删除 drop(index=[?],axis=1)

data_drop_index = data.drop(index=1,axis=1)data_drop_mulIndex = data.drop(index=[1,2,3,4,5],axis=1)

在这里插入图片描述

在这里插入图片描述


2.4 删除特定值的记录

2.4.1 找出特定值所在行进行筛选

方法一 drop(index=data_target_index,axis=1)

data_condition = data['城市'] == '阿坝'data_target = data.loc[data_condition]data_target_index = data_target.indexdata_drop_target_index = data.drop(index=data_target_index,axis=1)

在这里插入图片描述

在这里插入图片描述
在这里插入图片描述


方法二 loc[~data_condition]

data_condition = data['城市'].isin(['阿坝'])data_target = data.loc[data_condition]data_without_target = data.loc[~data_condition]   # 加个~号

在这里插入图片描述

在这里插入图片描述
在这里插入图片描述


转载地址:http://bzeq.baihongyu.com/

你可能感兴趣的文章
MySQL事务详解结合MVCC机制的理解
查看>>
MySQL事务隔离级别:读未提交、读已提交、可重复读和串行
查看>>
MySQL事务隔离级别:读未提交、读已提交、可重复读和串行
查看>>
webpack css文件处理
查看>>
mysql二进制包安装和遇到的问题
查看>>
MySql二进制日志的应用及恢復
查看>>
mysql互换表中两列数据方法
查看>>
mysql五补充部分:SQL逻辑查询语句执行顺序
查看>>
mysql交互式连接&非交互式连接
查看>>
MySQL什么情况下会导致索引失效
查看>>
Mysql什么时候建索引
查看>>
MySql从入门到精通
查看>>
MYSQL从入门到精通(一)
查看>>
MYSQL从入门到精通(二)
查看>>
mysql以下日期函数正确的_mysql 日期函数
查看>>
mysql以服务方式运行
查看>>