pandas妙招之在DataFrame中通过索引高效获取数据

发布时间：2020年10月29日 12:51:11 来源：环球青藤点击量：610

【摘要】相关学习推荐：python教程今天是pandas数据处理专题的第三篇文章，我们一起来聊聊DataFrame中的索引。上一篇文章当中我们介绍了DataFrame数

相关学习推荐：python教程

今天是pandas数据处理专题的第三篇文章，我们一起来聊聊DataFrame中的索引。
上一篇文章当中我们介绍了DataFrame数据结构当中一些常用的索引的使用方法，比如iloc、loc以及逻辑索引等等。今天的文章我们来看看DataFrame的一些基本运算。
数据对齐
我们可以计算两个DataFrame的加和，pandas会自动将这两个DataFrame进行数据对齐，如果对不上的数据会被置为Nan（not a number）。
首先我们来创建两个DataFrame：
import numpy as npimport pandas as pddf1 = pd.DataFrame(np.arange(9).reshape((3, 3)), columns=pst('abc'), index=['1', '2', '3'])df2 = pd.DataFrame(np.arange(12).reshape((4, 3)), columns=pst('abd'), index=['2', '3', '4', '5'])复制代码
得到的结果和我们设想的一致，其实只是通过numpy数组创建DataFrame，然后指定index和columns而已，这应该算是很基础的用法了。
然后我们将两个DataFrame相加，会得到：
我们发现pandas将两个DataFrame加起来合并了之后，凡是没有在两个DataFrame都出现的位置就会被置为Nan。这其实是很有道理的，实际上不只是加法，我们可以计算两个DataFrame的加减乘除的四则运算都是可以的。如果是计算两个DataFrame相除的话，那么除了对应不上的数据会被置为Nan之外，除零这个行为也会导致异常值的发生（可能不一定是Nan，而是inf）。
fill_value
如果我们要对两个DataFrame进行运算，那么我们当然不会希望出现空值。这个时候就需要对空值进行填充了，我们直接使用运算符进行运算是没办法传递参数进行填充的，这个时候我们需要使用DataFrame当中为我们提供的算术方法。
DataFrame当中常用的运算符有这么几种：
add、sub、p这些我们都很好理解，那么这里的radd、rsub方法又是什么意思呢，为什么前面要加上一个r呢？
看起来费解，但是说白了一文不值，radd是用来翻转参数的。举个例子，比如说我们希望得到DataFrame当中所有元素的倒数，我们可以写成1 / df。由于1本身并不是一个DataFrame，所以我们不能用1来呼叫DataFrame当中的方法，也就不能传递参数，为了解决这种情况，我们可以把1 / df写成df.rp(1)，这样我们就可以在其中传递参数了。
由于在算除法的过程当中发生了除零，所以我们得到了一个inf，它表示无穷大。
我们可以在add、p这些方法当中传入一个fill_value的参数，这个参数可以在计算之前对于一边出现缺失值的情况进行填充。也就是说对于对于只在一个DataFrame中缺失的位置会被替换成我们指定的值，如果在两个DataFrame都缺失，那么依然还会是Nan。
我们对比下结果就能发现了，相加之后的(1, d), (4, c)以及(5, c)的位置都是Nan，因为df1和df2两个DataFrame当中这些位置都是空值，所以没有被填充。
fill_value这个参数在很多api当中都有出现，比如reindex等，用法都是一样的，我们在查阅api文档的时候可以注意一下。
那么对于这种填充了之后还出现的空值我们应该怎么办呢？难道只能手动找到这些位置进行填充吗？当然是不现实的，pandas当中还为我们提供了专门解决空值的api。
空值api
在填充空值之前，我们首先要做的是发现空值。针对这个问题，我们有isna这个api，它会返回一个bool型的DataFrame，DataFrame当中的每一个位置表示了原DataFrame对应的位置是否是空值。
dropna
当然只是发现是否是空值肯定是不够的，我们有时候会希望不要空值的出现，这个时候我们可以选择drop掉空值。针对这种情况，我们可以使用DataFrame当中的dropna方法。
我们发现使用了dropna之后，出现了空值的行都被抛弃了。只保留了没有空值的行，有时候我们希望抛弃是的列而不是行，这个时候我们可以通过传入axis参数进行控制。
这样我们得到的就是不含空值的列，除了可以控制行列之外，我们还可以控制执行drop的严格程度。我们可以通过how这个参数来判断，how支持两种值传入，一种是'all'，一种是'any'。all表示只有在某一行或者是某一列全为空值的时候才会抛弃，any与之对应就是只要出现了空值就会抛弃。默认不填的话认为是any，一般情况下我们也用不到这个参数，大概有个印象就可以了。
fillna
pandas除了可以drop含有空值的数据之外，当然也可以用来填充空值，事实上这也是最常用的方法。
我们可以很简单地传入一个具体的值用来填充：
fillna会返回一个新的DataFrame，其中所有的Nan值会被替换成我们指定的值。如果我们不希望它返回一个新的DataFrame，而是直接在原数据进行修改的话，我们可以使用inplace参数，表明这是一个inplace的操作，那么pandas将会在原DataFrame上进行修改。
df3.fillna(3, inplace=True)复制代码
除了填充具体的值以外，我们也可以和一些计算结合起来算出来应该填充的值。比如说我们可以计算出某一列的均值、最大值、最小值等各种计算来填充。fillna这个函数不仅可以使用在DataFrame上，也可以使用在Series上，所以我们可以针对DataFrame中的某一列或者是某些列进行填充：
除了可以计算出均值、最大最小值等各种值来进行填充之外，还可以指定使用缺失值的前一行或者是后一行的值来填充。实现这个功能需要用到method这个参数，它有两个接收值，ffill表示用前一行的值来进行填充，bfill表示使用后一行的值填充。
我们可以看到，当我们使用ffill填充的时候，对于第一行的数据来说由于它没有前一行了，所以它的Nan会被保留。同样当我们使用bfill的时候，最后一行也无法填充。
总结
今天的文章当中我们主要介绍了DataFrame的一些基本运算，比如最基础的四则运算。在进行四则运算的时候由于DataFrame之间可能存在行列索引不能对齐的情况，这样计算得到的结果会出现空值，所以我们需要对空值进行处理。我们可以在进行计算的时候通过传入fill_value进行填充，也可以在计算之后对结果进行fillna填充。
在实际的运用当中，我们一般很少会直接对两个DataFrame进行加减运算，但是DataFrame中出现空置是家常便饭的事情。因此对于空值的填充和处理非常重要，可以说是学习中的重点，大家千万注意。
想了解更多编程学习，敬请关注php培训栏目！
以上就是小编分享的关于pandas妙招之在DataFrame中通过索引高效获取数据的详细内容希望对大家有所帮助，更多有关python教程请关注环球青藤其它相关文章！

分享到：编辑：wangmin

上一篇：怎么查看python版本? 下一篇：使用pandas进行数据处理之 DataFrame篇

就业培训申请领取

您的姓名

您的电话

意向课程
点击领取

环球青藤
官方QQ群

扫描上方二维码或点击一键加群，免费领取大礼包，加群暗号：青藤。一键加群

Python编程相关文章推荐
|
Python编程最新文章推荐

适用于应用程序开发的python编程工具有哪些?

获得python认证有哪些作用?

零基础怎样快速入门Python语言?

python编程未来就业方向有哪些?

初学者学习Python编程面临哪些挑战?

Python编程是什么?

学习Python需要多长时间?

使用Python的常见方式有哪些?

Python和Java的不同之处在哪里?

小白如何学习Python编程?

资深程序员都在用哪些工具?

学编程的必备素养有哪些?

适用于应用程序开发的python编程工具有哪些?

获得python认证有哪些作用?

程序员面试常见的问题有哪些?

零基础怎样快速入门Python语言?

python编程未来就业方向有哪些?

初学者学习Python编程面临哪些挑战?

Python编程是什么?

学习Python需要多长时间?

免费直播更多

绑定手机号

应《中华人民共和国网络安全法》加强实名认证机制要求,同时为更加全面的体验产品服务,烦请您绑定手机号.

获取短信验证码

提交

预约成功

预约成功

本直播为付费学员的直播课节

请您购买课程后再预约

我要购买

强力推荐!非常全的Python学习资料

Python编程基础语法，你了解吗?

学python好就业吗

行业动态| 实战技能| 求职就业|

资深程序员都在用哪些工具?

学编程的必备素养有哪些?

适用于应用程序开发的python编程工具有哪些?

获得python认证有哪些作用?

程序员面试常见的问题有哪些?

零基础怎样快速入门Python语言?

初学者学习Python编程面临哪些挑战?

Python编程是什么?

学习Python需要多长时间?

使用Python的常见方式有哪些?

零基础学习Python看哪些书?

零基础学编程应该学习什么?

Python与C语言有什么区别?

用Python编程需要哪些软件?

Python编程需要用什么软件?

Python中如何添加注释?

如何批量更新已安装的库?

怎样规划python学习路线?

学习Python编程有哪些方法?

python数据挖掘工具有哪些?

python编程未来就业方向有哪些?

python编程的就业方向有哪些?

java和python哪个发展前景好?

Python编程的职业方向有哪些?

Python编程有哪些就业岗位?

学习Python编程工作好找吗?

python新手如何成为优秀程序员?

python初学者如何找到自己的方向?

2021年Python发展趋势如何?

学习Python可以做什么工作?

最新文章

1 2022年中级经济师报名不成功的原因

2 2022年一建报考的科目有哪些

3 2022年一建报考有什么条件

4 2022年中级经济师报考时间及报考条件

5 2022年报考一建是什么时候

6 2022年一级建造师报名是在哪个网站

7 2022年中级经济师报名审核资料有哪些

8 一建年限

9 2022中级经济师报名官网

10 2022年中级经济师考试评分标准及答题技巧

Python编程各地入口
安徽北京兵团福建甘肃广东广西贵州海南河北河南黑龙江湖北湖南吉林江苏江西辽宁内蒙古宁夏青海山东山西陕西上海四川天津西藏新疆云南浙江重庆

环球青藤移动课堂APP 直播、听课。职达未来！

安卓版
下载

iPhone版
下载

环球青藤官方微信服务平台

刷题看课 APP下载

免费直播一键购课

代报名等人工服务

Python编程热点排行

1 python变量名是什么

2 python不支持的数据类型是什么

3 python如何求阶乘

4 python中abs是什么意思

5 python中的def是什么意思

6 python如何读取excel文件?

7 python字典怎么添加元素

8 python运算符优先级顺序是什么？

9 python中randint函数的用法是什么？

10 Python Launcher 可以卸载吗？

pandas妙招之 在DataFrame中通过索引高效获取数据

就业培训申请领取

Python编程相关文章推荐

Python编程最新文章推荐

绑定手机号

pandas妙招之在DataFrame中通过索引高效获取数据