python – 从pandas dataFrame中删除NaNs

栏目: Python · 发布时间: 6年前

内容简介:翻译自:https://stackoverflow.com/questions/17969878/drop-nans-from-a-pandas-dataframe

我不明白NaN是如何被大熊猫对待的,会很乐意得到一些解释,因为逻辑似乎对我“破坏”.

我有一个csv文件,我使用read csv加载.我在该文件中有一个“注释”列,大多数时候都是空的.

我已经隔离了该列,并尝试了不同的方法来删除空值.首先,当我写作:

marked_results.comments

我明白了:

0       VP
1       VP
2       VP
3     TEST
4      NaN
5      NaN
....

该列的其余部分是NaN.

所以pandas将空条目加载为NaN.到目前为止很棒.

现在我试图删除这些条目.我尝试过:

marked_results.comments.dropna()

并收到相同的专栏.没有什么被丢弃.困惑,我试图理解为什么没有丢弃,所以我尝试:

marked_results.comments==NaN

并收到了一系列法利斯.没有什么是NaNs ……令人困惑.

然后我试过:

marked_results.comments==nan

而且,除了愚蠢之外别无他物.我在那里有点生气,并且认为更聪明.所以我做了:

In [71]:
comments_values = marked_results.comments.unique()
comments_values 
Out[71]:
array(['VP', 'TEST', nan], dtype=object)

啊,得到了!所以我现在尝试过:

marked_results.comments==comments_values[2]

令人惊讶的是,仍然所有的结果都是法利斯!

唯一有效的是:

marked_results.comments.isnull()

它回归了预期的结果.谁能解释一下这里发生了什么?

你应该使用isnull和notnull来测试NaN(这些使用pandas dtypes比numpy更强大),见 “values considered missing” in the docs .

在列上使用Series方法 dropna 不会影响原始数据框,但可以执行您想要的操作:

In [11]: df
Out[11]:
  comments
0       VP
1       VP
2       VP
3     TEST
4      NaN
5      NaN

In [12]: df.comments.dropna()
Out[12]:
0      VP
1      VP
2      VP
3    TEST
Name: comments, dtype: object

dropna DataFrame方法有一个子集参数(用于删除在特定列中具有NaN的行):

In [13]: df.dropna(subset=['comments'])
Out[13]:
  comments
0       VP
1       VP
2       VP
3     TEST

In [14]: df = df.dropna(subset=['comments'])

翻译自:https://stackoverflow.com/questions/17969878/drop-nans-from-a-pandas-dataframe


以上就是本文的全部内容,希望本文的内容对大家的学习或者工作能带来一定的帮助,也希望大家多多支持 码农网

查看所有标签

猜你喜欢:

本站部分资源来源于网络,本站转载出于传递更多信息之目的,版权归原作者或者来源机构所有,如转载稿涉及版权问题,请联系我们

构建高性能Web站点

构建高性能Web站点

郭欣 / 电子工业出版社 / 2009-8 / 59.00元

本书围绕如何构建高性能Web站点,从多个方面、多个角度进行了全面的阐述,涵盖了Web站点性能优化的几乎所有内容,包括数据的网络传输、服务器并发处理能力、动态网页缓存、动态网页静态化、应用层数据缓存、分布式缓存、Web服务器缓存、反向代理缓存、脚本解释速度、页面组件分离、浏览器本地缓存、浏览器并发请求、文件的分发、数据库I/O优化、数据库访问、数据库分布式设计、负载均衡、分布式文件系统、性能监控等。......一起来看看 《构建高性能Web站点》 这本书的介绍吧!

JS 压缩/解压工具
JS 压缩/解压工具

在线压缩/解压 JS 代码

UNIX 时间戳转换
UNIX 时间戳转换

UNIX 时间戳转换

HSV CMYK 转换工具
HSV CMYK 转换工具

HSV CMYK互换工具