Duplicate Row Filter 重复行过滤节点

栏目: IT技术 · 发布时间: 4年前

重点:2/3 难度:1/3

Duplicate Row Filter 重复行过滤节点。在 KNIME 4.0 版本之前,都是没有重复行过滤节点的。但这并不代表之前版本的 KNIME 不能处理重复行问题。在没有这个节点时,可以使用 `GroupBy` 节点来处理重复行的问题。在 4.0 版本之后,有了这个节点,处理重复行问题就更方便了。重复行节点配置中可以让用户选择一行中某几列相同,就可以认为是重复行。我们可以把重复行去除,也可以进行标记保留。标记保留时,会使用 unique、chosen、duplicate 三种状态来进行标识,而保留的原则可以是第一次出现重复、最后一次出现重复,也可以对选定之前相同行认定排除出去不进行比较的列中最大或最小的那一行进行保留。这个节点比较简单,如果想要实验,可以直接下载[这个链接中的 workflow](https://hub.knime.com/knime/spaces/Examples/latest/02_ETL_Data_Manipulation/01_Filtering/08_Filtering_Duplicates) 进行练习掌握。

Duplicate Row Filter 重复行过滤节点

Duplicate Row Filter相同行判定选择页

Duplicate Row Filter 重复行过滤节点

Duplicate Row Filter高级选项页

值得一提的是这个节点的来历:KNIME 曾经发了一份用户问卷调查,作为对用户的感谢,他们挑出社区成员最想要的一个节点并进行实现。而去除重复行就是这个大家都要求的节点!KNIME 不止给了去除重复行的功能,如我们所见,这个节点还可以选定一些策略进行选择和标记。另外,KNIME 社区还有一个叫做 feature request 的子板块,如果你觉得某个功能是用的特别频繁的,可以去给他们提建议!当然,你也可以自己完成节点功能,贡献给社区。


以上就是本文的全部内容,希望本文的内容对大家的学习或者工作能带来一定的帮助,也希望大家多多支持 码农网

查看所有标签

猜你喜欢:

本站部分资源来源于网络,本站转载出于传递更多信息之目的,版权归原作者或者来源机构所有,如转载稿涉及版权问题,请联系我们

神一样的产品经理

神一样的产品经理

闫荣 / 电子工业出版社 / 2012-6-1 / 79.00元

这是一本系统阐述移动与互联网产品从无到有、从有到优的产品经理实践案例著作。《神一样的产品经理:基于移动与互联网产品实践》贯穿着“人如产品,产品如人”、“产品的根基和源泉来自现实生活”的写作理念,表达了产品的成功需要神一样的产品经理管理的观点。 《神一样的产品经理:基于移动与互联网产品实践》由浅入深、循序渐进地阐述了产品经理、产品需求、用户体验、项目管理、产品运营和产品团队管理的内容,理论与实......一起来看看 《神一样的产品经理》 这本书的介绍吧!

图片转BASE64编码
图片转BASE64编码

在线图片转Base64编码工具

UNIX 时间戳转换
UNIX 时间戳转换

UNIX 时间戳转换

HEX CMYK 转换工具
HEX CMYK 转换工具

HEX CMYK 互转工具