Twitter已经用Heron替换了Storm

栏目: 服务器 · 发布时间: 8年前

内容简介：Twitter已经用Heron替换了Storm

Twitter已经用Heron替换了Storm。此举将吞吐量最高提升了14倍，单词计数拓扑时间延迟最低降到了原来的1/10，所需的硬件减少了2/3。

Twitter使用 Storm 实时分析海量数据已经有好几年了，并在2011年将其开源。该项目稍后开始在Apache基金会孵化，并在去年秋天成为顶级项目。Storm以季度为发布周期，现在已经达到了0.9.5版本，并且正在向着人们期望的1.0稳定版前进。但一直以来，Twitter都在致力于开发替代方案Heron，因为Storm无法满足他们的实时处理需求。

Twitter的新实时处理需求包括：“每分钟数十亿的事件；大规模处理具有次秒级延迟和可预见的行为；在故障情况下，具有很高的数据准确性；具有很好的弹性，可以应对临时流量峰值和管道阻塞；易于调试；易于在共享基础设施中部署。” Karthik Ramasamy 是Twitter Storm/Heron团队的负责人。据他介绍，为满足这些需求，他们已经考虑了多个选项：增强Storm、使用一种不同的开源解决方案或者创建一个新的解决方案。增强Storm需要花费很长时间，也没有其它的系统能够满足他们在扩展性、吞吐量和延迟方面的需求。而且，其它系统也不兼容Storm的API，需要重写所有拓扑。所以，最终的决定是创建Heron，但保持其外部接口与Storm的接口兼容。

拓扑部署在一个 Aurora 调度器上，而后者将它们作为一个由多个容器（cgroups）组成的任务来执行：一个Topology Master、一个Stream Manager、一个Metrics Manager（用于性能监控）和多个Heron 实例(spouts和bolts)。拓扑的元数据保存在ZooKeeper中。处理流程通过一种反压机制实现调整，从而控制流经拓扑的数据量。除Aurora外，Heron还可以使用其它服务调度器，如YARN或Mesos。实例运行用户编写的 Java 代码，每个实例一个JVM。Heron通过协议缓冲处理彼此间的通信，一台机器上可以有多个容器。（要了解更多关于Heron内部架构的细节信息，请阅读论文《 Twitter Heron：大规模流处理》。）

Twitter已经用Heron完全替换了Storm。前者现在每天处理“数10TB的数据，生成数10亿输出元组”，在一个标准的单词计数测试中，“吞吐量提升了6到14倍，元组延迟降低到了原来的五到十分之一”，硬件减少了2/3。

当被问到Twitter是否会开源Heron时，Ramasamy说“在短时间内不会，但长期来看可能。”

以上所述就是小编给大家介绍的《Twitter已经用Heron替换了Storm》，希望对大家有所帮助，如果大家有任何疑问请给我留言，小编会及时回复大家的。在此也非常感谢大家对码农网的支持！

查看所有标签

猜你喜欢:

本站部分资源来源于网络，本站转载出于传递更多信息之目的，版权归原作者或者来源机构所有，如转载稿涉及版权问题，请联系我们。

码农书籍

反欺骗的艺术

(美) 米特尼克(Mitnick, K. D.) / 潘爱民 / 清华大学出版社 / 2014-7-1 / 49.80元

凯文•米特尼克(Kevin D. Mitnick)曾经是历史上最令FBI头痛的计算机顽徒之一，现在他已经完成了大量的文章、图书、影片和记录文件。自从2000年从联邦监狱中获释以来，米特尼克改变了他的生活方式，成了全球广受欢迎的计算机安全专家之一。在他的首部将功补过的作品中，这位全世界最著名的黑客为“放下屠刀，立地成佛”这句佛语赋予了新的含义。在《反欺骗的艺术——世界传奇黑客的经历分享》中，......一起来看看《反欺骗的艺术》这本书的介绍吧!

码农工具

Twitter已经用Heron替换了Storm

反欺骗的艺术

JS 压缩/解压工具

在线进制转换器

HEX HSV 转换工具