Apache Beam 2.27.0 发布,大数据流处理与批处理编程范式

栏目: 软件资讯 · 发布时间: 4年前

内容简介:Apache Beam 2.27.0 发布了。Beam 是一个用于定义和执行数据处理管道的统一编程模型,包括 ETL、批处理与流处理。Beam 项目重点在于数据处理的编程范式和接口定义,并不涉及具体执行引擎的实现,理想情况是基于 ...

Apache Beam 2.27.0 发布了。Beam 是一个用于定义和执行数据处理管道的统一编程模型,包括 ETL、批处理与流处理。Beam 项目重点在于数据处理的编程范式和接口定义,并不涉及具体执行引擎的实现,理想情况是基于 Beam 开发的数据处理程序可以执行在任意的分布式计算引擎上。

此版本主要更新内容如下:

Highlights

  • Java 11 Containers 现已随所有 Beam 版本一起发布。

  • 有一个新的转换ReadAllFromBigQuery,可以在管道运行时接收多个从 BigQuery 读取数据的请求。参见 PR 13170 和 BEAM-9650

I/Os

  • ReadFromMongoDB 现在可以与 MongoDB Atlas (Python) 一起使用(BEAM-11266

  • ReadFromMongoDB/WriteToMongoDB 将屏蔽 display_data (Python) 中的密码(BEAM-11444
  • 有一个新的转换ReadAllFromBigQuery,可以在管道运行时接收多个从 BigQuery 读取数据的请求。参见 PR 13170 和 BEAM-9650

New Features / Improvements

  • 依赖于 Hadoop 的 Beam 模块现在已经测试了与 Hadoop 3 的兼容性(BEAM-8569)。(Hive/HCatalog pending)

  • 作为 Apache Beam 发行过程的一部分,现在支持发布 Java 11 SDK 容器镜像。(BEAM-8106
  • 向 Beam SQL 添加了 Cloud Bigtable Provider 扩展(BEAM-11173BEAM-11373
  • 为 thrift data 添加了一个 schema provider(BEAM-11338
  • 在 Dataflow runner 中添加了 combiner packing pipeline 优化(BEAM-10641

Breaking Changes

  • HBaseIO hbase-shaded-client 依赖项现在应该由用户提供(BEAM-9278

  • amazon-web-services2 中的--region标志已被-awsRegion替代(BEAM-11331

更新说明:https://github.com/apache/beam/releases/tag/v2.27.0


以上所述就是小编给大家介绍的《Apache Beam 2.27.0 发布,大数据流处理与批处理编程范式》,希望对大家有所帮助,如果大家有任何疑问请给我留言,小编会及时回复大家的。在此也非常感谢大家对 码农网 的支持!

查看所有标签

猜你喜欢:

本站部分资源来源于网络,本站转载出于传递更多信息之目的,版权归原作者或者来源机构所有,如转载稿涉及版权问题,请联系我们

鼠标宣言

鼠标宣言

约翰·里德尔 / 倪萍、梅清豪 / 上海人民 / 2005-08-01 / 25.00

本书针对信息时代营销者不知该如何满足消费者的营销困境,提出了崭新的解决方案——以新技术为基础的群体筛选和推荐系统。随着信息管理软件和internet的高速发展,群体筛选技术下的推荐系统通过大量有关消费者偏好和购物记录的信息,以及对产品特征的准确把握,能够为消费者进行精确的推荐,提高了消费者的购物效率和准确度以及营销者的营销效率和竞争力。本书通过通俗而到位的讲解,向读者全面介绍了有关群体筛选技术的理......一起来看看 《鼠标宣言》 这本书的介绍吧!

HTML 压缩/解压工具
HTML 压缩/解压工具

在线压缩/解压 HTML 代码

JS 压缩/解压工具
JS 压缩/解压工具

在线压缩/解压 JS 代码

Markdown 在线编辑器
Markdown 在线编辑器

Markdown 在线编辑器