Apache Parquet MR 1.12.0 发布,列存储格式

栏目: 软件资讯 · 发布时间: 4年前

内容简介:Apache Parquet MR 1.12.0 已经发布。 Parquet 是支持嵌套数据的通用列文件格式,使用节省空间的编码和用于处理框架(如Hadoop)的压缩和可拆分结构。 主要更新内容 parquet-format-structures 加密 parquet-mr 代...

Apache Parquet MR 1.12.0 已经发布。 Parquet 是支持嵌套数据的通用列文件格式,使用节省空间的编码和用于处理框架(如Hadoop)的压缩和可拆分结构。

主要更新内容

  • parquet-format-structures 加密
  • parquet-mr 代码更改以支持加密
  • 添加空命令
  • [C++] 修复在 32 位结构上产生的损坏文件
  • 修复 Maven Protobuf 插件无法正常工作的问题
  • 修复升级 Scrooge 版本时出现编译错误的问题
  • 修复 API 后向兼容性问题导致主分支构建失败的问题
  • 修复在 ParquetInputSplit 中找不到 FilleInputSplit 的问题
  • 修复 ParquetMetadataConveter 在 Iceberg 单元测试中抛出 NPE 的问题
  • 添加加密密钥管理工具
  • 添加 BYTE_STREAM_SPLIT 编码
  • 添加 parquet 加密的属性驱动接口

详情请查看更新公告


以上就是本文的全部内容,希望对大家的学习有所帮助,也希望大家多多支持 码农网

查看所有标签

猜你喜欢:

本站部分资源来源于网络,本站转载出于传递更多信息之目的,版权归原作者或者来源机构所有,如转载稿涉及版权问题,请联系我们

数据驱动设计

数据驱动设计

[美]罗谢尔·肯(RochelleKing)、[美]伊丽莎白F.邱吉尔(Elizabeth F Churchill)、Caitlin Tan / 傅婕 / 机械工业出版社 / 2018-8 / 69.00元

本书旨在帮你了解数据引导设计的基本原则,了解数据与设计流程整合的价值,避免常见的陷阱与误区。本书重点关注定量实验与A/B测试,因为我们发现,数据分析与设计实践在此鲜有交集,但相对的潜在价值与机会缺大。本书提供了一些关于在组织中开展数据实践的观点。通过阅读这本书,你将转变你的团队的工作方式,从数据中获得大收益。后希望你可以在衡量指标的选择、佳展示方式与展示时机、测试以及设计意图增强方面,自信地表达自......一起来看看 《数据驱动设计》 这本书的介绍吧!

Base64 编码/解码
Base64 编码/解码

Base64 编码/解码

RGB CMYK 转换工具
RGB CMYK 转换工具

RGB CMYK 互转工具