内容简介:Apache Parquet MR 1.12.0 已经发布。 Parquet 是支持嵌套数据的通用列文件格式,使用节省空间的编码和用于处理框架(如Hadoop)的压缩和可拆分结构。 主要更新内容 parquet-format-structures 加密 parquet-mr 代...
Apache Parquet MR 1.12.0 已经发布。 Parquet 是支持嵌套数据的通用列文件格式,使用节省空间的编码和用于处理框架(如Hadoop)的压缩和可拆分结构。
主要更新内容
- parquet-format-structures 加密
- parquet-mr 代码更改以支持加密
- 添加空命令
- [C++] 修复在 32 位结构上产生的损坏文件
- 修复 Maven Protobuf 插件无法正常工作的问题
- 修复升级 Scrooge 版本时出现编译错误的问题
- 修复 API 后向兼容性问题导致主分支构建失败的问题
- 修复在 ParquetInputSplit 中找不到 FilleInputSplit 的问题
- 修复 ParquetMetadataConveter 在 Iceberg 单元测试中抛出 NPE 的问题
- 添加加密密钥管理工具
- 添加 BYTE_STREAM_SPLIT 编码
- 添加 parquet 加密的属性驱动接口
详情请查看更新公告。
以上就是本文的全部内容,希望对大家的学习有所帮助,也希望大家多多支持 码农网
猜你喜欢:- Lucene列式存储格式DocValues详解
- Apache Cassandra SSTable 存储格式详解
- IEEE754标准的浮点数存储格式
- PyTorch 1.5 发布,C++ 前端重大更新、引入新存储格式提高性能
- [译] 比较 Apache Hadoop 生态系统中不同的文件格式和存储引擎的性能
- 基于Hadoop生态系统的一高性能数据存储格式CarbonData(性能篇)
本站部分资源来源于网络,本站转载出于传递更多信息之目的,版权归原作者或者来源机构所有,如转载稿涉及版权问题,请联系我们。
Modeling the Internet and the Web
Pierre Baldi、Paolo Frasconi、Padhraic Smyth / Wiley / 2003-7-7 / USD 115.00
Modeling the Internet and the Web covers the most important aspects of modeling the Web using a modern mathematical and probabilistic treatment. It focuses on the information and application layers, a......一起来看看 《Modeling the Internet and the Web》 这本书的介绍吧!