分布式数据仓库系统 Apache Tajo

码农软件 · 软件分类 · 大数据 · 2020-02-14 09:44:17

软件介绍

Tajo 是一个分布式数据仓库系统,基于 Hadoop 实现,特点是低延迟、高可伸缩,提供专用查询和 ETL 工具

特点:

  • 可伸缩性和低延迟

    • 完全分布式的 SQL 查询处理,基于存储雨 HDFS 的大数据集

    • 超低响应时间(约100毫秒),在合理数据范围内的简单查询

  • 支持长时间运行的查询

    • 容错支持,避免某些任务失败后的查询重启

    • 动态调度,处理和异构集群节点故障

  • ETL

    • ETL 可实现不同数据格式之间的转换

    • 支持多种文件格式,如 CSV、RCFile 和 RowFile

  • 扩展性

    • 支持用户自定义函数

    • 提供自定义文件格式的 Scanner/Appender 接口

  • 兼容性

    • 遵循 ANSI/ISO SQL 标准,非标准方面遵循 PostgreSQL 规范

    • 支持 HiveQL 模式

    • 在 HCatalog 和 Hive MetaStore 实现表访问

    • 支持 JDBC 驱动

  • 简单

    • 提供交互式 Shell 来提交 SQL 查询到 Tajo 集群

    • 提供备份和恢复工具

    • 异步/同步 Java API 来提交 SQL 查询到 Tajo 集群

本文地址:https://codercto.com/soft/d/25579.html

信息乌托邦

信息乌托邦

桑斯坦 / 毕竞悦 / 法律出版社 / 2008-10-1 / 28.50元

我们被无限的媒体网从四面包围,如何能够确保最准确的信息脱颖而出、并且引起注意?在本书中,凯斯•R. 桑斯坦对于积蓄信息和运用知识改善我们生活的人类潜能,展示了深刻的乐观理解。 在一个信息超负荷的时代里,很容易退回到我们自己的偏见。人群很快就会变为暴徒。伊拉克战争的合法理由、安然破产、哥伦比亚号航天载人飞机的爆炸——所有这些都源自埋于“信息茧房”的领导和组织做出的决定,以他们的先入之见躲避意见......一起来看看 《信息乌托邦》 这本书的介绍吧!

MD5 加密
MD5 加密

MD5 加密工具

XML 在线格式化
XML 在线格式化

在线 XML 格式化压缩工具