Hive表压缩功能

除了直接配置MapReduce压缩功能外,Hive的ORC表和Parquet表直接支持表的压缩属性。

但支持的压缩格式有限,ORC表支持None、Zlib、Snappy压缩,默认为ZLIB压缩。但这3种压缩格式不支持切分,所以适合单个文件不是特别大的场景。使用Zlib压缩率高,但效率差一些;使用Snappy效率高,但压缩率低。

Parquet表支持Uncompress、Snappy、Gzip、Lzo压缩,默认不压缩Uncompressed。其中Lzo压缩是支持切分的,所以在表的单个文件较大的场景会选择Lzo格式。Gzip方式压缩率高,效率低;而Snappy、Lzo效率高,压缩率低。

最新文章

  1. 关于IoCallDriver使用的疑惑
  2. dbs:apple-notes
  3. char引发的血案
  4. XML学习笔记(1)--XML概述
  5. [转]NHibernate之旅(8):巧用组件之依赖对象
  6. 08JS高级 ——“继承”
  7. shiro的登陆认证(shiro项目中来的一)
  8. SQL c# 程序报错:未在本地计算机上注册“Microsoft.Jet.OLEDB.4.0”提供程序
  9. Python_day1 Learning record
  10. 两个类似的ViewModel一个可以重写事件,另一个不能重写事件,是哪里出了错。
  11. 029_mount bind挂载
  12. 如何将极客时间课程制作成kindle电子书
  13. ORACLE的impdp和expdp命令
  14. maven 父工程 消除重复 对子模块进行管理 主要继承依赖
  15. 14. Spring Boot的 thymleaf公共页抽取
  16. 大杂烩 -- HashMap、HashTable、ConCurrentHashMap 联系与区别
  17. end=‘’
  18. 关于定时器、波特率、TH和TL值的计算
  19. 获取String类型汉字乱码,如何进行编码
  20. 03_Spark集群部署

热门文章

  1. 推荐一个github国内访问加速神器GitHub520
  2. 【程序18】求s=a+aa+aaa+aaaa+aa...a的值
  3. 【Vulnhub靶场】JANGOW: 1.0.1
  4. python07day
  5. Python之基本数据类型与数据结构
  6. Spring源码-IOC部分-容器初始化过程【2】
  7. ApacheCN C/C++ 译文集(二) 20211204 更新
  8. Sublime Text4 安装与配置记录
  9. bom案例3-放大镜
  10. Endnote