美文网首页
HiVE 压缩

HiVE 压缩

作者: 无来无去_A | 来源:发表于2020-08-08 16:34 被阅读0次

1.开启Map输出阶段压缩(MR引擎)

开启map输出阶段压缩可以减少job中map和Reduce task间数据传输量。具体配置如下:

1)案例实操:

(1)开启hive中间传输数据压缩功能

hive (default)>set hive.exec.compress.intermediate=true;

(2)开启mapreduce中map输出压缩功能

hive (default)>set mapreduce.map.output.compress=true;

(3)设置mapreduce中map输出数据的压缩方式

hive (default)>set mapreduce.map.output.compress.codec= org.apache.hadoop.io.compress.SnappyCodec;

(4)执行查询语句

 hive (default)> select count(ename) name from emp;

开启Reduce输出阶段压缩

当Hive将输出写入到表中时,输出内容同样可以进行压缩。属性hive.exec.compress.output控制着这个功能。用户可能需要保持默认设置文件中的默认值false,这样默认的输出就是非压缩的纯文本文件了。用户可以通过在查询语句或执行脚本中设置这个值为true,来开启输出结果压缩功能。

1)案例实操:

(1)开启hive最终输出数据压缩功能

hive (default)>set hive.exec.compress.output=true;

(2)开启mapreduce最终输出数据压缩

hive (default)>set mapreduce.output.fileoutputformat.compress=true;

(3)设置mapreduce最终数据输出压缩方式

hive (default)> set mapreduce.output.fileoutputformat.compress.codec =
 org.apache.hadoop.io.compress.SnappyCodec;

(4)设置mapreduce最终数据输出压缩为块压缩

hive (default)> set mapreduce.output.fileoutputformat.compress.type=BLOCK;

(5)测试一下输出结果是否是压缩文件

hive (default)> insert overwrite local directory
 '/opt/module/datas/distribute-result' select * from emp distribute by deptno sort by empno desc;

相关文章

  • HIVE调优

    一 .hive的压缩方案介绍 在hive中一般推荐使用压缩方式:1.1 ) SNAPPY 速度最快(最常用的压缩方...

  • Hive学习-高级版五(压缩和存储)

    hive的压缩本质上指的是MapReduce的压缩,因为hive其实就是MapReduce的高级语言版(SQL),...

  • Hive安装

    Hive 安装与配置 hive安装 下载压缩包 下载地址 解压压缩包 配置环境变量 /etc/profile 检查...

  • 大数据环境搭建-Hive

    hive压缩包解压 使用mysql存储元数据 创建 hive 账号 hive元数据库 账号授权 通过hive账号...

  • HIVE

    --------hive 数据仓库 hive底层执行引擎有 MapReduce Tez Spark 压缩 GZI...

  • HiVE 压缩

    1.开启Map输出阶段压缩(MR引擎) 开启map输出阶段压缩可以减少job中map和Reduce task间数据...

  • hive压缩

    hive支持的文件格式 hive版本 2.1.1 hadoop版本 2.7.3 文件格式理论压缩格式当前...

  • hive积累大全

    此篇内容:hive自定义函数UDF、UDTF,压缩存储方式,hive优化、hive实际编程SQL中的if表达式用法...

  • Hive2

    Hive的部署解压缩、重命名、设置环境变量在目录$HIVE_HOME/conf/下,执行命令mv hive-def...

  • Hive中常用的数据压缩snappy

    Hive的数据压缩 压缩格式: bzip2, gzip, lzo, snappy等压缩比:bzip2>gzip>l...

网友评论

      本文标题:HiVE 压缩

      本文链接:https://www.haomeiwen.com/subject/vgvtdktx.html