您的位置：首页 > 其它

hive--桶

2016-05-10 16:52 120 查看

桶：

set hive.enforce.bucketing = true; 使hive知道用表定义中声明的数量来创建桶

create table bucketed_wyp (id int, name string, age int, tel string) clustered by (id) sorted by (id asc) into 4 buckets;
<!--插入是一个mp任务-->
insert overwrite table bucketed_wyp select * from wyp;
dfs -ls /user/hive/warehouse/bucketed_wyp;

（这里数据之间的tab消失了，但并不是真的消失了）

select * from bucketed_wyp tablesample(bucket 2 out of 4 on id);

(这也是一个MR任务，而且取样返回的是2/4的数据)

select * from bucketed_wyp tablesample(bucket 2 out of 4 on rand());

使用rand()之后，返回随机，但是使用了桶之后，扫描的是一部分，不使用桶，扫描的是所有的表。

内容来自用户分享和网络整理，不保证内容的准确性，如有侵权内容，可联系管理员处理

标签： hive

相关文章推荐

分享Hive的一份胶片资料
Hadoop生态上几个技术的关系与区别：hive、pig、hbase 关系与区别
将Hive的默认数据库Derby改为Postgresql
kettle中对hive操作时需要知道的东西
Hive安装配置
Hive - truncate partition、drop partition 区别
#Note# Analyzing Twitter Data with Apache Hadoo...
大数据实验室（大数据基础培训）——Hive的安装、配置及基础使用
[翻译]Hive wiki GettingStarted
hive命令积累
启动hive命令报错 “Metastore contains multiple versions”
sparksql与hive整合
hive on spark 编译
sqoop 中文文档 User guide 一
sqoop 中文文档 User guide 二 import
sqoop 中文文档 User guide 二 import续
sqoop 中文文档 User guide 三 export
sqoop 中文文档 User guide 四 validation
sqoop 中文文档 User guide 五 job,metastore,merge,codegen

新的分享

一次教科书级别的Redis高可用架构设计实践 - Redis
曾光：北京这次的毒株不像国内流行类型
从PRD文档到产品上线，有哪些问题需要解决？
vue3自定义指令的使用
Oracle SQL性能优化最常用的40条建议 - ORACLE
程序员翻车常见反应，你中枪了吗？ - 职场生涯
新鲜开源：基于Prometheus的企业监控平台设计与实现 - 运维
嵌入式软件开发之程序架构设计-任务调度
【Java面试】请简单说一下你对受检异常和非受检异常的理解
奇安信更新招股书：第一季亏损过5亿，齐向东持股38%
艾瑞咨询：2020年中国后智能厨房案例研究报告
艾瑞咨询：2020年中国人工智能+物流发展研究报告

章节导航