Hive---拉链表
创始人
2024-05-30 04:37:17
0

拉链表


文章目录

  • 拉链表
  • 定义
  • 用途
  • 案例
    • 全量流程
    • 增量流程
    • 合并过程
      • 第一步
      • 第二步
      • 第三步
  • 案例二(含分区)
    • 创建外部表orders
    • 增量分区表
    • 历史记录表


定义

拉链表是一种数据模型,主要是针对数据仓库设计中表存储数据的方式而定义的,顾名思义,所谓拉链,就是记录历史。记录一个事物从开始,一直到当前状态的所有变化的信息。拉链表可以避免按每一天存储所有记录造成的海量存储问题,同时也是处理缓慢变化数据(SCD2)的一种常见方式。

用途

1.数据量比较大
2.表中的部分字段会被update,如用户的地址,产品的描述信息,订单的状态等等
3。需要查看某一个时间点或者时间段的历史快照信息,比如,查看某一个订单在历史某一个时间点的状态,比如,查看某一个用户在过去某一段时间内,更新过几次等等
4.变化的比例和频率不是很大,比如,总共有1000万的会员,每天新增和发生变化的有10万左右
5.如果对这边表每天都保留一份全量,那么每次全量中会保存很多不变的信息,对存储是极大的浪费

拉链历史表,既能满足反应数据的历史状态,又可以最大程度的节省存储

案例

全量流程

这里有张info表
在这里插入图片描述

通过sqoop导出到Hive的ODS层

日期:2021-09-26
start_time:2021-09-26(抽取时间)
表名:ods_info
在这里插入图片描述

增量流程

日期:2021-09-27
info表增加了一条数据并且数据进行了修改
在这里插入图片描述

sqoop导出
新增数据+更新数据 都要采集

select sid,sname,address,Create_time,Update_time from info where Create_time='2021-09-26' or Update_time='2021-09-26'

在ODS层再创建一张保存当天的新增和更新的数据
ods_info_new
表结构和ods_info一致

在这里插入图片描述

原始拉链表数据和更新的数据进行合并处理

也就是ods_info和ods_info_new进行合并处理
在这里插入图片描述

增量流程日期:2021-09-28
数据发生变化
在这里插入图片描述

sqoop导出
新增数据+更新数据 都要采集

select sid,sname,address,Create_time,Update_time from info where Create_time='2021-09-27' or Update_time='2021-09-27'

原表删除 ,建ods_info_new存放更改的数据
在这里插入图片描述

9.27拉链表数据和更新的数据进行合并处理

也就是ods_info和ods_info_new进行合并处理
在这里插入图片描述

这个整个过程就是拉链表的过程

合并过程

在这里插入图片描述

第一步

更改原始拉链表(ods_info)的数据
select
a.sid,
a.sname,
a.address,
a.Create_time,
a.Update-time,
a.Start_time
if(a.end_time=‘9999-12-31’ and b.sid is not null,b.start_time,a.end_time) as End_time
from ods_info a
left join ods_info_new b
on a.sid=b.sid

第二步

将left join 的结果和新增更新表(ods_info_new)进行union all 合并操作 保存在临时表中(ods_info_tmp)

第三步

将临时表(ods_info_tmp)覆盖到原始拉链表(ods_info)中 Insert overwrite ods_info select * from ods_info_tmp

insert into ods_info_tmp
from ((select sid, sname, address, Create_time, Update_time, Start_time, End_time from ods_info_new)union all(select a.sid,a.sname,a.address,a.Create_time,a.Update_time,a.Start_time,if(a.end_time = '9999-12-31' and b.sid is not null, b.start_time, a.end_time) as End_timefrom ods_info aleft join ods_info_new b on a.sid = b.sid));
insert overwrite table ods_info from ods_info_new;         

案例二(含分区)

原始表数据
在这里插入图片描述

创建外部表orders

create external table orders(orderid int,createdate string,modifiedtime string,status string
)
row format delimited fields terminated by '\t'
location '/tmp/lalian/orders';

增量分区表

create table ods_orders_inc(orderid int,createdate string,modifiedtime string,status string
)
partitioned by (day string)
row format delimited fields terminated by '\t';
insert overwrite table ods_orders_inc partition (day='2023-03-03')

历史记录表

create table dws_orders_his(orderid int,createdate string,modifiedtime string,status string,start_time string,end_time string
)
row format delimited  fields terminated by '\t';insert overwrite table dws_orders_his
select orderid,createdate,modifiedtime,status,modifiedtime,'9999-12-31' from ods_orders_inc where day='2023-03-03';

2023-03-04凌晨

ods_orders_inc 分区表 按日期分区
将orders数据导入到2023一03一03分区中
在这里插入图片描述
2023-03-05凌晨

原表数据发生更改
在这里插入图片描述

将orders数据导入到2023-03-04分区中

insert overwrite table ods_orders_inc partition(day='2023-03-04')
select orderid, createdate, modifiedtime, status
from orders
where modifiedtime='2023-3-4';

合并操作

select tb.orderid,tb.createdate,tb.modifiedtime,tb.status,tb.start_time,tb.end_timefrom(
(select orderid, createdate, modifiedtime,status,modifiedtime as start_time,'9999-12-31' as end_time
from ods_orders_inc where day='2023-03-04')
union all
(selectt1.orderid,t1.createdate,t1.modifiedtime,t1.status,t1.start_time,case when t2.orderid is not nulland t1.end_time >'2023-3-4' then '2023-3-4' else t1.end_time end end_time
from dws_orders_his as t1left join (select orderid from ods_orders_inc where day='2023-03-04') as t2 on t1.orderid=t2.orderid))tb
order by tb.orderid,tb.start_time;

在这里插入图片描述
2023-03-06凌晨
原表数据发生更改
在这里插入图片描述

将orders数据导入到2023-03-05分区中

insert overwrite table ods_orders_inc partition (day='2023-03-05')
select orderid,createdate,modifiedtime,status from orders
where modifiedtime='2023-3-5' or (createdate='2023-3-5' and modifiedtime='2023-3-5');

合并操作

select tb1.*
from ((select orderid, createdate, modifiedtime, status, modifiedtime start_time, '9999-12-31' end_timefrom ods_orders_incwhere day = '2023-03-05')union all(select t1.orderid,t1.createdate,t1.modifiedtime,t1.status,t1.start_time,`if`(t2.orderid is not null and t1.end_time > '2023-03-05', '2023-03-05', t1.end_time) end_timefrom dws_orders_his t1left join (select orderid, modifiedtimefrom ods_orders_incwhere day = '2023-03-05') t2 on t1.orderid = t2.orderid)) tb1 order by tb1.orderid,tb1.modifiedtime;

在这里插入图片描述
以此类推,整个过程即为拉链表

每日的用户更新表该怎么获取,有3种方式拿到或者间接拿到每日的用户增量,因为它比较重要,所以详细说明:
我们可以监听 Mysql 库数据的变化,比如说用 Canal,最后合并每日的变化,获取到最后的一个状态。
假设我们每天都会获得一份切片数据,我们可以通过取两天切片数据的不同来作为每日更新表,这种情况下我们可以对所有的字段先进行 concat,再取 md5,这样就 ok 了。
流水表!有每日的变更流水表。通过etl工具对操作型数据库按照时间字段增量抽取到ods或者数据仓库(每天抽取前一天的数据),形成每天的增量数据(实际中使用最多的情形)。

相关内容

热门资讯

领动安卓系统导航盒,智能出行新... 你有没有想过,家里的电视竟然也能变成智能导航的小助手?没错,就是那个领动安卓系统导航盒!今天,就让我...
式神赠送系统安卓,畅享奇幻之旅 你知道吗?最近在安卓平台上,有一个特别有趣的式神赠送系统,简直让人爱不释手!想象每天都能收到各种可爱...
安卓能刷米柚系统,米柚系统刷机... 你有没有想过给你的安卓手机换换口味?没错,就是刷机!今天,我要给你详细介绍安卓手机如何刷上米柚系统,...
小屏安卓旗舰流畅系统,揭秘小屏... 你有没有发现,现在手机市场真是热闹非凡啊!各种新机层出不穷,让人眼花缭乱。不过,今天我要给你安利的这...
如何制作音乐墙安卓系统,安卓系... 音乐爱好者们,你是否曾梦想过拥有一面充满个性与活力的音乐墙?在安卓系统上,这不再是遥不可及的梦想!今...
安卓软件转换到苹果系统,跨平台... 你有没有想过,从安卓转到苹果系统,这不仅仅是一次操作那么简单,这可是你手机生活的一次大变革呢!想象那...
kindle转换安卓系统吗,解... 亲爱的读者,你是否曾经想过,那陪伴你无数个夜晚的Kindle电子书阅读器,能否与你的安卓手机无缝对接...
安卓手机苹果系统主题,体验非凡... 你有没有发现,现在手机的世界真是五彩斑斓,各种主题层出不穷,让人眼花缭乱。今天,咱们就来聊聊安卓手机...
安卓系统需要清理后台吗,后台清... 你有没有发现,你的安卓手机越来越慢了?是不是觉得打开应用都要等半天,甚至有时候还会卡住?别急,今天就...
安卓12系统通知栏,智能交互与... 你有没有发现,最近你的安卓手机更新到了安卓12系统?别小看了这个小小的更新,它可是给我们的手机生活带...
杂牌手机是安卓系统,性能与性价... 你有没有想过,为什么市面上那么多手机品牌,而你却对那些杂牌手机情有独钟呢?没错,说的就是那些安卓系统...
owlenz投影仪安卓系统,功... 你有没有想过,在家庭影院或者户外露营的时候,拥有一台投影仪是多么的酷炫啊!想象大屏幕上播放着你的最爱...
使命召唤手游安卓系统,安卓用户... 亲爱的手机游戏爱好者们,你是否曾在某个午后,无聊地刷着手机,突然眼前一亮,看到了一款名为“使命召唤手...
禁用安卓系统手势的模块,安卓系... 你有没有发现,手机操作越来越复杂了?有时候,那些手势操作简直让人头大!不过别担心,今天我要给你介绍一...
安卓系统禁入中国,安卓系统禁入... 你知道吗?最近有个大新闻在科技圈里炸开了锅,那就是安卓系统竟然被禁止进入中国市场了!这可真是让人大跌...
上课下课铃声系统安卓,安卓上课... 你知道吗?在这个数字化时代,连上课下课的铃声都有了新花样呢!想象当你正沉浸在知识的海洋中,突然一阵清...
安卓电脑怎么重新做系统,安卓电... 你的安卓电脑是不是突然间变得慢吞吞的,就像老牛拉车一样?别急,今天就来教你怎么给它来个焕然一新的变身...
安卓教育系统推荐,引领未来学习... 你有没有想过,你的手机里竟然藏着一个强大的教育系统?没错,就是安卓系统里的那些宝藏功能。今天,就让我...
安卓系统和gms的关系,安卓系... 你有没有发现,安卓手机的世界里,有一个神秘的存在,它就像一个无形的纽带,将无数的安卓设备紧密相连。它...
安卓怎么给系统升级,轻松实现系... 亲爱的安卓用户们,你是否也和我一样,对手机系统升级充满了期待和好奇呢?每次系统升级,都仿佛给我们的手...