资讯 更多 >>
商家花10万请人直播带货 结果3个月...
国内油价将迎来下调:国际原油跌破9...
国家能源局:今年以来我国煤炭生产...
河南4名阳性人员私自返乡并瞒报情况...
山西吕梁:发现盗采矿产资源行为可举报
受害方律师:接法院通知,乐安命案...
橙色——“柑橘院士”邓秀新心中最...
刷视频相认的双胞胎姐妹:两次创业...
四川通报2021年秋冬季首批大气污染...
首轮筛查:天津73443人全部阴性!
动态更多 >>
世界热推荐:数据库的类型有哪些_数...
讯息:柳岩燕子的电视剧_柳岩饰演燕...
新浪微博头像相册怎么删除_怎么删除...
我从基层来丨全国政协委员卢跃富:...
鳄鱼符文天赋怎么设置_鳄鱼符文s8 ...
二手公寓房交易税费怎么收(二手公...
全球微速讯:穿衣从释放“脖子”开...
分析|美国硅谷银行为何股价暴跌六...
百色:强化监督保障 推动铝产业高...
今日讯!盗窃五万判多少年徒刑
会展 更多 >>
美籍酿酒师在崇礼:中国是第二故乡...
河南项城报告2名疑似新冠肺炎病例 ...
浙江绍兴确诊病例首次零新增 上虞...
广西东兴实行全员居家隔离 启动口...
新疆全方位推进乡村振兴 “富春山...
云南瑞丽市主城区全员核酸检测结果...
内蒙古满洲里累计治愈出院本土确诊...
孙海洋夫妻驱车山东阳谷:还在为孙...
大国工匠追梦“玉米强国”40载:用...
让南海“海洋热带雨林”斑斓多彩
专题报道 
当前位置: 动态 > >> 正文
 
世界热推荐:数据库的类型有哪些_数据库与数据仓库的区别
来源:互联网     时间:2023-03-11 16:02:41

1、简而言之,数据库是面向事务的设计,数据仓库是面向主题设计的。


(资料图)

2、 数据库一般存储在线交易数据,数据仓库存储的一般是历史数据。

3、 数据库设计是尽量避免冗余,一般采用符合范式的规则来设计,数据仓库在设计是有意引入冗余,采用反范式的方式来设计。

4、 数据库是为捕获数据而设计,数据仓库是为分析数据而设计,它的两个基本的元素是维表和事实表。

5、维是看问题的角度,比如时间,部门,维表放的就是这些东西的定义,事实表里放着要查询的数据,同时有维的ID。

6、 单从概念上讲,有些晦涩。

7、任何技术都是为应用服务的,结合应用可以很容易地理解。

8、以银行业务为例。

9、数据库是事务系统的数据平台,客户在银行做的每笔交易都会写入数据库,被记录下来,这里,可以简单地理解为用数据库记帐。

10、数据仓库是分析系统的数据平台,它从事务系统获取数据,并做汇总、加工,为决策者提供决策的依据。

11、比如,某银行某分行一个月发生多少交易,该分行当前存款余额是多少。

12、如果存款又多,消费交易又多,那么该地区就有必要设立ATM了。

13、 显然,银行的交易量是巨大的,通常以百万甚至千万次来计算。

14、事务系统是实时的,这就要求时效性,客户存一笔钱需要几十秒是无法忍受的,这就要求数据库只能存储很短一段时间的数据。

15、而分析系统是事后的,它要提供关注时间段内所有的有效数据。

16、这些数据是海量的,汇总计算起来也要慢一些,但是,只要能够提供有效的分析数据就达到目的了。

17、 数据仓库,是在数据库已经大量存在的情况下,为了进一步挖掘数据资源、为了决策需要而产生的,它决不是所谓的“大型数据库”。

18、那么,数据仓库与传统数据库比较,有哪些不同呢?让我们先看看W.H.Inmon关于数据仓库的定义:面向主题的、集成的、与时间相关且不可修改的数据集合。

19、 “面向主题的”:传统数据库主要是为应用程序进行数据处理,未必按照同一主题存储数据;数据仓库侧重于数据分析工作,是按照主题存储的。

20、这一点,类似于传统农贸市场与超市的区别—市场里面,白菜、萝卜、香菜会在一个摊位上,如果它们是一个小贩卖的;而超市里,白菜、萝卜、香菜则各自一块。

21、也就是说,市场里的菜(数据)是按照小贩(应用程序)归堆(存储)的,超市里面则是按照菜的类型(同主题)归堆的。

22、 “与时间相关”:数据库保存信息的时候,并不强调一定有时间信息。

23、数据仓库则不同,出于决策的需要,数据仓库中的数据都要标明时间属性。

24、决策中,时间属性很重要。

25、同样都是累计购买过九车产品的顾客,一位是最近三个月购买九车,一位是最近一年从未买过,这对于决策者意义是不同的。

26、 “不可修改”:数据仓库中的数据并不是最新的,而是来源于其它数据源。

27、数据仓库反映的是历史信息,并不是很多数据库处理的那种日常事务数据(有的数据库例如电信计费数据库甚至处理实时信息)。

28、因此,数据仓库中的数据是极少或根本不修改的;当然,向数据仓库添加数据是允许的。

29、 数据仓库的出现,并不是要取代数据库。

30、目前,大部分数据仓库还是用关系数据库管理系统来管理的。

31、可以说,数据库、数据仓库相辅相成、各有千秋。

32、 补充一下,数据仓库的方案建设的目的,是为前端查询和分析作为基础,由于有较大的冗余,所以需要的存储也较大。

33、为了更好地为前端应用服务,数据仓库必须有如下几点优点,否则是失败的数据仓库方案。

34、 1.效率足够高。

35、客户要求的分析数据一般分为日、周、月、季、年等,可以看出,日为周期的数据要求的效率最高,要求24小时甚至12小时内,客户能看到昨天的数据分析。

36、由于有的企业每日的数据量很大,设计不好的数据仓库经常会出问题,延迟1-3日才能给出数据,显然不行的。

37、 2.数据质量。

38、客户要看各种信息,肯定要准确的数据,但由于数据仓库流程至少分为3步,2次ETL,复杂的架构会更多层次,那么由于数据源有脏数据或者代码不严谨,都可以导致数据失真,客户看到错误的信息就可能导致分析出错误的决策,造成损失,而不是效益。

39、 3.扩展性。

40、之所以有的大型数据仓库系统架构设计复杂,是因为考虑到了未来3-5年的扩展性,这样的话,客户不用太快花钱去重建数据仓库系统,就能很稳定运行。

41、主要体现在数据建模的合理性,数据仓库方案中多出一些中间层,使海量数据流有足够的缓冲,不至于数据量大很多,就运行不起来了。

本文分享完毕,希望对大家有所帮助。

关键词:

热门推荐
猜你喜欢