olapoltp和olap的异同

olap  时间:2021-08-17  阅读:()

什么是olap,简述其作用及过程

数据挖掘DM与联机分析处理DLAP都属于分析型工具,但两者之间有着明显的区别。

DM是一种挖掘型工具,DM它能自动地发现隐藏在数据中的模式( Pattern)。

DM是一种有效地从大量数据中发现潜在数据模式、作出预测性分析的分析工具,它是现有的一些人工智能、统计学等成熟技术在特定的数据库领域中的应用。

DM与其他分析型工具最大的不同在于:它的分析过程是自动的。

一个成熟的DM系统,除了具有良好的核心的技术外,还应该具有开放性的结构,友好的用户接口。

DM的用户不必提出确切的问题,而只需DM去挖掘隐藏的模式并预测未来的趋势,这样更有利于发现未知的事实。

OLAP是一种自上而下、不断深入的分析工具:用户提出问题或假设,OLAP负责从上至下深入地提取出关于该问题的详细信息,并以可视化的方式呈现给用户。

与DM相比,OGAP更多地依靠用户输入问题和假设,但用户先入为主的局限性可能会限制问题和假设的范围,从而影响最终的结论。

因此,作为验证型分析工具,QLAP更需要对用户需求有全面而深入的了解。

显然,从对数据分析的深度的角度来看,SLAP位于较浅的层次,而Dh}所处的位置则较深。

如果按E.F. Codd的数据分析模型来区分这两者,那么应该说OLAP实现了解释模型和思考模型,而DNd则实现了更深的第四层—公式模型。

所处分析模型层次的不同决定了这两者的分析能力和所能回答的问题种类也不相同。

OLAP具有哪些功能?

联机分析(OLAP)是由关系数据库之父E.F.Codd于1993年提出的一种数据动态分析模型,它允许以一种称为多维数据集的多维结构访问来自商业数据源的经过聚合和组织整理的数据。

以此为标准,OLAP作为单独的一类产品同联机事务处理(OLTP)得以明显区分。

  有点深奥是不是?其实并不复杂,OLAP最基本的概念其实只有三个:多维观察、数据钻取、CUBE运算。

  从动态的多维角度分析数据   我们在平时工作中,会遇到各种问题,在分析问题的时候,同样的现象,我们会从多个角度去分析考虑,并且有时候我们还会从几个角度综合起来进行分析。

这就是OLAP分析最基本的概念:从多个观察角度的灵活组合来观察数据,从而发现数据内在规律。

  OLAP将数据分为两种特征,一种为表现特征,比如一个销售分析模型中的销售额、毛利等;还有一种为角度特征,比如销售分析中的时间周期、产品类型、销售模式、销售区域等。

前者是被观察的对象,OLAP术语称之为“度量数据”,后者为观察视角,OLAP术语称之为“维数据”。

  如果建立这样一个模型,我们就可以根据业务需求,从产品类型角度去观察各个销售地区的销售额数据(以产品类型和销售地区为维、以销售额为度量);或者我们还可以从销售模式的角度去观察各个销售地区的销售额数据(以销售模式和销售地区为维、以销售额为度量)。

  在Max@X Analyser的OLAP模型中,每个模型最多可以设定255个维、1024个度量,也就是说,我们可以从255个角度或者角度组合,去同时观察1024个数据对象的变化。

  对数据进行钻取,以获得更为精确的信息   在分析过程中,我们可能需要在现有数据基础上,将数据进一步细化,以获得更为精确的认识。

这就是OLAP中数据钻取的概念。

  比如,在销售分析中,当我们以产品类型和销售地区为维、以销售额为度量进行分析的时候,可能希望进一步观察某类产品的不同销售模式在各个销售地区的表现,这时我们就可以在产品大类这个数据维下面,再加上一个销售模式维,从而获得相应的信息。

  创建数据CUBE   那么,要满足上述运算,需要什么样的前提呢?   我们可以想像,和报表不同,OLAP分析所需的原始数据量是非常庞大的。

一个分析模型,往往会涉及数百万条、数千万条、甚至更多;而分析模型中包含多个维数据,这些维又可以由浏览者作任意的提取组合。

这样的结果就是大量的实时运算导致的时间延滞。

我们可以设想,一个对于1000万条记录的分析模型,如果一次提取4个维度进行组合分析,那么实际的运算次数将达到4的1000次方的数量:这样的运算量将导致数十分钟乃至更长的等待时间。

如果用户对维组合次序进行调整,或者增加减少某些维度的话,又将是一个重新的计算过程。

  从上面分析,我们可以得出结论,如果不能解决OLAP运算效率问题的话,OLAP将是一个毫无实用价值的概念。

那么,作为一个成熟产品是如何解决这个问题的呢?这就是OLAP中一个非常重要的技术:数据CUBE预运算。

  一个OLAP模型中,度量数据和维数据我们应该实现确定,一旦两者确定下来,那么我们可以对数据进行预先的处理,在正式发布之前,将数据根据维进行最大限度的聚类运算,运算中会考虑到各种维组合情况,运算结果将生成一个数据CUBE,并保存在服务器上。

这样,当最终用户在调阅这个分析模型的时候,就可以直接使用这个CUBE,在此基础上根据用户的维选择和维组合进行复运算,从而达到实时响应的这么一个效果。

  作为一个成熟的产品,Max@X Analyser无论是在CUBE创建还是后续的浏览操作,效率都是非常高的。

测试结果表明:原始数据行数在3200万条记录的时候,包含10个维数据组合、2个度量数据的CUBE,创建周期为132分钟,装载效率是12.5秒。

这样的成绩对比世界上任何一个高端OLAP同类产品,都不逊色。

(需要更为详细的测试报告,可以与炎鼎软件联系)。

  补充说明   上面所说的,是OLAP最基本的概念,除此以外,OLAP通常包括的功能包括数据旋转(变换观察维组合顺序)、数据切片(过滤无关数据,对指定数据进行重点观察),以及对数据进行跨行列运算(如Max@X Analyser中的增加行列差额、等比环比等扩展运算)。

  如果您希望了解更多关于OLAP的信息,请与炎鼎软件技术支持联系。

oltp和olap的异同

检举|2007-09-19 16:30OLTP即联机事务处理,就是我们经常说的关系数据库,意即记录即时的增、删、改、查,就是我们经常应用的东西,这是数据库的基础; OLAP即联机分析处理,是数据仓库的核心部心,所谓数据仓库是对于大量已经由OLTP形成的数据的一种分析型的数据库,用于处理商业智能、决策支持等重要的决策信息;数据仓库是在数据库应用到一定程序之后而对历史数据的加工与分析;是处理两种不同用途的工具而已。

RFCHOST - 洛杉矶CN2 GIA VPS季付23.9美元起 100Mbps带宽

RFCHOST,这个服务商我们可能有一些朋友知道的。不要看官网是英文就以为是老外服务商,实际上这个服务商公司在上海。我们实际上看到的很多商家,有的是繁体,有的是英文,实际上很多都是我们国人朋友做的,有的甚至还做好几个品牌域名,实际上都是一个公司。对于RFCHOST商家还是第一次分享他们家的信息,公司成立大约2015年左右。目前RFCHOST洛杉矶机房VPS正进行优惠促销,采用CN2优化线路,电信双...

木木云35元/月,美国vps服务器优惠,1核1G/500M带宽/1T硬盘/4T流量

木木云怎么样?木木云品牌成立于18年,此为贵州木木云科技有限公司旗下新运营高端的服务器的平台,目前已上线美国中部大盘鸡,母鸡采用E5-267X系列,硬盘全部组成阵列。目前,木木云美国vps进行了优惠促销,1核1G/500M带宽/1T硬盘/4T流量,仅35元/月。点击进入:木木云官方网站地址木木云优惠码:提供了一个您专用的优惠码: yuntue目前我们有如下产品套餐:DV型 1H 1G 500M带宽...

Hostodo美国独立日优惠套餐年付13.99美元起,拉斯维加斯/迈阿密机房

Hostodo又发布了几款针对7月4日美国独立日的优惠套餐(Independence Day Super Sale),均为年付,基于KVM架构,采用NVMe硬盘,最低13.99美元起,可选拉斯维加斯或者迈阿密机房。这是一家成立于2014年的国外VPS主机商,主打低价VPS套餐且年付为主,基于OpenVZ和KVM架构,产品性能一般,支持使用PayPal或者支付宝等付款方式。商家客服响应也比较一般,推...

olap为你推荐
bftBFT、什么東西噢、什么意思、解釋下。apple以旧换新苹果以旧换新真的吗?163登陆163邮箱登陆电脑版wizardry霍格沃茨学校在哪里?最好的视频播放器目前最好的视频播放器是什么?实数的定义实数的概念是什么局域网ip扫描工具如何扫描局域网使用的设备系统登录界面谁知道XP系统的登录界面。和启动界面怎么更改的 急阶乘函数C语言中有计算阶乘的函数吗 不是自己写,,,是那种可以直接调用的函数软件群发我是做微商的需要经常群发一些图片给很多个群,有什么群发软件吗?
猫咪永久域名收藏地址 播放vps上的视频 linuxapache虚拟主机 唯品秀 plesk 免费ftp空间 godaddy 北京双线机房 hkg 新家坡 静态空间 卡巴斯基免费试用版 环聊 主机返佣 免费稳定空间 512内存 空间排行榜 带宽测速 卡巴斯基官方下载 以下 更多