目前,数据仓库一词尚没有一个统一的定义,著名的数据仓库专家W.H.Inmon在其著作《Building the Data Warehouse》一书中给予如下描述:数据仓库(Data Warehouse)是一个面向主题的(Subject Oriented)、集成的(Integrate)、相对稳定的(Non-Volatile)、反映历史变化(Time Variant)的数据集合,用于支持管理决策。对于数据仓库的概念我们可以从两个层次予以理解,首先,数据仓库用于支持决策,面向分析型数据处理,它不同于企业现有的操作型数据库;其次,数据仓库是对多个异构的数据源有效集成,集成后按照主题进行了重组,并包含历史数据,而且存放在数据仓库中的数据一般不再修改。
根据数据仓库概念的含义,数据仓库拥有以下四个特点:
1、面向主题。操作型数据库的数据组织面向事务处理任务,各个业务系统之间各自分离,而数据仓库中的数据是按照一定的主题域进行组织。主题是一个抽象的概念,是指用户使用数据仓库进行决策时所关心的重点方面,一个主题通常与多个操作型信息系统相关。
2、集成的。面向事务处理的操作型数据库通常与某些特定的应用相关,数据库之间相互独立,并且往往是异构的。而数据仓库中的数据是在对原有分散的数据库数据抽取、清理的基础上经过系统加工、汇总和整理得到的,必须消除源数据中的不一致性,以保证数据仓库内的信息是关于整个企业的一致的全局信息。
3、相对稳定的。操作型数据库中的数据通常实时更新,数据根据需要及时发生变化。数据仓库的数据主要供企业决策分析之用,所涉及的数据操作主要是数据查询,一旦某个数据进入数据仓库以后,一般情况下将被长期保留,也就是数据仓库中一般有大量的查询操作,但修改和删除操作很少,通常只需要定期的加载、刷新。
4、反映历史变化。操作型数据库主要关心当前某一个时间段内的数据,而数据仓库中的数据通常包含历史信息,系统记录了企业从过去某一时点(如开始应用数据仓库的时点)到目前的各个阶段的信息,通过这些信息,可以对企业的发展历程和未来趋势做出定量分析和预测。
企业数据仓库的建设,是以现有企业业务系统和大量业务数据的积累为基础。数据仓库不是静态的概念,只有把信息及时交给需要这些信息的使用者,供他们做出改善其业务经营的决策,信息才能发挥作用,信息才有意义。而把信息加以整理归纳和重组,并及时提供给相应的管理决策人员,是数据仓库的根本任务。因此,从产业界的角度看,数据仓库建设是一个工程,是一个过程。
整个数据仓库系统是一个包含四个层次的体系结构,具体由下图表示。
·数据源:是数据仓库系统的基础,是整个系统的数据源泉。通常包括企业内部信息和外部信息。内部信息包括存放于RDBMS中的各种业务处理数据和各类文档数据。外部信息包括各类法律法规、市场信息和竞争对手的信息等等;
·数据的存储与管理:是整个数据仓库系统的核心。数据仓库的真正关键是数据的存储和管理。数据仓库的组织管理方式决定了它有别于传统数据库,同时也决定了其对外部数据的表现形式。要决定采用什么产品和技术来建立数据仓库的核心,则需要从数据仓库的技术特点着手分析。针对现有各业务系统的数据,进行抽取、清理,并有效集成,按照主题进行组织。数据仓库按照数据的覆盖范围可以分为企业级数据仓库和部门级数据仓库(通常称为数据集市)。
·OLAP服务器:对分析需要的数据进行有效集成,按多维模型予以组织,以便进行多角度、多层次的分析,并发现趋势。其具体实现可以分为:ROLAP、MOLAP和HOLAP。ROLAP基本数据和聚合数据均存放在RDBMS之中;MOLAP基本数据和聚合数据均存放于多维数据库中;HOLAP基本数据存放于RDBMS之中,聚合数据存放于多维数据库中。
·前端工具:主要包括各种报表工具、查询工具、数据分析工具、数据挖掘工具以及各种基于数据仓库或数据集市的应用开发工具。其中数据分析工具主要针对OLAP服务器,报表工具、数据挖掘工具主要针对数据仓库。
[/img]
分享到:
相关推荐
标题中的“dw1-2021-1:DW-1 do curso DSM Fatec-Franca 20211储存库”表明这是一个与数据仓库(DW)相关的课程项目,可能来自于2021年第一学期的数据科学与管理(DSM)课程在Fatec-Franca学院的课程。这个项目的代码...
标题中的“dw1-2021-1”可能是一个课程项目或作业的标识符,表明这是关于2021年第一学期的某个主题。"光盘存储库Web 1"指的是一个网络应用的开发,可能是一个Web项目的早期版本,用于存储和管理数据,可能类似于数字...
标题 "dw1-2021-1:信息存储库Web 1做DSM Fatec Franca 20211" 暗示这是一个关于信息存储库的Web开发项目,可能是在DSM (Data Science and Management) 课程中由Fatec Franca在2021年第一学期进行的。这个项目的重点...
连接数据库是使用 DataWindow 控件处理数据的第一步。在 PowerBuilder 中,连接数据库通常涉及到指定一个事务对象来与数据库进行交互。PowerBuilder 提供了两种方法来实现这一目的:`SetTrans()` 和 `SetTransObject...
DesignWare DW_apb_i2c是一款由Synopsys公司开发的接口控制器,专为系统级芯片(SoC)设计中的APB(Advanced Peripheral Bus)总线与I2C(Inter-Integrated Circuit)通信协议之间的互连而设计。该产品代码下的数据...
生成解析json,支持datawindow快速导入导出字段名有大写字母的json,支持dw导入出json时对指定字段进行des加密,并在导入到dw时时进行des解密,修改了pbvm115.dll(内存修改方法的文件,请看n_datastore的api定义), ...
1. Dreamweaver(DW)插件系统:如何安装和使用插件增强DW的功能。 2. CSS:用于美化和定义按钮样式。 3. JavaScript:用于实现按钮的交互行为。 4. 动态按钮设计:如何创建和配置不同状态的按钮,以及添加动画效果...
3. demo.pbl:这可能是一个示例库,包含了演示如何使用“dw-office9.pbl”中定义的对象的代码和界面设计。 4. dw-office9.pbt:这是PowerBuilder的项目文件,包含了关于“dw-office9.pbl”库的相关信息,如引用的...
DW1000 提供了双接收缓冲区机制,允许连续接收两个数据包而无需等待微控制器处理完毕第一个数据包。这样可以避免因为处理时间过长而导致丢失数据的风险。 **4.4 低功耗监听** 为了进一步降低功耗,DW1000 设计了一...
浏览器最好选择用户系统第一种字体显示文本。 大小是 CSS 样式的另一个基本配置之一,在这里我们可以选择合适的大小,例如选择数字和度量单位选择特定的大小,也可以选择相对大小。以像素为单位能够有效地防止...
- **拉出绝缘体薄片**(见第1页)。 - **格式化并/重新启动操作**(见第2页)。 - **检查回转速感应器ID**(见第4页)。 - **选择速度单位**(见第5页)。 - **输入轮胎周长**(见第6页)。 - **操作测试**...
标题“DW2021-1”可能指的是Dreamweaver 2021的第一个版本,Dreamweaver是一款由Adobe公司开发的集成开发环境(IDE),主要用于网页设计和Web应用程序的开发。这个压缩包可能包含了与这个软件版本相关的源代码、教程...
任务一:网页设计制作的重要性 网页设计制作的重要性体现在以下几个方面: * 树立现代化企业新形象:一个好的网站可以帮助企业树立现代化的形象,提高企业的品牌形象和知名度。 * 广泛的广告效应:网站可以作为一...
5. **第三方工具**:存在一些工具如PBDView、PBDOM等,可以帮助查看和提取PBD文件中的信息,包括DataWindow的定义。 6. **源码反编译**:有时PBD文件无法直接提供源码,需要借助反编译工具进行转换,这可能不完全...
********2024904更新,of_get_sql_json、of_get_datawindow_json、of_get_datastore_json 中ls_key参数,增加多节点支持,例如:datalist:1:list1,意思sql生成json数据写入到数据datalist的第1行,字段名为list1,...
DW16系列是一款由德力西集团生产的高性能断路器,广泛应用于电力系统的过载和短路保护。 ### 一、DW16系列万能式断路器概述 #### 1.1 基本定义与应用领域 DW16系列万能式断路器是一种适用于交流50Hz/60Hz,额定...
1. 建立站点:在Dreamweaver中建立站点是网站开发的第二个关键步骤。在这里,需要定义站点、策划站点结构、部署开发环境。 2. 站点定义:定义站点是为了更好地利用文件面板对站点文件进行管理,也是为了减少一些...