




全文预览已结束
VIP免费下载
版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
建立数据仓库的八条规则,尤其是如何建立第一个数据仓库。但实际上,对于如何建立一个成功的数据仓库,现实中不存在也根本不可能存在一个涵盖万千、放之四海而皆准的宝书。本文规则的意义在于帮助用户避免一些已知的缺陷。而对于那些不可避免的必然错误,这些规则会尽可能地帮助用户减轻可能带来的危害。 数据仓库应用具有从多个分散的部门级系统中捕捉大量共享信息的能力。它们可以将机构的原始数据有效地转化为有用的知识信息,于是这些知识信息就可以被用来进行战略决策支持,从而提高企业效益。在一个先进的数据仓库应用的帮助下,企业决策者可以从质量、区域收入和产量等基本面上对企业性能进行跟踪,并基于这些可靠的信息采取快速、明智的行动。 建立数据仓库的八条规则,尤其是如何建立第一个数据仓库。实际上,对于如何建立一个成功的数据仓库,现实中不存在也根本不可能存在一个涵盖万千、放之四海而皆准的宝书。几乎可以肯定的是,在建立第一个数据仓库的时候,用户肯定会犯错误,这是不可避免的。本文的规则的意义仅仅在于,帮助用户避免一些已知的缺陷。而对于那些不可避免的必然错误,这些规则会尽可能地帮助用户减轻可能带来的危害。规则一:从小处着手 不要一上来就要完成一个大规模的企业范围的数据仓库,这样会使用户陷入逻辑、行政和财政的泥沼中而不能自拔。 数据仓库不是越大越有效,较小系统的价值对机构来讲可能会很大。例如,用户可以将第一个数据仓库的实现定位于一个特定的部门和应用或者业务线。初始时采用规模向下的数据集市可以降低开发成本,缩短实现周期,并有助于为未来的数据仓库的发展培训IT人员。规则二:向大处考虑 即使在建立第一个面向特定部门或特定应用的数据集市时,也一定要保证现在所使用的数据模型能够向将来企业范围的数据存储扩展,以便于将来其他数据集市和战略数据仓库的实现。 必须在部门之间进行一致性数据定义,并使每个人都遵守。例如,如何构成一个销售体系?是预约登记、开发票还是付款?在这些定义上的一致性协议会使以后部门数据的联合成为可行、有效。规则三:定义目标和量化收益 在项目开始实施以前,用户必须明确回答几个问题。我们为什么要建立一个数据仓库?项目的目的同我们机构的任务一致吗?哪些问题是我们致力于要去解决的?要考虑及时推入市场、质量和客户满意度等因素吗? 在进行了目标问题的认知以后,应该认清哪些是关键性的影响成功的因素,以便于在解决方案的实施进程中进行跟踪。例如,收益和运输单位(units shipped)可能是对丧失市场份额产生作用的两个影响因素。 在确立了这些关键的成功影响因素以后,用户就可以在应用中设置自动水开标记或警报。这些警报保证对底层产生直接影响的最重要数据是清晰可见的,便于及时采取行动。定义了成功的影响因素后,在使用数据仓库时就可以检测到威胁成功的因素。 一旦这些基本目标确立以后,下一个基本要求是对来自数据仓库的可预期的收益进行量化。只有在做了这些工作以后,管理层才会有据可依地判断一个数据仓库的成功与否。 量化的目标不一定非是数字或金融表达式,它们只需要明确、有意义即可。许多机构都采用金融衡量标准,比如ROI,来对收益进行量化。IDC对62家数据仓库的实现进行研究表明,在数据仓库项目上的总体ROI为401%,平均回报时间为23年。数据集市的ROI经检验为533%。其他类型的收益衡量标准还包括成本节约程度以及可获得的能够进行衡量的效率。规则四:取得最高管理层的支持和认可 数据仓库中涉及到信息的共享,这必然会由于部门数据所有者的人为因素造成失控。在数据所有权和数据存放等问题上的内部纷争,很容易给数据仓库带来进程上的滞延和失败。 这种数据上的割据必须在项目的开始就立即加以解决。理想的情况是,公司最高管理层的一个或者几个成员能够为数据仓库进行部门或部门之间的对象设置。管理层的支持有助于打破各个部门之间日益严重的由于数据保护而形成的行政壁垒。 在整个过程中,终端用户也是一个不可忽视的因素。如果那些首先进行数据输入的人员不了解数据仓库的意义,用户很容易地陷入一摊垃圾数据中。用户用来决策的数据应该同最初输入的数据一样好。规则五:等待完美不会带来收益 如果已经进行了目标定义,明确了关键的成功影响因素,并且数据仓库项目的规模得到了合理的控制,那么就不要永久地等待下去,因为这样下去什么也不会得到。尽快行动起来,开始分享数据仓库投资带来的回报。用户不应拘泥于所谓的完美不放,一旦客户开始访问到新数据仓库中的信息,研究结果展现在他们的面前,他们很快会发现自己需要更多的信息和更详细的细节。 研究表明,数据仓库以每年大约40%的速率在增长。随着用户需求的发展,应用能够不断修改与之适应。这种方式是一个垒砖的方式,迈向数据仓库的第一步路就是快速实现它。规则六:选择能够与用户需求匹配的系统 如上所述,要认识到数据仓库将可能以每年递增40%或更多的速度增长。同时要认识到,用户和职员不可能非常准确地预料到系统上的初始和未来负载的情况。这种固有的精确度的缺乏就需要软件和硬件具有可伸缩性,能够容纳更多的客户、进程和存储的发展。 这种性能必须在设计的开始就考虑进去。否则,就可能因设置过大而超出系统的适用范围,白白将投资浪费掉。规则七:要确保数据仓库工具协作使用 尽管数据仓库市场已经进入了第二代,它仍然是不成熟的。其表现为过多过剩的产品,有太多的厂家而无明确的领导者,导致了行业上的竞争,使购买决策变得困难。这使得那些想对来自多厂家的数据仓库工具和应用进行集成的厂商感到惶惑不知所措。同其他信息技术领域不同,如TCP/IP对于网络,RISC/UNIX对于企业级计算,SMTP对于消息传递,HTML和Java对于Web等,可靠的、被广泛接受的数据仓库标准还不存在。 在集成多厂家的数据仓库工具时,IT人员由于缺少了明确定义的标准的指导,而使数据仓库的实施从一开始就处于风险中。一些大一点的厂家通过将他们的产品与其他厂家的产品进行捆绑来降低风险,并做一些集成。规则八:关系的价值 在建立第一个数据仓库时,选择正确的合作伙伴是很关键的,包括顾问、分销商以及软件和硬件的厂家。 选择合作伙伴一是基于其能力,二是基于其具有长期同舟共济的愿望。要自问一下,这个厂家在初始实现以后是否还会积极地帮助我解决面临的问题?这个厂家现在在我的机构中的投资是什么?随着我们的项目的继续推进,情况会是什么样子? 当困难接踵而至的时候,对运作中的其他方面不感兴趣的合作伙伴将很难与其保持真诚的合作。 当寻找能够维持长期合作关系的合作伙伴的时候(通常是行业内已经建立关系的),一定要注意自己内在的感受。例如,在对行业中某个公司的一位资深顾问进行考察,以探察其对特定应用领域的数据集市的实现经验时,一定要保证能够与之合作。想要取得成功,就必须能够与所有的厂家和合作伙伴进行有效的合作和交流。 上面列出的大多数规则集中在人的问题上:计划、定义、协调、实践、完美。这一点也不出人意料,因为数据仓库的建立就是为了一件事情:帮助人们实实在在地更好地进行决策。 在过去,人为机器服务。人按照机器所
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- 制定质量标准
- 跟骨骨折经皮复位与置钉知识2025
- 中国古代文学作品选辅导
- DeepSeek大模型在医学影像诊断智能识别中的应用方案
- 2025年四川省绵阳市安州八年级中考一模生物试题 (含答案)
- 2025年甘肃省武威市凉州区松树、永昌九年制学校中考三模语文试题(含答案)
- 2025年广东省初中毕业生学业考试英语模拟试题(文字版无答案)
- 后置埋件安装垂直度技术专题
- 2025合同能源管理EMC(EPC)融资及信用保障
- 2025年北京市二手车交易合同
- 辽宁省2024年高中历史1月学生学业水平考试试题含解析
- 2012年重庆物理高考题及答案解析
- DL∕T 5210.4-2018 电力建设施工质量验收规程 第4部分:热工仪表及控制装置
- 江苏自然资源厅事业单位笔试真题2024
- HG+20231-2014化学工业建设项目试车规范
- 江苏省徐州市2023-2024学年八年级下学期期末英语试卷(含答案解析)
- 安徽省阜阳市2023-2024学年七年级下学期期末数学试题
- 急性胰腺炎护理查房课件
- 2024年河南省洛阳市中考第三次模拟考试语文试卷
- 华盛顿英语介绍课件
- 血标本凝血的应急预案
评论
0/150
提交评论