面向商务智能的人力资源数据仓库设计与实现_第1页
面向商务智能的人力资源数据仓库设计与实现_第2页
面向商务智能的人力资源数据仓库设计与实现_第3页
面向商务智能的人力资源数据仓库设计与实现_第4页
面向商务智能的人力资源数据仓库设计与实现_第5页
已阅读5页,还剩2页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

1、面向商务智能的人力资源数据仓库设计与实现面向商务智能的人力资源数据仓库设计与实现摘要:针对现代企业海量数据管理的目标和任务,从日益增 长的用户需求出发划分人力资源数据仓库主题,搭建数据获取、数据 管理和数据使用三个递进层次的商务智能平台架构。结合某大型国有 物流企业sap-bi实施项目案例,全面阐述了数据仓库建设中基于扩 展星形结构信息立方体的数据抽取、清洗、转换和加载的完整过程, 指出了系统建设中增量数据传输和性能优化手段等关键技术点。实践 表明,该商务智能平台能够协助企业人力资源战略决策,有效提升管 理水平。关键词:人力资源;商务智能;数据仓库;扩展星形结构; 信息立方体中图分类号:tp3

2、92文献标志码:a文章编号:1006-8228(2014) 04-18-03abstract: to deal with the object and assignment for massive data management of modern enterprise, hr data warehouse themes have been partitioned according to increasing demand of customers bi platform architecture is constructed from three progressive stages in

3、 eluding data acquisition, data management and data usage combing with a sap-bi case of one large state-owned logistics company, the procedure of extracting, washing, transferring and loading in data warehouse based on infocube is illustrated completely. the key technology including increment transm

4、ission and performance optimization etc in system implementation is pointed out the practice results show that the bi platform can assist hr strategic decisions and enhance the management level effectively.key words: human resource; bi; data warehouse; extended star schema; infocubeo引言人力资源管理信息化(e-ii

5、r) 1推动了从行政事务管理向战略 性人力资源管理的转变,同时大幅度提高了企业人力资源管理的工作 效率和技术含量。然而,e-iir系统面向一线工作人员,所生成的h 常事务型明细数据无法帮助决策者全面和实吋地掌握企业级的多维 统计信息,数据仓库很好地解决了这个问题。数据仓库是一个面向主 题的、集成的、非易失的、随时间变化的支持管理人员决策的数据集 合2,包含粒度可变的企业数据。以决策者需求和未來发展为导向 设计和构建数据仓库是企业商务智能解决方案的坚实基础。木文以笔 者参与实施的某大型国有物流集团人力资源商务智能项目为例加以 阐述,该项目基于sap-bie3套件开发完成。其中的sap-bw是一整

6、 套覆盖数据仓库建设周期的产品包,包括数据仓库的建模、数据集成 和转换、数据存储和管理、元数据管理和数据可视化分析等产品。1建设目标现阶段该集团公司已经实现基于sap产品的erp业务和财务系 统,全面覆盖下属各行业子公司,集团整体信息化建设已然跨越集中 建设阶段,正处于成熟应用向创新应用转变的关键时期。随着sap erp 系统的上线运行,产生了海量的事务型数据,这对数据的管理和利用 提出新的挑战,建设为决策支持系统和联机分析应用服务的数据仓库 成为当前的紧迫任务。因此,面向集团管理层的人事管理需求,基于 维度划分数据粒度,完成人事管理日常数据的抽取、转换和加载,构 建多维星形数据模型,是人力资

7、源数据仓库建设实施的首要目标和任 务。2建设主题该集团公司人力资源管理和关的需求共涉及人力资源领域四个 主题,分别为:人事管理、组织管理、吋间管理和薪酬管理。人事管 理是对企业人才结构的总体评价。作为集团职能部门,人力资源部需 统计、查询员工数据,如人员结构、员工合同、在岗职工分布、新增 人员总量及录用、人员减少情况和人员退休预测等,以便为公司的各 项人力资源决策提供可靠的基础依据。组织管理可实现下属公司的定 员编制数、机构数量的统计,可以根据机构类别、机构规格、经营类 型、机构经济类型、专业板块、专业子板块、机构专业队伍类别等维 度进行组合分析。时间管理可实现员工和部门的汇总上班天数、休假

8、天数、加班天数和出勤/缺勤天数等数据统计,为薪酬核算和绩效考 核提供相关支持。薪酬管理帮助人力资源部及时掌握下属公司各类员 工的工资数据和福利数据,在公司层面掌控成本,为与市场和行业的 工资福利进行比较提供有力的数据依据。3蓝图设计3. 1 bi架构sap商务智能系统架构如图1所示。它以数据仓库、在线分析处 理(olap)、数据挖掘三种技术的整合为基础,建立企业数据中心和 业务分析模型,以提高企业获取经营分析信息的能力。系统架构由四部分组成。(1) 数据源:系统的数据来源。通常包括企业内部信息和外部信 息,既存放于关系数据库中的各种业务处理数据和各类文档数据。(2) 数据存储与管理:数据仓库的

9、关键点。数据仓库的组织管理方式决定了它有别于传统数据库,同吋也决定了其对外部数据的表现 形式。<!-endprint-> <!-startprint->(3) olap 服务:对分析需要的数据进行有效集成,按多维模型予以组织,以便进行多 角度、多层次的分析,并发现趋势。(4)前端工具:主要包括各种报表工具、查询工具、数据分析工 具、数据挖掘工具以及各种基于数据仓库或数据集市的应用开发工具。3. 2物理模型与用户视觉交互的前端数据常常以报表的形式展现,这些报表是 高度汇总的数据集合,源头是sap-hr业务系统的明细数据。不失一 般性,下面以组织管理主题屮的“职务层级分布表

10、”为实现目标,具 体探讨数据仓库物理模型的建立过程。内容如表1所示。必须指出的 是木文为便于讨论,需要从案例报表出发建模,而在实际项冃中应从 多个报表归纳出主题,不能为了实现单个报表进行大量的建模工作。3. 2. 1数据源数据仓库木身不产生数据,所有存储的数据都來源于sap-hr业 务系统。数据源是一个指向sap-hr业务系统数据存放地址的指针, 通过该指针可以将业务明细数据抽取到数据仓库永久存储区域(psa)o 结合职务层级分布表内容,对应的数据源如表2所示。业务数据源 0hr_pa_0中只包含必要的关键字段,说明在某个月份某个员工在岗, 至于该员工的具体信息可以到对应的主数据源中查找。这种

11、二维数据 表间的关联关系正是关系数据库的典型特征,说明数据源指向的 sap-hr业务系统后台结构是基于关系数据库构成。3. 2. 2信息对象信息对象主要用于存放主数据信息,有特征和关键值两类。特征 是用來描述事物主要特点的字段,具有惟一性。在infocube中被分 配到每一个维度,一个维度可以有多个特征,也称为维度特征。关键 值存放在infocube的事实表中,用來对量化数据进行描述。职务层 级表用到的信息对象如表3所示,数据抽取转换加载来源于表中对应 的数据源。3. 2. 3数据存储对象从数据源抽取的存放在数据仓库psa中的原始业务数据只是简 单的拷贝,不能直接使用,数据存储对象(ds0)提

12、供了前期的数据 清洗和转换。ds0仍然是二维表结构,存储明细数据,支持关键值的 覆盖和合计。为了将业务数据的一条记录从最初的“日历年/月”和 “人员编号”两个特征扩展到包含“公司代码”、“组织单位”、 “员工组”、“员工子组”等特征,转换规则先后使用了两层ds0结 构,如图2和图3所示。图2的转换规则从数据源0hr_pa_0至第一 层ds0,其中关键值“员工人数”直接设置为常数1,因为一条员工 记录就对应一名员工。图3中增加的特征來源于读取的员工主数据, 读取的依据是人员编号和日历年/月的联合主键,这种特征属性的时 间相关性是人力资源业务的鲜明特点。比如某个员工在某个时间段属 于某个组织单位,

13、在另一个吋间段完全可能属于不同的组织单位,其 他特征的情况类似。因此必须是人员编号和日历年/月的联合主键才 能惟一确定具体特征值。再者可以看出笫二层ds0通过读取主数据使得二维表冗余度大 大增加,数据仓库的这种设计方法和关系数据库设计模式大相径庭, 却为将平面二维数据加载到多维信息立方体奠定了良好的基础。3. 2. 4信息立方体infocube是根据最终用户请求塑造的多维扩展星形结构,是最 主要的用于报表的模型。它通过关联多张二维平面表实现多维结构, 支持快速而高效的直接数据存取。infocube中心是事实表,如图4 所示,由时间维、公司组织维、岗位维和员工维的id和关键值“员 工人数”构成。

14、在事实表周围是维表,每个维表结构由事先指定的若 干特征维度sid组成,维表记录数等于特征维度记录数的笛卡尔积。 主数据表不在infocube中,它们通过sid表和维度表关联。4关键技术4.1增量传输从数据源抽数到psa的方式根据数据量的多少分为两种。一种是 全量抽数,既每次都将可用的数据全部抽取,已抽的数据会重复抽取, 这种方式适用于数据量较小的情况;另一种方式是增量抽取,只抽取 上次抽完后增删改过的数据,已抽的数据不会再次抽取,这种方式适 用于大数据量的情况。人事数据仓库的数据源如人事管理和培训活动 管理使用全量抽数,时间管理和工资核算使用增量抽数。这里需注意, 因为人事涉及的增量数据源使用

15、附加镜像(add),第一层dso关键值 转换规则不能是覆盖只能是合计。此外,尽管采用全量抽数的人事数 据源的数据量相比后勤和财务等模块的数据量为小,但是实际项目中 仍然有可能很庞大,用户不愿意接受每次低效的重复抽数,可以采用 “假增量”的抽取模式,既只抽取距今一个吋间段的数据,规定用户 超过该时间段的数据不能增删和修改。该吋间段内的数据其实还是全 量抽取,但是也仅抽取这个吋间段的数据量,如此大大降低了从业务 系统抽数的负载。4. 2性能优化数据仓库中信息立方体蕴含的多维度海量数据使得实吋查询成 为奢望,一般情况是滞后若干时间获取统计数据。可以主要从以下两 个方面考虑加快查询速度。(1)建立聚集

16、。聚集是数据仓库经常使用的性能优化方法,是以 空间换吋间的方法。对信息立方体的数据按照指定的了集进行数据汇 总,汇总数据存放在不同的独立事实表中,根据常用的查询种类,一 个基本事实表可以设置多个聚集事实表。在报表运行屮,系统自动根 据报表的查询维度找到最合适也就是数据量最少的聚集事实表读取 数据。由于数据量的减少,降低了报表的运行时间。(2)使用虚拟信息提供者。可以利用bi中的各种虚拟的信息提供 者來把不同的数据对象,如dso或信息立方体的数据融合在一个虚拟 的信息提供者中。在信息立方体中存放基于关键指标的聚集数据,在 数据存储对象中存放详细的业务数据。通过追溯的功能,可以浏览不 同阶层的聚集或明细数据。这样的设计保证了汇总数据与详细数据的 一致性,提高了数据访问的效率,降低了数据的冗余。5结束语目前数据仓库技术已趋成熟,许多产品供应商推出了商品化软件, 包括 oracle> ibm、microsoft> sas、teradata> sap 等。由于国夕卜 企业率先使用erp系统且更早注重基于数据的分析和企业管理决策 的支持,因此数据仓库产品被广泛应用于国外企业的数据管理领域。 比较而言,国内企业对于数据仓库的需求和建设仍处于起步时期,且 侧重点在于应用,既如何选择合适的国际化产品并结合自身业务

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论