




已阅读5页,还剩11页未读, 继续免费阅读
版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
目录: 什么是大数据 Hadoop介绍-HDFS、MR、Hbase 大数据平台应用举例-腾讯 公司的大数据平台架构 “就像望远镜让我们能够感受宇宙,显微镜让我们能够观测微生物一样,大数据正在改变我们的生活以 及理解世界的方式”。 大数据的4V特征-来源 公司的“大数据” 随着公司业务的增长,大量和流程、规则相关的非结构化数据也爆发式增长。比如: 1、业务系统现在平均每天存储20万张图片,磁盘空间每天消耗100G; 2、平均每天产生签约视频文件6000个,每个平均250M,磁盘空间每天消耗1T; 三国里的“大数据” “草船借箭”和大数据有什么关系呢?对天象的观察是基于一种对风、云、温度、湿度、光照和所处节气 的综合分析这些数据来源于多元化的“非结构”类型,并且数据量较大,只不过这些数据输入到的不是电 脑,而是人脑并最终通过计算分析得出结论。 深入浅出解析大数据平台架构 2015/1/12 Google分布式计算的三驾马车 Google File System用来解决数据存储的问题,采用N多台廉价的电脑,使用冗余(也就是一份文件保 存多份在不同的电脑之上)的方式,来取得读写速度与数据安全并存的结果。 Map-Reduce说穿了就是函数式编程,把所有的操作都分成两类,map与reduce,map用来将数据 分成多份,分开处理,reduce将处理后的结果进行归并,得到最终的结果。 BigTable是在分布式系统上存储结构化数据的一个解决方案,解决了巨大的Table的管理、负载均衡 的问题。 Hadoop体系架构 Hadoop核心设计 深入浅出解析大数据平台架构 2015/1/12 HDFS介绍-文件读流程 Client向NameNode发起文件读取的请求。 NameNode返回文件存储的DataNode的信息。 Client读取文件信息。 HDFS介绍-文件写流程 深入浅出解析大数据平台架构 2015/1/12 Client向NameNode发起文件写入的请求。 NameNode根据文件大小和文件块配置情况,返回给Client它所管理部分DataNode的信息。 Client将文件划分为多个Block,根据DataNode的地址信息,按顺序写入到每一个DataNode块中。 MapReduce映射、化简编程模型 输入数据-Map分解任务-执行并返回结果-Reduce汇总结果-输出结果 Hbase分布式数据存储系统 深入浅出解析大数据平台架构 2015/1/12 Client:使用HBase RPC机制与HMaster和HRegionServer进行通信 Zookeeper:协同服务管理,HMaster通过Zookeepe可以随时感知各个HRegionServer的健康状况 HMaster: 管理用户对表的增删改查操作 HRegionServer:HBase中最核心的模块,主要负责响应用户I/O请求,向HDFS文件系统中读写数据 HRegion:Hbase中分布式存储的最小单元,可以理解成一个Table HStore:HBase存储的核心。由MemStore和StoreFile组成。 HLog:每次用户操作写入Memstore的同时,也会写一份数据到HLog文件 还有哪些NoSQL产品? 深入浅出解析大数据平台架构 2015/1/12 为什么要使用NoSQL? 一个高并发网站的DB进化史 关系模型聚合数据模型的转换-基本变换 深入浅出解析大数据平台架构 2015/1/12 关系模型聚合数据模型的转换-内嵌变换 关系模型聚合数据模型的转换-分割变换 深入浅出解析大数据平台架构 2015/1/12 关系模型聚合数据模型的转换-内联变换 Hadoop2.0 MapReduce: JobTracker:协调作业的运行。 TaskTracker:运行作业划分后的任务。 深入浅出解析大数据平台架构 2015/1/12 大数据的技术领域 腾讯大数据现状(资料来自2014.4.11 腾讯分享日大会) 深入浅出解析大数据平台架构 2015/1/12 腾讯大数据平台产品架构 深入浅出解析大数据平台架构 2015/1/12 腾讯大数据平台与业务平台的关系 深入浅出解析大数据平台架构 2015/1/12 公司数据处理平台的基础架构 深入浅出解析大数据平台架构 2015/1/12 公司大数据平台架构图 深入浅出解析大数据平台架构 2015/1/12 应用一数据分析 应用二视频存储 深入浅出解析大数据平台架构 2015/1/12 应用三离
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- 浦北县中考数学试卷
- 沿河土家族自治县选调教研员考试真题2024
- 莆田市高三二模数学试卷
- 平潭小升初数学试卷
- 期末季数学试卷
- 濮阳高三一模数学试卷
- 2025山西中医药大学第二批招聘博士研究生25人笔试备考试题及答案解析
- 2025年合肥市六安路小学教育集团招聘编外聘用教师考试参考题库附答案解析
- 内江市模拟考试数学试卷
- 去年全国高考数学试卷
- 慢性疾病管理与健康指导手册
- 2025年高中音乐教师招聘考试测试题及参考答案
- 主持人基础知识培训课件
- 2025年储能运维面试题及答案
- 医院招聘面试题目及参考答案
- 建筑工地基孔肯雅热防控和应急方案
- 2025年高考山东卷物理试题讲评及备考策略指导(课件)
- 租房合同范本下载(可直接打印)
- 佳能-6D-相机说明书
- DZ∕T 0153-2014 物化探工程测量规范(正式版)
- 木栈道专项施工方案
评论
0/150
提交评论