学海无涯机电社区

 找回密码
 立即注册
搜索
查看: 396|回复: 0
打印 上一主题 下一主题

深入浅出解析大数据平台架构

[复制链接]
威望
138
金钱
51
贡献
4286

71

主题

110

帖子

4286

积分

论坛元老

Rank: 8Rank: 8

积分
4286
跳转到指定楼层
楼主
发表于 2020-6-27 08:06:25 | 只看该作者 |只看大图 回帖奖励 |倒序浏览 |阅读模式
目录:
  什么是大数据
  Hadoop介绍-HDFS、MR、Hbase
  大数据平台应用举例-腾讯
  公司的大数据平台架构
  “就像望远镜让我们能够感受宇宙,显微镜让我们能够观测微生物一样,大数据正在改变我们的生活以及理解世界的方式……”。
 大数据的4V特征-来源




公司的“大数据”
  随着公司业务的增长,大量和流程、规则相关的非结构化数据也爆发式增长。比如:
  1、业务系统现在平均每天存储20万张图片,磁盘空间每天消耗100G;
  2、平均每天产生签约视频文件6000个,每个平均250M,磁盘空间每天消耗1T;
  ……
  三国里的“大数据”
  “草船借箭”和大数据有什么关系呢?对天象的观察是基于一种对风、云、温度、湿度、光照和所处节气的综合分析这些数据来源于多元化的“非结构”类型,并且数据量较大,只不过这些数据输入到的不是电脑,而是人脑并最终通过计算分析得出结论。
  Google分布式计算的三驾马车
  Google File System用来解决数据存储的问题,采用N多台廉价的电脑,使用冗余(也就是一份文件保存多份在不同的电脑之上)的方式,来取得读写速度与数据安全并存的结果。
  Map-Reduce说穿了就是函数式编程,把所有的操作都分成两类,map与reduce,map用来将数据分成多份,分开处理,reduce将处理后的结果进行归并,得到最终的结果。
  BigTable是在分布式系统上存储结构化数据的一个解决方案,解决了巨大的Table的管理、负载均衡的问题

Hadoop体系架构


Hadoop核心设计



 HDFS介绍-文件读流程




Client向NameNode发起文件读取的请求。
  NameNode返回文件存储的DataNode的信息。
  Client读取文件信息。
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

手机版|小黑屋| 学海无涯机电社区  

GMT+8, 2024-4-24 22:30 , Processed in 0.096151 second(s), 31 queries .

Powered by Discuz!

© Comsenz Inc.

快速回复 返回顶部 返回列表