莫张周刘王 发表于 2024-7-15 08:33:52

【云计算与大数据计算】大数据物理、集成、安全架构及阿里云飞天系统架构讲

一、物理架构

物理架构 - 企业大数据系统的各层次系统最终要部署到主机节点中,这些节点通过网络连接成 为一个团体,为企业的大数据应用提供物理支撑 ,企业大数据系统由多个逻辑层构成,多个逻辑层可以映射到一个物理节点上,也可以映射到多个物理节点上
在映射时需要考虑三个方面的标题:一是是否轻易识别,二是是否充足集约,三是是否可以或许同构
二、集成架构

集成架构 - 企业大数据系统由多个系统集成而成,每个系统都提供了多种协媾和接口, 以便企业大数据系统的内部系统间集成和外部系统与大数据系统的集成
企业大数据系统的集成可以分为总体集成和专项集成,总体集成是指各构成系统间的集成,通过总体集成可以构成高校,可靠,安全运行的企业大数据系统,若企业大数据系统之外的某个应用系统或大数据系统之内的某个应用系统只想与存储系统,调理系统等进行集成,那么可通过调用这些系统开放的接口来实现,这种集成方式就是专项集成
三、安全架构

安全架构 - 由于企业大数据系统的数据资源和计算资源广泛地分布在多个节点上,以是用户的 身份、权限等安全,数据资源的存储、传输、访问等安全,以及计算资源的访问、监控、调整、规复等安全,都是企业大数据系统在进行安全架构设计时需要考虑的标题
一样平常来讲,企业大数据的安全架构由针对三层的安全设计构成,这三层分别是用户层,应用层和数据层,针对每一层的关键行为加入安全因素的设计,以确保系统的团体安全
四、阿里云飞天系统体系架构

飞天(Apsara)是由阿里云自主研发、服务全球的超大规模通用计 算操作系统  
它可以将遍布全球的百万级服务器连成一台超级计算机、以在线公共服务的方式为社会提供计算本领  
7年已往,飞天已经为全球200多个国家和地域的创新创业企业、政府、机构等提供服务
阿里云飞天团体架构 - 飞天平台的体系架构如图所示,整个飞天平台包括飞天内核和飞天开辟服务两大部门
https://img-blog.csdnimg.cn/c2e93694b7ed4637a1b5360ddc0f384e.png
 飞天管理着互联网规模的底子办法。其最底层是遍布全球的几十个数据中心和数百个PoP节点
飞天内核跑在每个数据中心内里,它负责统一管理数据中心内的通用服务器集 群,调理集群的计算、存储资源,支撑分布式应用的部署和执行
安全管理根植在飞天内核最底层。飞天内核提供的授权机制可以或许有用实现“最小权限原则 (principle of least privilege)”,同时还建立了自主可控的全栈安全体系
监控报警诊断是飞天内核最基本的本领之一。飞天内核对上层应用提供了非常详细的、无中断的监控数据和系统变乱采集
在底子公共模块之上有两个最核心的服务,一个叫盘古,一个叫伏羲
天基是飞天的自动化运维服务,负责飞天各个子系统的部署、升级、扩容以及故障迁移 
阿里云飞天平台内核可以分成以下几个部门

分布式系统底层服务 - 其提供分布式环境下所需要的分布式协调服务、长途过程调用服务、安全管理、分布式资源调理等功能
盘古分布式文件系统 - 盘古(Pangu)是一个分布式文件系统, 盘古系统 的设计目标是将大量通用机器的存储资源聚合在一起,为用户提供大规模、高可靠、高可用、高吞吐量和可扩展的存储服务
伏羲任务调理系统 - 该系统为集群中的任务提供调理服务,同时支持强调响应速率的在线 服务(Online Service)和强调处理数据吞吐量的离线任务(Batch Processing Job)
集群监控和部署 - 神农(Shennong )是飞天平台内核中负责信息收集 、监控和诊断的模块,大禹 (Dayu)是飞天内核中负责提供配置管理和部署的模块
飞天开放服务 

包括弹性计算 (ECS)、阿里云对象存储(OSS)、表格存储服 务(Table Store)、关系型数据库服务(RDS)、流式计算服务 (Stream Compute)和大数据计算服务(MaxCompute)等
弹性计算 (ECS) - 云服务器ECS(Elastic Compute Service)是一种云计算服务 , 它的管理方式比物理服务器更加简朴、高效
 阿里云对象存储(OSS) - 阿里云对象存储 (Object Storage Service, OSS)是阿里云对外提供的海量、安全、低本钱、高可靠的云存储服务
表格存储 (Table Store) -  它是构建在阿里云飞天分布式系统之上的NoSQL数据存储服务,提供海量布局化数据的存储和实时访问
大数据计算服务(MaxCompute) - 大数据计算服务(MaxCompute,原名 ODPS)是一种快速、完全托管的TB/PB级数据仓库解决方案
阿里云飞天 OpenStack 和 Hadoop 的差别

OpenStack和 Hadoop是软件,它们并没有解决客户的CAPEX 投入标题、运维人员投入标题,需要部署到自有的硬件上,一样平常只用于单个企业的内部环境
 飞天上面提供了基于 Hadoop、EMR、Mongo等开源软件的托管服务,这是飞天开放 本领的表现
阿里云飞天与 VMware 、华为 FusionSphere 的差别

假造化未便是云计算,云的实时在线、海量弹性、多租户隔离、专业运维都是传统假造化软件所欠缺的
 VMware的三大件主要解决了计算的服从标题,但是没有解决计算的规模标题 
华为的 FusionSphere 其实是基于开源软件进行定制并适配华为硬件的软件系统,飞天内核在规模、性能、稳定性和通用性上都逾越了 FusionSphere
五、主流大数据厂商

Cloudera

Cloudera是一家专业从事基于Apache Hadoop的数据管理软 件销售和服务的公司 , 它发布的实时查询开源项目Impala比基于 MapReduce的HiveSQL的查询速率提拔了3~90 倍
https://img-blog.csdnimg.cn/b8a199ab2e2d4f7b98b7e0fac5aec82e.png
 Hortonworks

Hortonworks的开放式互联平台帮助企业管理所拥有的数据(动态数据以及静态 数据),为用户组织启用可操作情报。
https://img-blog.csdnimg.cn/dd4f08876b8a474b8d202a55adb6bfa8.png 
Amazon 

Amazon 的 AWS 自己就是最完备的大数据平台, Amazon Web Services 提供了一系列广泛的服务,可以快速 、轻松地构建和部署大数据分析应用程序
https://img-blog.csdnimg.cn/e5141b3fb3284d8792943b14c12d1ead.png 
Google 

Google提出的 MapReduce计算框架在许多大数据范畴得到了非常广泛的应用
https://img-blog.csdnimg.cn/b9f64613286e47ba8160d2990ac50826.png 
 微软 

微软推出的商业数据分析系统 Microsoft Analytics Platform System 可以或许通过其扩充的大规模平行处理整合式系统支持混合格式的数据仓库,借此顺应数据仓库环境不停发展的需求
https://img-blog.csdnimg.cn/9b35c2ced4b2483eb32936a76f9df47c.png 
阿里云数加平台

数加是阿里云为企业大数据的实施提供的一套完备的一站式大数据解决方案,
数加平台由大数据计算服务(MaxCompute)、分析型数据库(Analytic DB)、流计算 (StreamCompute)共同构成了底层强大的计算引擎, 速率更快, 本钱更低  
https://img-blog.csdnimg.cn/d4f4d3826b614a11b313f72ed65cdd99.png
https://img-blog.csdnimg.cn/4053b357ef97405c8bfe5d2f8555c026.png 
创作不易 以为有帮助请点赞关注收藏~~~ 


免责声明:如果侵犯了您的权益,请联系站长,我们会及时删除侵权内容,谢谢合作!更多信息从访问主页:qidao123.com:ToB企服之家,中国第一个企服评测及商务社交产业平台。
页: [1]
查看完整版本: 【云计算与大数据计算】大数据物理、集成、安全架构及阿里云飞天系统架构讲