文章目录
- 大数据时代
-
- [大数据特点(4v+1C](#大数据特点(4v+1C)
- 大数据与云计算的关系
- 云计算
大数据时代
- 大数据定义:海量数据或巨量数据,其规模巨大到无法通过目前主流的计算机系统在合理时间内获取、存储、管理、处理并提炼以帮助使用者决策。
大数据特点(4v+1C
- 价值密度低(Value):在成本可接受的条件下,通过快速采集、发现和分析,从大量、多种类别的数据中提取价值的体系架构。
- 数据量大(Volume):存储的数据量巨大,PB级别是常态,因而对其分析的计算量也大。
- 快速(Velocity):数据增长速度快,而且越新的数据价值越大,这就要求对数据的处理速度也要快,以便能够从数据中及时地提取知识,发现价值。
- 多样(Variety):数据的来源及格式多样,数据格式除了传统的结构化数据外,还包括半结构化或非结构化数据,比如用户上传的音频和视频内容。而随着人类活动的进一步拓宽,数据的来源更加多样。
- 复杂度(Complexity):对数据的处理和分析的难度大。
大数据与云计算的关系
云计算
云计算定义
- 云计算长定义:云计算是一种商业计算模型。它将计算任务分布在大量计算机构成的资源池上,使各种应用系统能够根据需要获取计算力、存储空间和信息服务。
- 云计算短定义:云计算是通过网络按需提供可动态伸缩的廉价计算服务。
云计算特点
- 云计算的7个特点:超大规模、虚拟化、高可靠性、通用性、高可伸缩性、按需付费、极其廉价
云计算分类(服务类型)
- 将软件作为服务SaaS(Software as a Service):针对性更强,它将某些特定应用软件功能封装成服务,如:Salesforce online CRM
- 将平台作为服务PaaS(Platform as a Service):对资源的抽象层次更进一步,提供用户应用程序运行环境如:Google App Engine ,Microsoft Windows Azure
- 将基础设施作为服务IaaS(Infrastructure as a Service):将硬件设备等基础资源封装成服务供用户使用如:Amazon EC2/S3
云计算实现机制
云计算体系结构
- 管理中间件层和资源池层是云计算技术的最关键部分,SOA构建层的功能更多依靠外部设施提供。
云计算的管理中间件层
- 资源管理 :均衡使用云资源节点,检测节点故障并试图恢复或屏蔽之,并对资源的使用情况进行监视统计
- 任务管理:执行用户或应用提交的任务,包括完 成用户任务映象(Image)的部署和管理、任务调度、任务执行、任务生 命期管理等
- 用户管理 : 实现云计算商业模式的一个必不可少的环节,包括提供用户交互接口、管理和识别用户身份、创建用户程序的执行环境、对用户的使用进行计费等
- 安全管理:保障云计算设施的整体安全,包括身份认证、访问授权、综合防护和安全审计等
- 简化的IaaS实现机制图
- 用户交互接口向应用以WebServices方式提供访问接口,获取用户需求。
- 服务目录是用户可以访问的服务清单。
- 系统管理模块负责管理和分配所有可用的资源,其核心是负载均衡。
- 配置工具负责在分配的节点上准备任务运行环境。
- 监视统计模块负责监视节点的运行状态,并完成用户使用节点情况的统计。