云端巨擘:大数据与云计算的时代航向

文章目录

大数据时代

  • 大数据定义:海量数据或巨量数据,其规模巨大到无法通过目前主流的计算机系统在合理时间内获取、存储、管理、处理并提炼以帮助使用者决策。

大数据特点(4v+1C

  1. 价值密度低(Value):在成本可接受的条件下,通过快速采集、发现和分析,从大量、多种类别的数据中提取价值的体系架构。
  2. 数据量大(Volume):存储的数据量巨大,PB级别是常态,因而对其分析的计算量也大。
  3. 快速(Velocity):数据增长速度快,而且越新的数据价值越大,这就要求对数据的处理速度也要快,以便能够从数据中及时地提取知识,发现价值。
  4. 多样(Variety):数据的来源及格式多样,数据格式除了传统的结构化数据外,还包括半结构化或非结构化数据,比如用户上传的音频和视频内容。而随着人类活动的进一步拓宽,数据的来源更加多样。
  • 复杂度(Complexity):对数据的处理和分析的难度大。

大数据与云计算的关系

云计算

云计算定义

  • 云计算长定义:云计算是一种商业计算模型。它将计算任务分布在大量计算机构成的资源池上,使各种应用系统能够根据需要获取计算力、存储空间和信息服务。
  • 云计算短定义:云计算是通过网络按需提供可动态伸缩的廉价计算服务。

云计算特点

  • 云计算的7个特点:超大规模、虚拟化、高可靠性、通用性、高可伸缩性、按需付费、极其廉价

云计算分类(服务类型)

  • 将软件作为服务SaaS(Software as a Service):针对性更强,它将某些特定应用软件功能封装成服务,如:Salesforce online CRM
  • 将平台作为服务PaaS(Platform as a Service):对资源的抽象层次更进一步,提供用户应用程序运行环境如:Google App Engine ,Microsoft Windows Azure
  • 将基础设施作为服务IaaS(Infrastructure as a Service):将硬件设备等基础资源封装成服务供用户使用如:Amazon EC2/S3

云计算实现机制

云计算体系结构

  • 管理中间件层和资源池层是云计算技术的最关键部分,SOA构建层的功能更多依靠外部设施提供。

云计算的管理中间件层

  • 资源管理 :均衡使用云资源节点,检测节点故障并试图恢复或屏蔽之,并对资源的使用情况进行监视统计
  • 任务管理:执行用户或应用提交的任务,包括完 成用户任务映象(Image)的部署和管理、任务调度、任务执行、任务生 命期管理等
  • 用户管理 : 实现云计算商业模式的一个必不可少的环节,包括提供用户交互接口、管理和识别用户身份、创建用户程序的执行环境、对用户的使用进行计费等
  • 安全管理:保障云计算设施的整体安全,包括身份认证、访问授权、综合防护和安全审计等

  • 简化的IaaS实现机制图
  • 用户交互接口向应用以WebServices方式提供访问接口,获取用户需求。
  • 服务目录是用户可以访问的服务清单。
  • 系统管理模块负责管理和分配所有可用的资源,其核心是负载均衡。
  • 配置工具负责在分配的节点上准备任务运行环境。
  • 监视统计模块负责监视节点的运行状态,并完成用户使用节点情况的统计。
相关推荐
乌龟跌倒1 小时前
磁盘结构、访问时间、调度算法
大数据
林农1 小时前
C05S16-MySQL高可用
linux·mysql·云计算
努力的小T1 小时前
Linux apt-mirror 同步搭建本地源详解教程
linux·运维·服务器·ubuntu·云计算·debian
神秘打工猴2 小时前
Spark任务的执⾏流程
大数据·分布式·spark
百家方案3 小时前
「下载」阿里云智慧办公园区解决方案:打造全息数字园区,助力商业地产数字化转型
阿里云·云计算·智慧园区
努力的布布4 小时前
Elasticsearch-索引的批量操作
大数据·elasticsearch·搜索引擎·全文检索
RodrickOMG4 小时前
【大数据】Hadoop三节点集群搭建
大数据·hadoop·分布式
智慧化智能化数字化方案4 小时前
工业金融政务数据分类分级体系建设解读
大数据·金融·数据分类分级·政务·政务数据分类·工业数据分类·金融数据分类分级
DashVector4 小时前
如何通过HTTP API插入或更新Doc
大数据·数据库·数据仓库·人工智能·http·数据库架构·向量检索
斑驳竹影4 小时前
ElasticSearch存储引擎
大数据·elasticsearch·搜索引擎