云端巨擘:大数据与云计算的时代航向

文章目录

大数据时代

  • 大数据定义:海量数据或巨量数据,其规模巨大到无法通过目前主流的计算机系统在合理时间内获取、存储、管理、处理并提炼以帮助使用者决策。

大数据特点(4v+1C

  1. 价值密度低(Value):在成本可接受的条件下,通过快速采集、发现和分析,从大量、多种类别的数据中提取价值的体系架构。
  2. 数据量大(Volume):存储的数据量巨大,PB级别是常态,因而对其分析的计算量也大。
  3. 快速(Velocity):数据增长速度快,而且越新的数据价值越大,这就要求对数据的处理速度也要快,以便能够从数据中及时地提取知识,发现价值。
  4. 多样(Variety):数据的来源及格式多样,数据格式除了传统的结构化数据外,还包括半结构化或非结构化数据,比如用户上传的音频和视频内容。而随着人类活动的进一步拓宽,数据的来源更加多样。
  • 复杂度(Complexity):对数据的处理和分析的难度大。

大数据与云计算的关系

云计算

云计算定义

  • 云计算长定义:云计算是一种商业计算模型。它将计算任务分布在大量计算机构成的资源池上,使各种应用系统能够根据需要获取计算力、存储空间和信息服务。
  • 云计算短定义:云计算是通过网络按需提供可动态伸缩的廉价计算服务。

云计算特点

  • 云计算的7个特点:超大规模、虚拟化、高可靠性、通用性、高可伸缩性、按需付费、极其廉价

云计算分类(服务类型)

  • 将软件作为服务SaaS(Software as a Service):针对性更强,它将某些特定应用软件功能封装成服务,如:Salesforce online CRM
  • 将平台作为服务PaaS(Platform as a Service):对资源的抽象层次更进一步,提供用户应用程序运行环境如:Google App Engine ,Microsoft Windows Azure
  • 将基础设施作为服务IaaS(Infrastructure as a Service):将硬件设备等基础资源封装成服务供用户使用如:Amazon EC2/S3

云计算实现机制

云计算体系结构

  • 管理中间件层和资源池层是云计算技术的最关键部分,SOA构建层的功能更多依靠外部设施提供。

云计算的管理中间件层

  • 资源管理 :均衡使用云资源节点,检测节点故障并试图恢复或屏蔽之,并对资源的使用情况进行监视统计
  • 任务管理:执行用户或应用提交的任务,包括完 成用户任务映象(Image)的部署和管理、任务调度、任务执行、任务生 命期管理等
  • 用户管理 : 实现云计算商业模式的一个必不可少的环节,包括提供用户交互接口、管理和识别用户身份、创建用户程序的执行环境、对用户的使用进行计费等
  • 安全管理:保障云计算设施的整体安全,包括身份认证、访问授权、综合防护和安全审计等

  • 简化的IaaS实现机制图
  • 用户交互接口向应用以WebServices方式提供访问接口,获取用户需求。
  • 服务目录是用户可以访问的服务清单。
  • 系统管理模块负责管理和分配所有可用的资源,其核心是负载均衡。
  • 配置工具负责在分配的节点上准备任务运行环境。
  • 监视统计模块负责监视节点的运行状态,并完成用户使用节点情况的统计。
相关推荐
AKAMAI1 小时前
Sport Network 凭借 Akamai 实现卓越成就
人工智能·云原生·云计算
计算机编程小央姐1 小时前
跟上大数据时代步伐:食物营养数据可视化分析系统技术前沿解析
大数据·hadoop·信息可视化·spark·django·课程设计·食物
智数研析社2 小时前
9120 部 TMDb 高分电影数据集 | 7 列全维度指标 (评分 / 热度 / 剧情)+API 权威源 | 电影趋势分析 / 推荐系统 / NLP 建模用
大数据·人工智能·python·深度学习·数据分析·数据集·数据清洗
潘达斯奈基~2 小时前
《大数据之路1》笔记2:数据模型
大数据·笔记
寻星探路2 小时前
数据库造神计划第六天---增删改查(CRUD)(2)
java·大数据·数据库
翰林小院4 小时前
【大数据专栏】流式处理框架-Apache Fink
大数据·flink
孟意昶5 小时前
Spark专题-第一部分:Spark 核心概述(2)-Spark 应用核心组件剖析
大数据·spark·big data
IT学长编程6 小时前
计算机毕业设计 基于Hadoop的健康饮食推荐系统的设计与实现 Java 大数据毕业设计 Hadoop毕业设计选题【附源码+文档报告+安装调试】
java·大数据·hadoop·毕业设计·课程设计·推荐算法·毕业论文
AAA修煤气灶刘哥6 小时前
Kafka 入门不踩坑!从概念到搭环境,后端 er 看完就能用
大数据·后端·kafka
10岁的博客7 小时前
《云计算如何驱动企业数字化转型:关键技术与实践案例》
云计算