医疗保健协会选择 NetApp 进行大数据分析

客户:

医疗保健协会(Healthcare Association, U.S.)

解决方案目标

"我们需要一个可靠、快速且经济高效的 Hadoop 解决方案来应对我们的新数据计划。在概念验证中,NetApp 的 Hadoop 解决方案被证明比商用服务器方法更快、更可靠。 200TB 的概念验证进展顺利,我们已经开始朝着数据计划的目标取得进展。

NetApp 产品和服务

• NetApp® E5560 storage array

• NetApp SANtricity®

• NetApp FAS2540

• NetApp FAS3250 (Disaster Recovery)

• Clustered Data ONTAP®

环境

• 文件系统: Hortonworks Data Platform

(Hadoop)

• 集群: 4 Hadoop DataNodes

• OS: RHEL 6.2

• 服务器平台: HP

• 数据存储: NetApp E5560

• NameNode 存储: FAS2540 and FAS3250

• Network: Brocade 5100 switches

• 协议: HDFS, SAS

客户介绍

医疗保健协会是一个全国性联合会,由众多独立的、以社区为基础的、当地经营的医疗保险公司组成。通过访问来自近 1.05 亿人的数据,该公司将强大的数据转化为丰富的见解和有意义的分析,从而改变美国医疗保健的交付和支付方式。

客户情况

为了加速医疗保健的智能化、数据化和可及性, 该组织启动了一项由三部分组成的项目,其中包括确定如何最好地使用公司和合作伙伴数据、评估分析数据的新功能以及使用数据洞察来提高客户保留率。

医疗保健协会选择了适用于 Hadoop 的 NetApp 解决方案来帮助释放数据的潜力。但是,对可靠性和可扩展性的担忧促使该公司在完全致力于解决方案之前请求概念验证 (POC)。

概念验证(POC)

NetApp 团队很快就确定了 200TB 的 POC。在 POC 期间,运行的性能和故障切换测试让客户对 NetApp Hadoop 解决方案充满信心。POC 还帮助客户更好地为在生产中运行的大量数据做好准备。

POC 测试结果

• 性能更好。NetApp E 系列解决方案在采集和 MapReduce 作业上的执行速度是内部驱动器的两倍。

• 可用性更高。与带有内置驱动器的白盒服务器相比,E 系列解决方案的停机时间更少。即使数据节点出现故障,服务在存储故障转移期间也不会中断。NameNode 恢复得更快。E 系列的一个关键优势是能够在群集运行时热插拔磁盘驱动器。

为什么选择 NetApp

• 提高效率。两个数据副本而不是三个(Hadoop 默认值)可减少所需的容量并加快应用程序性能,而不会影响数据可用性。

• 轻松部署。参考体系结构的模块化设计使添加节点和扩展变得简单,尤其是对于存储密集型工作负载。SANtricity 软件支持在存储保持在线的同时执行管理任务,因此可以在不中断的情况下进行配置更改、维护或存储容量扩展。

• 成本更低。 与带有内部驱动器的白盒服务器的成本相比,客户有望在五年内节省 210万 美元的资本支出。

相关推荐
电商API_1800790524723 分钟前
淘宝商品详情 API 性能优化秘籍:QPS 提升 5 倍的技术方案
大数据·性能优化·数据挖掘·数据分析·网络爬虫
自学互联网4 小时前
Fine Bi数据可视化day01:连接到数据
数据分析
腾讯WeTest4 小时前
Al in CrashSight ——基于AI优化异常堆栈分类模型
人工智能·分类·数据挖掘
阿里云大数据AI技术5 小时前
EMR Serverless Stella 1.0 技术分享:StarRocks企业级版本内核重大突破
数据分析
--fancy8 小时前
如何使用Tushare构建自己的本地量化投研数据库
数据库·sql·数据分析
qq_225891746611 小时前
基于Python+Django餐饮评论大数据分析与智能推荐系统 毕业论文
开发语言·后端·python·信息可视化·数据分析·django
龙腾AI白云12 小时前
国内外具身智能VLA模型深度解析(3)
深度学习·数据挖掘
xuehaikj13 小时前
文档类型识别与分类_yolo13-C3k2-SFSConv实现详解
人工智能·数据挖掘
蒋星熠19 小时前
实证分析:数据驱动决策的技术实践指南
大数据·python·数据挖掘·数据分析·需求分析
谅望者1 天前
数据分析笔记14:Python文件操作
大数据·数据库·笔记·python·数据挖掘·数据分析