比自建 Hadoop 还便宜!云栖大会揭秘阿里云数加 MaxCompute

2017 年 9 月 21 日 开源中国


DT时代,越来越多的企业应用数据步入云端。 Hadoop是当下流行的大数据并行计算体系,横向扩展、生态圈成熟等一直是它的主要特点。

阿里云数加MaxCompute (原名ODPS)是一种快速、完全托管的TB/PB级数据仓库解决方案。与传统 Hadoop 相比,MaxCompute 向用户提供了完善的数据导入方案以及多种经典的分布式计算模型,能够更快速的解决用户海量数据计算问题,有效降低企业成本,并保障数据安全。

国内做大数据,基本就这两个选择:自建Hadoop或者使用阿里云的MaxCompute。像Amazon、Google、微软的大数据服务在国内基本处于不可用或者很难用的状态。我们就来对比一下这两个主流的技术选型:

以企业拥有10TB数据为例,自建hadoop集群,则至少需要6台机器(3nodes+2NameNode+1jobtracker),成本在20万左右。除此之外,还需要投入机房资源,网络设备和运维成本。这其中主要是运维成本,要知道一个运维人员的成本一年至少15万。这样,整体算下来要55万左右。

如果采用阿里云的MaxCompute,按照现在的报价,大约需要32160(存储费用)+45000(计算费用)=77160元。也就是说二者的成本差距在7倍以上。

按照Hortonworks首席技术官EricBaldeschwieler关于成本的陈述,就更为夸张:硬件成本只占Hadoop数据中心总成本的20%。

如此明显的优势,相信开发者的选择已经了然于胸。想了解 MaxCompute 目前情况和未来规划、MaxCompute如何对生态赋能、MaxCompute与自建Hadoop成本效能分析、MaxCompute与开源生态连接工具讲解和MaxCompute编译器与开发环境等方面的技术问题,就来云栖大会吧~10 月 14 日阿里云大数据计算服务MaxCompute 阿里云大数据计算服务专场将有众多阿里云大数据资深技术专家为你一一解答以上问题。

这一届云栖大会的主题是“飞天·智能”,会有3场主论坛、22场前沿峰会,同时有100余场分论坛、400余家科技企业展,围绕云计算、大数据、人工智能、智能硬件、VR、AR、芯片技术、数据库、loT、操作系统、生物识别、天文科研、金融科技、量子计算等前沿领域进行讨论与展出。

开源中国一直致力于为一线开发者提供最热门的技术干货,因此本次云栖大会我们给用户带来了盛大优惠,9月20日起购票活动再升级!返现 100 元基础上每天再抽 10 张门票免费送!赶紧点击“阅读原文”订购2017云栖大会门票吧!



推荐阅读

这些优秀的主流代码编辑器,你用过多少款?

可能是国内最火的开源项目 —— Python 篇

JDK 9 中一些需要提防的坑

CSDN CODE 项目整体迁移到码云平台的公告

点击“阅读原文”查看更多精彩内容

登录查看更多
0

相关内容

Hadoop 是 Apache 软件基金会所研发的开放源码并行运算编程工具和分布式档案系统,与 MapReduce 和 Google 档案系统的概念类似。
商业数据分析,39页ppt
专知会员服务
158+阅读 · 2020年6月2日
华为发布《自动驾驶网络解决方案白皮书》
专知会员服务
122+阅读 · 2020年5月22日
Python数据分析:过去、现在和未来,52页ppt
专知会员服务
99+阅读 · 2020年3月9日
【2020新书】Kafka实战:Kafka in Action,209页pdf
专知会员服务
65+阅读 · 2020年3月9日
【大数据白皮书 2019】中国信息通信研究院
专知会员服务
133+阅读 · 2019年12月12日
【干货】大数据入门指南:Hadoop、Hive、Spark、 Storm等
专知会员服务
94+阅读 · 2019年12月4日
阿里云发布机器学习平台PAI v3.0
雷锋网
12+阅读 · 2019年3月22日
重新体验NoSQL | 飞雪连天射白鹿 大数狂舞倚灵动(Lindorm)
阿里巴巴数据库技术
11+阅读 · 2018年12月25日
蚂蚁金服微服务实践(附演讲PPT)
开源中国
17+阅读 · 2018年12月21日
干货 | 双11总峰值超8亿OPS 阿里分布式NoSQL如何岿然不动稳如山?
阿里巴巴数据库技术
10+阅读 · 2018年12月12日
爱奇艺路演PPT曝光:下周在纳斯达克上市
腾讯科技
3+阅读 · 2018年3月19日
一篇文章读懂阿里企业级数据库最佳实践
阿里巴巴数据库技术
5+阅读 · 2017年12月20日
【AI说】揭秘京东实时数据仓库背后的神秘力量—JDQ
Real-time Scalable Dense Surfel Mapping
Arxiv
5+阅读 · 2019年9月10日
Arxiv
3+阅读 · 2018年8月17日
Arxiv
13+阅读 · 2018年4月18日
Arxiv
6+阅读 · 2018年2月7日
Arxiv
8+阅读 · 2018年1月12日
VIP会员
相关资讯
阿里云发布机器学习平台PAI v3.0
雷锋网
12+阅读 · 2019年3月22日
重新体验NoSQL | 飞雪连天射白鹿 大数狂舞倚灵动(Lindorm)
阿里巴巴数据库技术
11+阅读 · 2018年12月25日
蚂蚁金服微服务实践(附演讲PPT)
开源中国
17+阅读 · 2018年12月21日
干货 | 双11总峰值超8亿OPS 阿里分布式NoSQL如何岿然不动稳如山?
阿里巴巴数据库技术
10+阅读 · 2018年12月12日
爱奇艺路演PPT曝光:下周在纳斯达克上市
腾讯科技
3+阅读 · 2018年3月19日
一篇文章读懂阿里企业级数据库最佳实践
阿里巴巴数据库技术
5+阅读 · 2017年12月20日
【AI说】揭秘京东实时数据仓库背后的神秘力量—JDQ
Top
微信扫码咨询专知VIP会员