课程首页大数据大数据 Facebook数据查询引擎Presto教程（含配套资料）

Facebook数据查询引擎Presto教程（含配套资料）

无限期视频有效期

36节节数

1100人学习人数

4.5分

课程评分

免费试看

Facebook数据查询引擎Presto教程（含配套资料）

版本：presto-server-0.214.tar 软件版本 presto-cli-0.214-executable CentOS7 1、presto的起因 hadoop ---hdfs----MR（java）-----hive hive底层原理用MR，速度比较慢，公司hadoop集群主要集中于晚上到凌晨，平日工作时间负载不是很高。但在工作时间内，公司业务人员有实时查询的需求，现在主要借助于hive提供业务人员的查询。hive是基于MR类的SQL查询工具，他会输入的查询SQL解析为MapReduce，能极大的降低使用大数据门槛，让一般的业务人员可以直接准对大数据进行查询，但是有一个利弊，它的查询基于MR，会让人等待比较着急，等待的时间可能是几个小时或者一天。 spark基于内存提高改良的hive，sql，现在factbook在hive上面开发一套利器，准对hive可以通过sql语句快速查询，presto。 2、Facebook为何开发Presto Facebook的2011的数据仓库存储在少量大型hadoopfs集群，Hive是FaceBook在几年前专门为Hadoop打造的一款数据仓库工具，在以前，facebook的科学家和分析师一直靠hive进行数据分析.但hive使用MR作为底层计算框架，是专为批处理设计的，但是随着数据的不断增多，使用hive进行一个简单的数据查询可能要花费分钟或者几个小时，显然不能满足查询需求，FaceBooke也调研了其他比hive更快的工具，但是他们需要在功能有限的条件下做简单操作，以至于无法操作Facebook庞大的数据要求。 2012年开始研究自己的框架--presto，每日可以超过1pb查询，而且速度比较快，faceBook声称Presto的性能比hive要好上10倍或者100倍，presto和hive都是facebook开发的 Presto是一个开源的分布式SQL查询引擎，适用于交互式查询，数据量支持GB到PB字节。 Presto的设计和编写完全是为了解决Facebook这样规模的商业数据仓库交互式分析和处理速度的问题 Presto可以做什么 Presto支持在线数据查询，包括Hive kafka Cassandra关系数据库以及专门数据存储，一条Presto查询可以将多个数据源进行合并，可以跨越整个组织进行分析。 Presto以分析师的需求作为目标，他们期望相应速度小于1秒到几分钟，Presto要么在使用速度的快的昂贵的商业方案，提高内存，要么是消耗大量的硬件进行快速查询。（128G 64G）本套课程教给如何在企业环境中使用Presto技术。

复制链接

IT 节气

张长志

lv: 钻石讲师

升级再获取10231荣耀值升级成荣耀讲师

当前荣耀值： 9770 20001

268 课程数量

208741 学生人数

CTO/CIO/技术副总裁/总工程师

张长志技术全才、擅长领域：区块链、大数据、Java等。10余年软件研发及企业培训经验，曾为多家大型企业提供企业内训如中石化，中国联通，中国移动等知名企业。拥有丰富的企业应用软件开发经验、深厚的软件架构设计理论基础及实践能力。项目开发历程：基于大数据技术推荐系统，医疗保险大数据分析与统计推断，H5跨平台APP，携程酒店APP，Go语言实现Storm和ZK类似框架。

课程介绍
课程目录
讨论留言

你将收获

1.掌握presto的使用和操作，胜任企业的开发应用场景

2.掌握Presto技术在企业中如何使用

适用人群

适合有大数据基础的学员

课程介绍

版本：presto-server-0.214.tar

软件版本

presto-cli-0.214-executable

CentOS7

1、presto的起因

hadoop ---hdfs----MR（java）-----hive

hive底层原理用MR，速度比较慢，公司hadoop集群主要集中于晚上到凌晨，平日工作时间负载不是很高。但在工作时间内，公司业务人员有实时查询的需求，现在主要借助于hive提供业务人员的查询。hive是基于MR类的SQL查询工具，他会输入的查询SQL解析为MapReduce，能极大的降低使用大数据门槛，让一般的业务人员可以直接准对大数据进行查询，但是有一个利弊，它的查询基于MR，会让人等待比较着急，等待的时间可能是几个小时或者一天。 spark基于内存提高改良的hive，sql，现在factbook在hive上面开发一套利器，准对hive可以通过sql语句快速查询，presto。

2、Facebook为何开发Presto

Facebook的2011的数据仓库存储在少量大型hadoopfs集群，Hive是FaceBook在几年前专门为Hadoop打造的一款数据仓库工具，在以前，facebook的科学家和分析师一直靠hive进行数据分析.但hive使用MR作为底层计算框架，是专为批处理设计的，但是随着数据的不断增多，使用hive进行一个简单的数据查询可能要花费分钟或者几个小时，显然不能满足查询需求，FaceBooke也调研了其他比hive更快的工具，但是他们需要在功能有限的条件下做简单操作，以至于无法操作Facebook庞大的数据要求。
2012年开始研究自己的框架--presto，每日可以超过1pb查询，而且速度比较快，faceBook声称Presto的性能比hive要好上10倍或者100倍，presto和hive都是facebook开发的

Presto是一个开源的分布式SQL查询引擎，适用于交互式查询，数据量支持GB到PB字节。

Presto的设计和编写完全是为了解决Facebook这样规模的商业数据仓库交互式分析和处理速度的问题

Presto可以做什么

Presto支持在线数据查询，包括Hive kafka Cassandra关系数据库以及专门数据存储，一条Presto查询可以将多个数据源进行合并，可以跨越整个组织进行分析。

Presto以分析师的需求作为目标，他们期望相应速度小于1秒到几分钟，Presto要么在使用速度的快的昂贵的商业方案，提高内存，要么是消耗大量的硬件进行快速查询。（128G 64G）

本套课程教给如何在企业环境中使用Presto技术。

课程目录