ad
close
猿课教育
  • 畅销套餐
  • 精选套餐
  • 人气套餐
  • 尊享套餐
  • 高薪套餐
大数据企业级真实案例系列视频专题
互联网常用的大数据指标系列视频课程
1434人学习
¥30.00
Hadoop流量统计案例视频课程
735人学习
¥99.00
Facebook数据查询引擎Presto教程
720人学习
¥108.00
更 多 6 门 课 程
大数据+Python+机器学习实战班
IDEA版Java高级开发知识第1季IDEA+Maven+HashMap原理
686人学习
¥12.00
IDEA版Java高级开发知识第2季数据类型+设计模式+原理剖析
59人学习
¥12.00
IDEA版Java高级开发知识第3季多线程-线程安全性-同步代码块
80人学习
¥12.00
更 多 40 门 课 程
征服Hadoop之实战大数据工程师视频课程套餐
Hadoop(一)入门与环境配置视频课程
3586人学习
¥34.00
Hadoop(二)HDFS使用源码分析
371人学习
¥69.00
Hadoop(三)高级特性压缩串行化视频课程
183人学习
¥51.00
更 多 6 门 课 程
7期专业的大数据实战班(理论+实战)
7期大数据之10天Java高级技术教程(数据类型、IO、连接池、NIO、JVM、Rose、线程池等)
487人学习
¥128.00
7期大数据之图解Hadoop技术教程(入门、原理、MR、Avro、容灾)
184人学习
¥198.00
7期大数据之数据仓库Hive技术教程(含优化)
92人学习
¥128.00
更 多 11 门 课 程
7期专业的大数据实战班(理论+实战)
7期大数据之10天Java高级技术教程(数据类型、IO、连接池、NIO、JVM、Rose、线程池等)
487人学习
¥128.00
7期大数据之图解Hadoop技术教程(入门、原理、MR、Avro、容灾)
184人学习
¥198.00
7期大数据之数据仓库Hive技术教程(含优化)
92人学习
¥128.00
更 多 11 门 课 程
  • 课程介绍
  • 课程大纲

适合人群:

对大数据有所了解,有一定编程基础

你将会学到:

通过本套教程的学习你可以学习presto的使用和操作,胜任企业的开发应用场景。

课程简介:

版本:presto-server-0.214.tar

软件版本

presto-cli-0.214-executable

CentOS7


1、presto的起因

hadoop ---hdfs----MR(java)-----hive

hive底层原理用MR,速度比较慢,公司hadoop集群主要集中于晚上到凌晨,平日工作时间负载不是很高。但在工作时间内,公司业务人员有实时查询的需求,现在主要借助于hive提供业务人员的查询。hive是基于MR类的SQL查询工具,他会输入的查询SQL解析为MapReduce,能极大的降低使用大数据门槛,让一般的业务人员可以直接准对大数据进行查询,但是有一个利弊,它的查询基于MR,会让人等待比较着急,等待的时间可能是几个小时或者一天。 spark基于内存提高改良的hive,sql,现在factbook在hive上面开发一套利器,准对hive可以通过sql语句快速查询,presto。


2、Facebook为何开发Presto

 Facebook的2011的数据仓库存储在少量大型hadoopfs集群,Hive是FaceBook在几年前专门为Hadoop打造的一款数据仓库工具,在以前,facebook的科学家和分析师一直靠hive进行数据分析.但hive使用MR作为底层计算框架,是专为批处理设计的,但是随着数据的不断增多,使用hive进行一个简单的数据查询可能要花费分钟或者几个小时,显然不能满足查询需求,FaceBooke也调研了其他比hive更快的工具,但是他们需要在功能有限的条件下做简单操作,以至于无法操作Facebook庞大的数据要求。
2012年开始研究自己的框架--presto,每日可以超过1pb查询,而且速度比较快,faceBook声称Presto的性能比hive要好上10倍或者100倍,presto和hive都是facebook开发的 


Presto是什么

图片1.png

Presto是一个开源的分布式SQL查询引擎,适用于交互式查询,数据量支持GB到PB字节。

Presto的设计和编写完全是为了解决Facebook这样规模的商业数据仓库交互式分析和处理速度的问题


Presto可以做什么

Presto支持在线数据查询,包括Hive kafka Cassandra关系数据库以及专门数据存储,一条Presto查询可以将多个数据源进行合并,可以跨越整个组织进行分析。

Presto以分析师的需求作为目标,他们期望相应速度小于1秒到几分钟,Presto要么在使用速度的快的昂贵的商业方案,提高内存,要么是消耗大量的硬件进行快速查询。(128G 64G)


架构图

图片2.png

图片3.png

本套课程教给如何在企业环境中使用Presto技术。







展开更多
close
  • 课程介绍
  • 课程大纲
在线
客服
APP
下载

下载Android客户端

下载iphone 客户端

官方
微信

关注官方微信

返回
顶部