搭建Hive的远程模式
本系列课程将基于RedHat Linux 7.4版本、Hadoop 2.7.3、Spark 2 版本多面介绍大数据的整体内容,让学员深入理解并学习运行机制和原理,从而进一步学习大数据的相关内容。
课程说明
==========================================================================
Hive 是一个基于 hadoop 的开源数据仓库工具,用于存储和处理海量结构化数据。 它把海量数据存储于 hadoop 文件系统,而不是数据库,但提供了一套类数据库的数据存储和处理机制,并采用 HQL (类 SQL )语言对这些数据进行自动化管理和处理。我们可以把 Hive 中海量结构化数据看成一个个的表,而实际上这些数据是分布式存储在 HDFS 中的。 Hive 经过对语句进行解析和转换,最终生成一系列基于 hadoop 的 map/reduce 任务,通过执行这些任务完成数据处理。
Hive 诞生于 facebook 的日志分析需求,面对海量的结构化数据, Hive 以较低的成本完成了以往需要大规模数据库才能完成的任务,并且学习门槛相对较低,应用开发灵活而高效。
赵渝强老师博客地址:http://collen7788.blog.51cto.com/
赵渝强老师:大数据系列视频课程
==========================================================================
1、Hadoop大数据学习高级应用系列套餐
https://edu.51cto.com/topic/1155.html
2、Spark 2系列课程视频套餐
https://edu.51cto.com/topic/1258.html
3、大数据消息(Kafka)与实时处理(Storm)系统系列套餐
https://edu.51cto.com/topic/1003.html
4、NoSQL 数据库实战系列视频课程专题(上)
https://edu.51cto.com/topic/955.html
5、NoSQL 数据库实战系列视频课程专题(下)
即将发布
本门课程课程大纲
==========================================================================
(*)数据分析引擎和Hive简介
(*)Hive的体系结构
(*)搭建Hive的嵌入模式
(*)搭建Hive的远程模式
(*)Hive的内部表
(*)Hive的分区表
(*)Hive的外部表
(*)Hive的桶表和视图
(*)Hive的查询
(*)Hive的Java客户端
(*)Hive的自定义函数
公开笔记对他人可见,有机会被管理员评为“优质笔记”
{{ noteEditor.content.length }}/2000
讲师收到你的提问会尽快为你解答。若选择公开提问,可以获得更多学员的帮助。
课程大纲