讲师公开课内训文章


首页>公开课程 > 大数据课程 [返回PC端]

暑期大数据“ Hadoop应用与开发高级工程师” 实战培训班

讲师:讲师团天数:5天费用:元/人关注:2620

日程安排:

课程大纲:

模块一大数据介绍带来的机遇和挑战
1)大数据概念的发展与解析
2)大数据在国内外发展现状
3)大数据在互联网发展现状
4)大数据四个特点分析
大数据带来的机遇和挑战
1)大数据能带来什么、引领社会进入“大数据时代”
2)大数据对国家、社会的作用、大数据将推动经济发展
3)大数据将推动科技发展进程、开启商业智能新阶段
4)数据分析的发展——从数据到知识大数据如何让商业更智能、大数据应用案例
5)带来数据处理新变革、大数据的关键技术
6)大数据与云计算、大数据技术的发展趋势精彩案例
电信手机上网日志分析
移动GPRS上网日志查询系统
某省份联通网络不良信息检测系统
国土资源部门下属单位非结构离线网格分析平台
某银行海量数据统一分析平台
某电信用户属性精分系统
某银行实时计算平台
某电力电台电视节目推荐系统

模块二Hadoop在云计算技术的作用和地位传统大规模系统存在的问题
Hadoop概述
Hadoop分布式文件系统
MapRedce工作原理
Hadoop集群剖析
Hadoop生态系统对一种新的解决方案的需求
Hadoop的行业应用案例分析
Hadoop在云计算和大数据的位置和关系数据开放,数据云服务平台(DAAS)时代
Hadoop平台在数据云平台(DAAS)上的天然优势。
数据云平台(DAAS平台)组成部分
互联网公共数据大云(DAAS)案例
Hadoop构建构建游戏云(WebGameDaas)平台

模块三Hadoop生态系统介绍和演示HadoopHDFS和MapRedce
Hadoop数据库之Hbase
Hadoop数据仓库之Hive
Hadoop数据处理脚本Pig
Hadoop数据接口Sqoop和Flme,ScribeDataX
Hadoop工作流引擎Oozie运用Hadoop自下而上构建大规模企业数据仓库
暴风影音数据仓库实战解析

模块四Hadoop组件详解HadoopHDFS基本结构
HadoopHDFS副本存放策略
HadoopNameNode详解
HadoopSecondaryNameNode详解
HadoopDataNode详解
HadoopJobTracker详解
HadoopTaskTracker详解HadoopMapper类核心代码
HadoopRedce类核心代码
Hadoop核心代码

模块五Hadoop安装和部署Hadoop系统模块组件概述
Hadoop试验集群的部署结构
Hadoop安装依赖关系
Hadoop生产环境的部署结构
Hadoop集群部署
Hadoop高可用配置方法
Hadoop集群简单测试方法
Hadoop集群异常Debg方法Hadoop安装部署实验
RedhatLinx基础环境搭建
Hadoop单机系统版本安装配置
Hadoop集群系统版本安装和启动配置
使用HadoopMapRedceStreaming快速测试系统
Hadoopcore-site,hdfs-site,mapred-site配置详解

模块六Hadoop集群规划Hadoop集群内存要求
Hadoop集群磁盘分区
集群和网络拓扑要求
集群软件的端口配置针对NameNodeJobtrackerDataNodeTaskTrackerHiveserver等不同组件需求推荐服务器配置

模块七MapRedce算法原理HadoopMapRedce算法的原理和优化思想
灵活运用MapRedce实现算法运用MapRedce构建数据库算法
SelectSortGrogBySmCont
Join新进流失算法
使用Y-Smart快速转换SQL为MapRedce代码

模块八编写MapRedce高级程序使用HadoopMapRedceStreaming编程
MapRedce流程
剖析一个MapRedce程序
基本MapRedceAPI概念
驱动代码Mapper、Redcer
Hadoop流
API使用Eclipse进行快速开发
新MapRedceAPI
MapRedce的优化
MapRedce的任务调度
MapRedce编程实战
如何利用其他Hadoop相关技术,包括ApacheHive,ApachePig,Sqoop和Oozie等
满足解决实际数据分析问题的高级HadoopAPIHadoopStreaming和JavaMapRedceApi差异。
MapRedce实现数据库功能
利用Combiners来减少中间数据
编写Partitioner来优化负载平衡
直接访问Hadoop分布式文件系统(HDFS)
Hadoop的join操作
辅助排序在Redcer方的合并
定制Writables和WritableComparables
使用SeqenceFiles和Avro文件保存二进制数据
创建InptFormatsOtptFormats
Hadoop的二次排序
Hadoop的海量日志分析
在Map方的合并

模块九集成Hadoop到现有工作流
及HadoopAPI深入探讨存储系统
利用Sqoop从关系型数据库系统中导入数据到Hadoop
利用Flme导入实时数据到Hadoop
ToolRnner介绍、使用MRnit进行测试
使用Configre和Close方法来进行Map/Redce设置和关闭使用FseDFS和Hadoop访问HDFS
使用分布式缓存(DistribtedCache)
直接访问Hadoop分布式文件系统(HDFS)
利用Combiners来减少中间数据
编写Partitioner来优化负载平衡

模块十使用Hive和Pig开发及技巧Hive和Pig基础
Hive的作用和原理说明
Hadoop仓库和传统数据仓库的协作关系
Hadoop/Hive仓库数据数据流
Hive部署和安装
HiveCli的基本用法
HQL基本语法
运用Pig过滤用户数据使用JDBC连接Hive进行查询和分析
使用正则表达式加载数据
HQL高级语法
编写DF函数
编写DAF自定义函数
基于Hive脚本内嵌Streaming编程

模块十一Hbase安装和使用Hbase安装部署
Hbase原理和结构
Hbase运维和管理使用Hbase+Hive提供OLAPSQL查询能力
使用Hbase+Phoenix提供OLTPSQL能力
基于Hbase的时间序列数据库OpenTsDb结构解析

模块十二Hadoop2.0集群探索Hadoop2.0HDFS原理
Hadoop2.0Yarn原理
Hadoop2.0生态系统基于Hadoop2.0构建分布式系统

模块十三Hadoop企业级别案例解析Hadoop结构化数据案例
Hadoop非结构化案例
Hbase数据库案例
Hadoop视频分析案例利用大数据分析改进交通管理
区域医疗大数据应用案例
银联大数据数据票据详单平台
某银行大数据Spark应用案例详解
某证券公司大数据案例介绍
广东移动省公司请账单系统
上海电信网络优化
某通信运营商全国用户上网记录
浙江台州市智能交通系统
移动广州详单实时查询系统
跨区域实时视频监控系统
电信大数据案例介绍:
基于社交网络的*营销和客户维系
基于信令分析用户的移动轨迹
基站规划和动态优化
智慧城市交通
流量分析
上海联通大数据开放变现的实现案例介绍

模块十四RedHadoop企业版本运用RedHadoop快速构建服务集群
运用RedHadoopDW构建数据仓库基于RedHadoopHive构建数据仓库平台
灵活运用Hive加速游戏数据仓库
基于Pig+OpenCV大规模图像人脸识别

模块十五Spark原理和入门Spark原理;Spark的架构图;Spark运行模式介绍
—local;—standalone;—messos;—yarn;Spark的RDD
什么是RDD;RDD的种类;—Tranformation;—Action
Spark的存储级别;Cache介绍;Spark的容错原理
Lineage容错;Checkpoint容错;RDD的创建
案例—统计单词的个数

模块十六互联网大数据应用案例根阿里的ODPS大数据平台架构介绍
阿里的实时推荐架构
阿里的交叉营销系统
阿里支付宝交易监控系统
支付宝微贷案例分析(互联网征信系统)
京东打白条系统分析
百度预测大数据平台案例分析

大数据培训:Hadoop应用与开发高级工程师

上一篇: 全国高校大数据“ Hadoop应用与开发” 实战培
下一篇: “机房建设与管理”高级培训班


其他相关公开课程:


联系电话:4000504030
24小时热线(微信):
13262638878(华东)
18311088860(华北)
13380305545(华南)
15821558037(华西)
服务投诉:13357915191

 
线上课程关注公众号