Spark大数据学渣到学神高薪课程【2018年Python版PySpark最新版】

7人 购买 好评度 - 收藏
  • Spark大数据高薪
更多班级

Spark大数据高薪

支持随到随学,23年08月过期

¥399.00

本班因教学质量问题暂时不能报名。 查看详情

课程因违反平台规定暂时不能报名。

立即购买

课程概述

课程目录

学员评论

老师介绍

张敏

张敏

在Spark内核方面有深入的研究,参与Scala基础入门,Spark内核及性能优化相关书籍部分内容的编写工作。 目前在物联网公司参加公司大数据平台建设及数据挖掘工作,在大数据领域有着丰富的实战经验。
简  介 本课程主要讲解Spark技术,借助Spark对外提供的Python接口,使用Python语言开发。涉及到Spark内核原理、Spark基础知识及应用、Spark基于DataFrame的Sql应用、机器学习及深度学习等内容。由浅到深的带大家深入学习大数据领域最火的项目Spark。帮助大家进入大数据领域,抓住大数据浪潮的尾巴。
        本课程学习环境基于Docker容器搭建,通过学习Docker容器技术,让学员不仅可以掌握云计算最火的一门技术Docker,还能让学员使用Docker搭建Spark、Hadoop、Hive集群,一键启动集群,玩转大数据,降低学员学习门槛和成本,快速入门大数据,冲击高薪! 
        自2013年开始出现的大数据概念及伴随出现的以Hadoop,Spark为代表的分布式大数据处理技术,大数据一词让人耳熟能详。大部分框架使用类Java语言实现,对于Python学员,PySpark是使用Python作为开发语言的程序员的福音,借助PySpark,Python开发人员可以轻松胜任大数据任务,冲击高薪。本课程主要讲解Spark技术,借助Spark对外提供的Python接口,使用Python语言开发。涉及到Spark内核原理、Spark基础知识及应用、Spark基于DataFrame的Sql应用、机器学习及深度学习等内容。由浅到深的带大家深入学习大数据领域最火的项目Spark。帮助大家进入大数据领域,抓住大数据浪潮的尾巴。

    软件版本:     

  • Hadoop2.7.3

  • Spark2.3.0

  • Scala2.11.8

  • Python2.7.12

  • Jdk-8u101-linux-x64

  • Docker 1.12.6

  • Apache-hive-2.3.2-bin

  • Mysql-5.5.45-linux2.6-x86_64

  • Mysql-connector-java-5.1.37-bin

   内容涉及:   

  • pyspark 基础模块

  • pyspark.sql 模块

  • pyspark.ml 基于DataFrame的机器学习模块

  • pyspark.mllib package 基于RDD的机器学习模块

  • 中间还会涉及到云计算中的docker容器技术,课程的学习环境就是使用Docker三个容器搭建的分布式环境

  • pyspark中Numpy、Pandas、Scikit-learn的互操作和相互对比

* 课程提供者:张敏

老师还为你推荐了以下几门课程