幫助中心 | 我的帳號 | 關於我們

Hadoop大數據開發基礎(大數據人才培養規劃教材)

  • 作者:編者:餘明輝//張良均
  • 出版社:人民郵電
  • ISBN:9787115370662
  • 出版日期:2018/02/01
  • 裝幀:平裝
  • 頁數:188
人民幣:RMB 39.8 元      售價:
放入購物車
加入收藏夾

內容大鋼
    餘明輝、張良均主編的《Hadoop大數據開發基礎(大數據人才培養規劃教材)》以任務為導向,較為全面地介紹了Hadoop大數據技術的相關知識。全書共6章,具體內容包括Hadoop介紹、Hadoop集群的搭建及配置、Hadoop基礎操作、MapReduce編程入門、MapReduce進階編程、項目案例:電影網站用戶性別預測。本書的2?5章包含了實訓與課後練習,通過練習和操作實踐,幫助讀者鞏固所學的內容。
    本書可以作為高校大數據技術類專業的教材,也可作為大數據技術愛好者的自學用書。

作者介紹
編者:餘明輝//張良均

目錄
第1章  Hadoop介紹
  1.1  Hadoop概述
    1.1.1  Hadoop簡介
    1.1.2  Hadoop的發展歷史
    1.1.3  Hadoop的特點
  1.2  Hadoop核心
    1.2.1  分散式文件系統——HDFS
    1.2.2  分散式計算框架——MapReduce
    1.2.3  集群資源管理器——YARN
  1.3  Hadoop生態系統
  1.4  Hadoop應用場景
  小結
第2章  Hadoop集群的搭建及配置
  任務2.1  安裝及配置虛擬機
    2.1.1  創建Linux虛擬機
    2.1.2  設置固定IP
    2.1.3  遠程連接虛擬機
    2.1.4  虛擬機在線安裝軟體
    2.1.5  任務實現
  任務2.2  安裝Java
    2.2.1  在Windows下安裝Java
    2.2.2  在Linux下安裝Java
    2.2.3  任務實現
  任務2.3  搭建Hadoop完全分散式集群
    2.3.1  修改配置文件
    2.3.2  克隆虛擬機
    2.3.3  配置SSH免密碼登錄
    2.3.4  配置時間同步服務
    2.3.5  啟動關閉集群
    2.3.6  監控集群
  小結
  實訓
    實訓1  為Hadoop集群增加一個節點
    實訓2  編寫Shell腳本同步集群時間
  課後練習
第3章  Hadoop基礎操作
  任務3.1  查看Hadoop集群的基本信息
    3.1.1  查詢集群的存儲系統信息
    3.1.2  查詢集群的計算資源信息
  任務3.2  上傳文件到HDFS目錄
    3.2.1  了解HDFS文件系統
    3.2.2  掌握HDFS的基本操作
    3.2.3  任務實現
  任務3.3  運行MapReduce任務
    3.3.1  了解Hadoop官方的示常式序包
    3.3.2  提交MapReduce任務給集群運行
  任務3.4  管理多個MapReduce任務
    3.4.1  查詢MapReduce任務
    3.4.2  中斷MapReduce任務
  小結

  實訓
    實訓1  統計文件中所有單詞的平均長度
    實訓2  查詢與中斷MapReduce任務
  課後練習
第4章  MapReduce編程入門
  任務4.1  使用Eclipse創建MapReduce工程
    4.1.1  下載與安裝Eclipse
    4.1.2  配置MapReduce環境
    4.1.3  新建MapReduce工程
  任務4.2  通過源碼初識MapReduce編程
    4.2.1  通俗理解MapReduce原理
    4.2.2  了解MR實現詞頻統計的執行流程
    4.2.3  讀懂官方提供的WordCount源碼
  任務4.3  編程實現按日期統計訪問次數
    4.3.1  分析思路與處理邏輯
    4.3.2  編寫核心模塊代碼
    4.3.3  任務實現
  任務4.4  編程實現按訪問次數排序
    4.4.1  分析思路與處理邏輯
    4.4.2  編寫核心模塊代碼
    4.4.3  任務實現
  小結
  實訓
    實訓1  獲取成績表的高分記錄
    實訓2  對兩個文件中的數據進行合併與去重
  課後練習
第5章  MapReduce進階編程
  任務5.1  篩選日誌文件並生成序列化文件
    5.1.1  MapReduce輸入格式
    5.1.2  MapReduce輸出格式
    5.1.3  任務實現
  任務5.2  Hadoop Java API讀取序列化日誌文件
    5.2.1  FileSystem API管理文件夾
    5.2.2  FileSystem API操作文件
    5.2.3  FileSystem API讀寫數據
    5.2.4  任務實現
  任務5.3  優化日誌文件統計程序
    5.3.1  自定義鍵值類型
    5.3.2  初步探索Combiner
    5.3.3  淺析Partitioner
    5.3.4  自定義計數器
    5.3.5  任務實現
  任務5.4  Eclipse提交日誌文件統計程序
    5.4.1  傳遞參數
    5.4.2  Hadoop輔助類ToolRunner
    5.4.3  Eclipse自動打包並提交任務
  小結
  實訓
    實訓1  統計全球每年的高氣溫和低氣溫
    實訓2  篩選氣溫在15?25℃之間的數據

  課後練習
第6章  項目案例:電影網站用戶性別預測
  任務6.1  認識KNN演算法
    6.1.1  KNN演算法簡介
    6.1.2  KNN演算法原理及流程
  任務6.2  數據預處理
    6.2.1  獲取數據
    6.2.2  數據變換
    6.2.3  數據清洗
    6.2.4  劃分數據集
  任務6.3  實現用戶性別分類
    6.3.1  實現思路
    6.3.2  代碼實現
  任務6.4  評價分類結果的準確性
    6.4.1  評價思路
    6.4.2  實現分類評價
    6.4.3  尋找優K值
  小結
參考文獻

  • 商品搜索:
  • | 高級搜索
首頁新手上路客服中心關於我們聯絡我們Top↑
Copyrightc 1999~2008 美商天龍國際圖書股份有限公司 臺灣分公司. All rights reserved.
營業地址:臺北市中正區重慶南路一段103號1F 105號1F-2F
讀者服務部電話:02-2381-2033 02-2381-1863 時間:週一-週五 10:00-17:00
 服務信箱:bookuu@69book.com 客戶、意見信箱:cs@69book.com
ICP證:浙B2-20060032