本書講述在流行的大數據分布式存儲和計算平臺Hadoop上設計實現數據倉庫,將傳統(tǒng)數據倉庫建模與SQL開發(fā)的簡單性與大數據技術相結合,快速、高效地建立可擴展的數據倉庫及其應用系統(tǒng)?!”緯鴥热莅〝祿}庫、Hadoop及其生態(tài)圈的相關概念,使用Sqoop從關系數據庫全量或增量抽取數據,使用HIVE進行數據轉換和裝載處理,使用Oozie調度作業(yè)周期性執(zhí)行,使用Impala進行快速聯機數據分析,使用Hue將數據可視化,以及數據倉庫中的漸變維(SCD)、代理鍵、角色扮演維度、層次維度、退化維度、無事實的事實表、遲到的事實、累積的度量等常見問題在Hadoop上的處理等?!”緯m合數據庫管理員、大數據技術人員、Hadoop技術人員、數據倉庫技術人員,也適合高等院校和培訓機構相關專業(yè)的師生教學參考。