7.1 wordCount.java介紹 http://hadoop.apache.org/docs/current/hadoop-mapreduce-client/hadoop-mapreduce-client-core/MapReduceTutorial.html ...
Read More
Home / 本書指令整理
第6章. Hadoop HDFS命令介紹
6.1 啟動Hadoop Multi-Node Cluster start-all.sh 6.2 建立與查看HDFS目錄 Step1 建立HDFS目錄 hadoop fs -mkdir /user hadoop fs -mkdir /user/hduser hado...
Read More
第19章 使用Apache Zeppelin資料視覺化指令整理
Zeppelin由NFLAB開發提供了web介面,類似ipython的notebook,可做為資料分析與資料視覺化,支援Apache Spark Scala, Apache Spark Python, SparkSQL, Hive, Markdown and Shell。Ze...
Read More
第9章. Spark RDD介紹與範例指令
Spark 的核心是 RDD ( Resilient Distributed Dataset )彈性分散式資料集,是由 AMPLab 實驗室所提出的概念,屬於一種分散式的記憶體。 Spark 主要優勢是來自 RDD 本身的特性。 RDD 能與其他系統相容,可以匯入外部儲存系統的...
Read More
第8章 Apache Spark 安裝指令
8.1 安裝scala Step1~4 下載安裝 Scala wget http://www.scala-lang.org/files/archive/scala-2.11.6.tgz tar xvf scala-2.11.6.tgz sudo mv scala-2.1...
Read More
第5章 Hadoop 2.6 Multi Node Cluster安裝指令
Hadoop Multi Node Cluster規劃如下圖, 由多台電腦組成: 有一台主要的電腦master,在HDFS擔任NameNode角色,在MapReduce2(YARN)擔任ResourceManager角色 有多台的電腦data1、data2、data3...
Read More
訂閱:
文章
(
Atom
)