亚洲中文精品a∨在线,国产在线精品在线精品,国产亚洲欧美一区,欧美肉肉丝视频一区二区


學校介紹

曼頓培訓網(wǎng)(www.mdpxb.com),是北京曼頓企業(yè)管理咨詢有限公司(以下簡稱北京曼頓咨詢)旗下網(wǎng)站。是總部位于美國的國際職業(yè)認證標準聯(lián)合會在北京地區(qū)授權的培訓考試及認證單位[認證號:IOCL086132],同時也是 香港培訓認證中心授權的培訓認證機構[認證號:HKTCC(GZ)A1.. 招生資質(zhì): 已認證
學校優(yōu)勢: 企業(yè)內(nèi)訓方面/公開課方面
咨詢電話: 13810210257
分享到:
大數(shù)據(jù)挖掘和分析技術實戰(zhàn)-MahoutMLlibStormDocker培訓(北京,11月14-16日)
2018/9/7 9:42:23 來源:北京曼頓企業(yè)管理咨詢有限公司 [加入收藏]

大數(shù)據(jù)挖掘和分析技術實戰(zhàn)-MahoutMLlibStormDocker培訓(北京,11月14-16日)
【舉辦單位】北京曼頓培訓網(wǎng) www.mdpxb.com 中國培訓資訊網(wǎng) www.e71edu.com
【咨詢電話】4006820825 010-56133998 13810210257
【培訓日期】2018年11月14-16日
【培訓地點】北京
【培訓對象】
1,系統(tǒng)架構師、系統(tǒng)分析師、高級程序員、資深開發(fā)人員。
2,牽涉到大數(shù)據(jù)處理的數(shù)據(jù)中心運行、規(guī)劃、設計負責人。
3,政府機關,金融保險、移動和互聯(lián)網(wǎng)等大數(shù)據(jù)來源單位的負責人。
4,高校、科研院所牽涉到大數(shù)據(jù)與分布式數(shù)據(jù)處理的項目負責人。
5,對大數(shù)據(jù)的前沿技術非常感興趣的人。
6,有志于成為一名數(shù)據(jù)科學家的從業(yè)人員。
7,有一定算法和編程基礎的技術愛好者。

【課程背景】
隨著互聯(lián)網(wǎng)、移動互聯(lián)網(wǎng)和物聯(lián)網(wǎng)的發(fā)展,我們已經(jīng)切實地迎來了一個大數(shù)據(jù)的時代。大數(shù)據(jù)是指無法在一定時間內(nèi)用常規(guī)軟件工具對其內(nèi)容進行抓取、管理和處理的數(shù)據(jù)集合,對大數(shù)據(jù)的分析已經(jīng)成為一個非常重要且緊迫的需求。
本課程從大數(shù)據(jù)挖掘分析技術實戰(zhàn)的角度,結合理論和實踐,全方位地介紹基于Yarn的Mahout和基于Spark的MLlib等大數(shù)據(jù)挖掘工具的開發(fā)技巧。涉及的主題包括:大數(shù)據(jù)挖掘及其背景,Mahout和 MLlib大數(shù)據(jù)挖掘工具,推薦系統(tǒng)及電影推薦案例,分類技術及聚類分析,以及與流挖掘和Docker技術的結合,分析了大數(shù)據(jù)挖掘前景。
培訓過程中提供了案例分析來幫助學員了解如何用Mahout和 MLlib挖掘工具來解決具體的問題,并介紹了從大數(shù)據(jù)中挖掘出有價值的信息的關鍵。
本課程是針對問題討論Mahout和 MLlib解決方案的深入課程。教師對于上述領域有深入的理論研究與實踐經(jīng)驗,在課程中將會針對這些問題與學員一起進行探討,在關鍵點上搭建實驗環(huán)境進行實踐研究,以加深對于這些解決方案的理解。通過本課程學習,希望推動大數(shù)據(jù)分析挖掘項目開發(fā)上升到一個新水平。

【學員基礎】
1,對IT系統(tǒng)設計有一定的理論與實踐經(jīng)驗。
2,數(shù)據(jù)倉庫與數(shù)據(jù)挖掘處理有一定的基礎知識。
3,對HadoopYarnSpark大數(shù)據(jù)技術有一定的了解。

【培訓目標】
1, 全面了解大數(shù)據(jù)處理技術的相關知識。
2,學習HadoopYarnSpark的核心數(shù)據(jù)分析技術
3,深入學習MahoutMLlib挖掘工具在大數(shù)據(jù)中的使用。
4,掌握Storm流處理技術和Docker等技術與大數(shù)據(jù)挖掘結合的方法。

【課程大綱】
第一講 大數(shù)據(jù)挖掘及其背景
1)大數(shù)據(jù)環(huán)境下的數(shù)據(jù)分析
2)數(shù)據(jù)挖掘定義
3)Hadoop相關技術
4)大數(shù)據(jù)挖掘知識點

第二講 MapReduceSpark DAG計算模式
1)分布式文件系統(tǒng)DFS
2)MapReduce計算模型介紹
3)使用MR進行算法設計
4)DAG及其算法設計

第三講 大數(shù)據(jù)挖掘分析工具
1)Yarn中的Mahoutb介紹
2)Spark中的MahoutMLib介紹
3)推薦系統(tǒng)及其Mahout實現(xiàn)方法
4)信息聚類及其MLlib實現(xiàn)方法
5)分類技術在MahoutMLib中的實現(xiàn)方法

第四講 大數(shù)據(jù)推薦及其應用開發(fā)
1)一個推薦系統(tǒng)的模型
2)基于內(nèi)容的推薦
3)協(xié)同過濾
4)基于Mahout的電影推薦案例

第五講 大數(shù)據(jù)分類技術及其應用
1)分類的定義
2)分類主要算法
3)Mahout分類過程
4)評估指標以及評測
5)貝葉斯算法新聞分類實例

第六講 大數(shù)據(jù)聚類技術及其應用
1)聚類的定義
2)聚類的主要算法
3)K-Means、Canopy及其應用示例
4)Fuzzy K-Means、Dirichlet及其應用示例
5)基于MLlib的新聞聚類實例

第七講 大數(shù)據(jù)關聯(lián)規(guī)則和相似項發(fā)現(xiàn)
1)購物籃模型
2)Apriori算法
3)抄襲文檔發(fā)現(xiàn)
4)近鄰搜索的應用

第八講 流數(shù)據(jù)挖掘相關技術
1)流數(shù)據(jù)挖掘及分析
2)Storm和流數(shù)據(jù)處理模型
3)流處理中的數(shù)據(jù)抽樣
4)流過濾和Bloom filter

第九講 云環(huán)境下大數(shù)據(jù)挖掘應用
1)與YarnSpark集群應用的協(xié)作
2)與Docker等其它云工具配合
3)大數(shù)據(jù)挖掘行業(yè)應用展望

【講師介紹】
楊老師,曼頓培訓網(wǎng)(www.mdpxb.com)資深講師。主要研究網(wǎng)絡信息分析以及云計算相關技術,長期從事通信網(wǎng)管系統(tǒng)、網(wǎng)絡信息處理、商務智能(BI)以及電信決策支持系統(tǒng)的研究開發(fā)工作,主持和參與了多個國家和省部級基金項目,具有豐富的工程實踐及軟件研發(fā)經(jīng)驗。

【費用及報名】
1、費用:培訓費5800元(含培訓費、講義費);如需食宿,會務組可統(tǒng)一安排,費用自理。
2、報名咨詢:4006820825 010-56133998 56028090 13810210257 鮑老師
3、報名流程:電話登記--填寫報名表--發(fā)出培訓確認函
4、備注:如課程已過期,請訪問我們的網(wǎng)站,查詢最新課程
5、詳細資料請訪問北京曼頓培訓網(wǎng):www.mdpxb.com (每月在全國開設四百多門公開課,歡迎報名學習)

我要發(fā)表評論

      張躍華
      方向:更多管理研修
      資深培訓師,營銷實戰(zhàn)專家,中國品牌研究院研究員,特聘專家。《銷售與市場》資源中心專家講師。曾在多家集團公司擔任、營銷總監(jiān),副總經(jīng)理,董事長助理等職務。系"情感營銷"“終端...