大數(shù)據(jù)分析之六大神器
大數(shù)據(jù)是一個(gè)內(nèi)涵寬泛的術(shù)語(yǔ),其中含有十分龐大且復(fù)雜無(wú)比數(shù)據(jù)集的意思,需要專門設(shè)計(jì)的硬件和軟件工具進(jìn)行處理,。該數(shù)據(jù)集通常是萬(wàn)億或EB的大小,。這些數(shù)據(jù)集收集自各種各樣的來(lái)源:傳感器,、氣候信息,、公開(kāi)的信息,、如雜志,、報(bào)紙,、文章,。大數(shù)據(jù)產(chǎn)生的其他例子包括購(gòu)買交易記錄、網(wǎng)絡(luò)日志,、病歷,、事監(jiān)控、視頻和圖像檔案,、及大型電子商務(wù),。大數(shù)據(jù)分析是在研究大量的數(shù)據(jù)的過(guò)程中尋找模式,相關(guān)性和其他有用的信息,,可以幫助企業(yè)更好地適應(yīng)變化,,并做出更明智的決策。
Hadoop
Hadoop是一個(gè)能夠?qū)Υ罅繑?shù)據(jù)進(jìn)行分布式處理的軟件框架,。但是Hadoop是以一種可靠,、高效、可伸縮的方式進(jìn)行處理的,。Hadoop是可靠的,,因?yàn)樗僭O(shè)計(jì)算元素和存儲(chǔ)會(huì)失敗,因此它維護(hù)多個(gè)工作數(shù)據(jù)副本,,確保能夠針對(duì)失敗的節(jié)點(diǎn)重新分布處理,。Hadoop是高效的,,因?yàn)樗圆⑿械姆绞焦ぷ?,通過(guò)并行處理加快處理速度。Hadoop還是可伸縮的,,能夠處理PB級(jí)數(shù)據(jù),。此外,Hadoop依賴于社區(qū)服務(wù)器,,因此它的成本比較低,,任何人都可以使用。
Hadoop是一個(gè)能夠讓用戶輕松架構(gòu)和使用的分布式計(jì)算平臺(tái),。用戶可以輕松地在Hadoop上開(kāi)發(fā)和運(yùn)行處理海量數(shù)據(jù)的應(yīng)用程序,。它主要有以下幾個(gè)優(yōu)點(diǎn):
高可靠性。Hadoop按位存儲(chǔ)和處理數(shù)據(jù)的能力值得人們信賴,。
高擴(kuò)展性,。Hadoop是在可用的計(jì)算機(jī)集簇間分配數(shù)據(jù)并完成計(jì)算任務(wù)的,這些集簇可以方便地?cái)U(kuò)展到數(shù)以千計(jì)的節(jié)點(diǎn)中。
高效性,。Hadoop能夠在節(jié)點(diǎn)之間動(dòng)態(tài)地移動(dòng)數(shù)據(jù),,并保證各個(gè)節(jié)點(diǎn)的動(dòng)態(tài)平衡,因此處理速度非???。
高容錯(cuò)性。Hadoop能夠自動(dòng)保存數(shù)據(jù)的多個(gè)副本,,并且能夠自動(dòng)將失敗的任務(wù)重新分配,。
Hadoop帶有用Java語(yǔ)言編寫(xiě)的框架,因此運(yùn)行在Linux生產(chǎn)平臺(tái)上是非常理想的,。Hadoop上的應(yīng)用程序也可以使用其他語(yǔ)言編寫(xiě),,比如C++。
HPCC
HPCC,,High Performance Computing and Communications(高性能計(jì)算與通信)的縮寫(xiě),。1993年,由美國(guó)科學(xué),、工程,、技術(shù)聯(lián)邦協(xié)調(diào)理事會(huì)向國(guó)會(huì)提交了“重大挑戰(zhàn)項(xiàng)目:高性能計(jì)算與通信”的報(bào)告,也就是被稱為HPCC計(jì)劃的報(bào)告,,即美國(guó)總統(tǒng)科學(xué)戰(zhàn)略項(xiàng)目,,其目的是通過(guò)加強(qiáng)研究與開(kāi)發(fā)解決一批重要的科學(xué)與技術(shù)挑戰(zhàn)問(wèn)題。HPCC是美國(guó)實(shí)施信息高速公路而上實(shí)施的計(jì)劃,,該計(jì)劃的實(shí)施將耗資百億美元,,其主要目標(biāo)要達(dá)到:開(kāi)發(fā)可擴(kuò)展的計(jì)算系統(tǒng)及相關(guān)軟件,以支持太位級(jí)網(wǎng)絡(luò)傳輸性能,,開(kāi)發(fā)千兆比特網(wǎng)絡(luò)技術(shù),,擴(kuò)展研究和教育機(jī)構(gòu)及網(wǎng)絡(luò)連接能力。
該項(xiàng)目主要由五部分組成:
高性能計(jì)算機(jī)系統(tǒng)(HPCS),,內(nèi)容包括今后幾代計(jì)算機(jī)系統(tǒng)的研究,、系統(tǒng)設(shè)計(jì)工具、先進(jìn)的典型系統(tǒng)及原有系統(tǒng)的評(píng)價(jià)等;
先進(jìn)軟件技術(shù)與算法(ASTA),,內(nèi)容有巨大挑戰(zhàn)問(wèn)題的軟件支撐,、新算法設(shè)計(jì)、軟件分支與工具,、計(jì)算計(jì)算及高性能計(jì)算研究中心等;
國(guó)家科研與教育網(wǎng)格(NREN),,內(nèi)容有中接站及10億位級(jí)傳輸?shù)难芯颗c開(kāi)發(fā);
基本研究與人類資源(BRHR),內(nèi)容有基礎(chǔ)研究,、培訓(xùn),、教育及課程教材,被設(shè)計(jì)通過(guò)獎(jiǎng)勵(lì)調(diào)查者-開(kāi)始的,長(zhǎng)期的調(diào)查在可升級(jí)的高性能計(jì)算中來(lái)增加創(chuàng)新意識(shí)流,,通過(guò)提高教育和高性能的計(jì)算訓(xùn)練和通信來(lái)加大熟練的和訓(xùn)練有素的人員的聯(lián)營(yíng),,和來(lái)提供必需的基礎(chǔ)架構(gòu)來(lái)支持這些調(diào)查和研究活動(dòng);
信息基礎(chǔ)結(jié)構(gòu)技術(shù)和應(yīng)用(IITA ),目的在于保證美國(guó)在先進(jìn)信息技術(shù)開(kāi)發(fā)方面的領(lǐng)先地位,。
Storm
Storm是自由的開(kāi)源軟件,,一個(gè)分布式的、容錯(cuò)的實(shí)時(shí)計(jì)算系統(tǒng),。Storm可以非??煽康奶幚睚嫶蟮臄?shù)據(jù)流,用于處理Hadoop的批量數(shù)據(jù),。Storm很簡(jiǎn)單,,支持許多種編程語(yǔ)言,使用起來(lái)非常有趣,。Storm由Twitter開(kāi)源而來(lái),,其它知名的應(yīng)用企業(yè)包括Groupon、淘寶,、支付寶,、阿里巴巴、樂(lè)元素,、Admaster等等,。
Storm有許多應(yīng)用領(lǐng)域:實(shí)時(shí)分析、在線機(jī)器學(xué)習(xí),、不停頓的計(jì)算,、分布式RPC(遠(yuǎn)過(guò)程調(diào)用協(xié)議,一種通過(guò)網(wǎng)絡(luò)從遠(yuǎn)程計(jì)算機(jī)程序上請(qǐng)求服務(wù)),、ETL(Extraction-Transformation-Loading的縮寫(xiě),,即數(shù)據(jù)抽取、轉(zhuǎn)換和加載)等等,。Storm的處理速度驚人:經(jīng)測(cè)試,,每個(gè)節(jié)點(diǎn)每秒鐘可以處理100萬(wàn)個(gè)數(shù)據(jù)元組,。Storm是可擴(kuò)展,、容錯(cuò),很容易設(shè)置和操作,。
Apache Drill
為了幫助企業(yè)用戶尋找更為有效,、加快Hadoop數(shù)據(jù)查詢的方法,Apache軟件基金會(huì)近日發(fā)起了一項(xiàng)名為“Drill”的開(kāi)源項(xiàng)目,。Apache Drill實(shí)現(xiàn)了Google's Dremel,。
相關(guān)新聞:
- 月入6000還缺人?大數(shù)據(jù)統(tǒng)計(jì):物流業(yè)人才成今年最
- 沱沱工社許良:利用大數(shù)據(jù)手段增強(qiáng)網(wǎng)絡(luò)誠(chéng)信透明
- 大數(shù)據(jù)時(shí)代如何升級(jí)電商供應(yīng)鏈管理
- 大數(shù)據(jù)作支撐 智能物流迎加速發(fā)展
- 國(guó)家郵政局公布5月郵政行業(yè)運(yùn)行大數(shù)據(jù) 你想到
- 2015全國(guó)物流運(yùn)行大數(shù)據(jù)發(fā)布 這幾個(gè)數(shù)字對(duì)你
- 馬化騰,、李彥宏,、劉強(qiáng)東......大數(shù)據(jù)峰會(huì)他們
- 李克強(qiáng):信息產(chǎn)業(yè),、大數(shù)據(jù)、電子商務(wù)等新經(jīng)濟(jì)給
- 4月郵政業(yè)消費(fèi)者申訴大數(shù)據(jù)公布:為消費(fèi)者挽回
- 一圖看懂未來(lái)5年大數(shù)據(jù)市場(chǎng)
0條評(píng)論
網(wǎng)友評(píng)論推薦資訊
全國(guó)預(yù)制菜品牌供應(yīng)鏈與冷鏈服
- 國(guó)家郵政局:上半年快遞業(yè)務(wù)收入完成6530億元,,
- 國(guó)家發(fā)展改革委發(fā)布2024年國(guó)家骨干冷鏈物流
- 商務(wù)部外貿(mào)司負(fù)責(zé)人解讀《關(guān)于拓展跨境電商
- 以責(zé)任落實(shí)筑牢交通運(yùn)輸安全防線
- 2024年端午假期全國(guó)郵政快遞業(yè)攬投快遞包裹2
- 交通運(yùn)輸領(lǐng)域七大行動(dòng)促進(jìn)大規(guī)模設(shè)備更新
- 中國(guó)商業(yè)聯(lián)合會(huì)發(fā)布商貿(mào)流通領(lǐng)域提升支付便
- 2024年度農(nóng)產(chǎn)品骨干冷鏈物流重點(diǎn)縣(重點(diǎn)市)建
- 中歐班列累計(jì)開(kāi)行9萬(wàn)列
- 關(guān)于舉辦“全國(guó)預(yù)制菜品牌供應(yīng)鏈與冷鏈服務(wù)
熱門點(diǎn)擊排行
- ·物流企業(yè)數(shù)字化轉(zhuǎn)型:精準(zhǔn)匹配人車貨 技術(shù)創(chuàng)
- ·我國(guó)智能航運(yùn)發(fā)展迅速 相繼突破航行關(guān)鍵核
- ·中共二十屆三中全會(huì)公報(bào):健全提升產(chǎn)業(yè)鏈供應(yīng)
- ·商務(wù)部財(cái)務(wù)司負(fù)責(zé)人解讀《關(guān)于加強(qiáng)商務(wù)和金
- ·財(cái)經(jīng)觀察:貨物貿(mào)易創(chuàng)歷史同期新高 增長(zhǎng)動(dòng)能
- ·天津印發(fā)方案打造世界一流自由貿(mào)易園
- ·新疆加快建設(shè)烏魯木齊國(guó)際航空樞紐
- ·黑龍江辦理運(yùn)輸企業(yè)“一件事”許可超四千件
- ·交通運(yùn)輸行業(yè)壓實(shí)責(zé)任強(qiáng)化巡查排險(xiǎn)
- ·深中通道車流量超200萬(wàn)輛次