欧美日韩一级黄色片,国产高清av在线免费,久久福利国产精品,毛片网址大全,成年人视频网站大全,六月丁香婷婷爱AV,国产一级片avv

    大數(shù)據服務

    來源:|瀏覽次:244|2017年11月17日

    大數(shù)據概念

        "大數(shù)據"是一個體量特別大,數(shù)據類別特別大的數(shù)據集,并且這樣的數(shù)據集無法用傳統(tǒng)數(shù)據庫工具對其內容進行抓取、管理和處理。 "大數(shù)據"首先是指數(shù)據體量(volumes)?大,指代大型數(shù)據集,一般在10TB?規(guī)模左右,但在實際應用中,很多企業(yè)用戶把多個數(shù)據集放在一起,已經形成了PB級的數(shù)據量;其次是指數(shù)據類別(variety)大,數(shù)據來自多種數(shù)據源,數(shù)據種類和格式日漸豐富,已沖破了以前所限定的結構化數(shù)據范疇,囊括了半結構化和非結構化數(shù)據。接著是數(shù)據處理速度(Velocity)快,在數(shù)據量非常龐大的情況下,也能夠做到數(shù)據的實時處理。最后一個特點是指數(shù)據真實性(Veracity)高,隨著社交數(shù)據、企業(yè)內容、交易與應用數(shù)據等新數(shù)據源的興趣,傳統(tǒng)數(shù)據源的局限被打破,企業(yè)愈發(fā)需要有效的信息之力以確保其真實性及安全性。

    大數(shù)據作用
    大數(shù)據處理之一:采集
        大數(shù)據的采集是指利用多個數(shù)據庫來接收發(fā)自客戶端(Web、App或者傳感器形式等)的數(shù)據,并且用戶可以通過這些數(shù)據庫來進行簡單的查詢和處理工作。比如,電商會使用傳統(tǒng)的關系型數(shù)據庫MySQL和Oracle等來存儲每一筆事務數(shù)據,除此之外,Redis和MongoDB這樣的NoSQL數(shù)據庫也常用于數(shù)據的采集。
           在大數(shù)據的采集過程中,其主要特點和挑戰(zhàn)是并發(fā)數(shù)高,因為同時有可能會有成千上萬的用戶來進行訪問和操作,比如火車票售票網站和淘寶,它們并發(fā)的訪問量在峰值時達到上百萬,所以需要在采集端部署大量數(shù)據庫才能支撐。并且如何在這些數(shù)據庫之間進行負載均衡和分片的確是需要深入的思考和設計。
    大數(shù)據處理之二:導入/預處理
        雖然采集端本身會有很多數(shù)據庫,但是如果要對這些海量數(shù)據進行有效的分析,還是應該將這些來自前端的數(shù)據導入到一個集中的大型分布式數(shù)據庫,或者分布式存儲集群,并且可以在導入基礎上做一些簡單的清洗和預處理工作。也有一些用戶會在導入時使用來自Twitter的Storm來對數(shù)據進行流式計算,來滿足部分業(yè)務的實時計算需求。
           導入與預處理過程的特點和挑戰(zhàn)主要是導入的數(shù)據量大,每秒鐘的導入量經常會達到百兆,甚至千兆級別。
    大數(shù)據處理之三:統(tǒng)計/分析
        統(tǒng)計與分析主要利用分布式數(shù)據庫,或者分布式計算集群來對存儲于其內的海量數(shù)據進行普通的分析和分類匯總等,以滿足大多數(shù)常見的分析需求,在這方面,一些實時性需求會用到EMC的GreenPlum、Oracle的Exadata,以及基于MySQL的列式存儲Infobright等,而一些批處理,或者基于半結構化數(shù)據的需求可以使用Hadoop。

           統(tǒng)計與分析這部分的主要特點和挑戰(zhàn)是分析涉及的數(shù)據量大,其對系統(tǒng)資源,特別是I/O會有極大的占用。
    大數(shù)據處理之四:挖掘
        統(tǒng)計與分析主要利用分布式數(shù)據庫,或者分布式計算集群來對存儲于其內的海量數(shù)據進行普通的分析和分類匯總等,以滿足大多數(shù)常見的分析需求,在這方面,一些實時性需求會用到EMC的GreenPlum、Oracle的Exadata,以及基于MySQL的列式存儲Infobright等,而一些批處理,或者基于半結構化數(shù)據的需求可以使用Hadoop。

           統(tǒng)計與分析這部分的主要特點和挑戰(zhàn)是分析涉及的數(shù)據量大,其對系統(tǒng)資源,特別是I/O會有極大的占用。
許 可 證:《互聯(lián)網信息增值電信業(yè)務經營許可證》編號(蒙ISP:20080001)《移動網信息增值電信業(yè)務經營許可證》編號(蒙B2-420090006) 蒙ICP備:06003799號     蒙公網安備 15040402220079號
聯(lián)系電話:0476-8222762 0476-8222761 18004762534 18004761534 18004762634 18004761634 傳真:0476-8222761
電子信箱:cfhlwl@163.com 客服QQ:565109814(技術部) 2982804625(備案咨詢) 2030466526(市場部)