storm記錄--4--Storm適用場(chǎng)景-創(chuàng)新互聯(lián)

Storm適用場(chǎng)景

成都創(chuàng)新互聯(lián)公司-專業(yè)網(wǎng)站定制、快速模板網(wǎng)站建設(shè)、高性價(jià)比寧城網(wǎng)站開發(fā)、企業(yè)建站全套包干低至880元,成熟完善的模板庫(kù),直接使用。一站式寧城網(wǎng)站制作公司更省心,省錢,快速模板網(wǎng)站建設(shè)找我們,業(yè)務(wù)覆蓋寧城地區(qū)。費(fèi)用合理售后完善,10余年實(shí)體公司更值得信賴。
  1. 流聚合:

    流聚合就是把兩個(gè)或多個(gè)數(shù)據(jù)流聚合成一個(gè)數(shù)據(jù)流 -- 基于一些共同的tuple字段。

    builder.setBolt(5,new MyJoiner(),parallelism)

     .fieldsGrouping(1,new Fields("joinfield1","joinfield2"))

     .fieldsGrouping(2,new Fields("joinfield1","joinfield2"))

     .fieldsGrouping(3,new Fields("joinfield1","joinfield2"))

  2. 批處理:

    有時(shí)候?yàn)榱诵阅芑蛘咭恍﹦e的原因,你可能想把一組tuple一起處理,而不是一個(gè)一個(gè)單獨(dú)處理。

  3. BasicBolt:

    a、讀一個(gè)輸入tuple;

    b、根據(jù)這個(gè)輸入tuple發(fā)射一個(gè)或者多個(gè)tuple;

    c、在execute的方法的最后ack那個(gè)輸入tuple

    遵循這類模式的bolt一般是函數(shù)或者是過(guò)濾器,這種模式太常見(jiàn),storm為這類模式單獨(dú)封裝了一個(gè)接口:IbasicBolt。

  4. 內(nèi)存內(nèi)緩存 + Fields grouping組合

    在bolt的內(nèi)存里面緩存一些東西非常常見(jiàn)。緩存在和fields grouping結(jié)合起來(lái)之后就更有用了。比如,你有一個(gè)bolt把短鏈接變成長(zhǎng)鏈接(bit.ly,t.co之類的)。你可以把短鏈接到長(zhǎng)鏈接的對(duì)應(yīng)關(guān)系利用LRU算分緩存在內(nèi)存里面以避免重復(fù)計(jì)算。比如組件一發(fā)射短鏈接,組件二把短鏈接轉(zhuǎn)化成長(zhǎng)鏈接并緩存在內(nèi)存里面。看一下下面兩段代碼有什么不一樣:

    builder.setBolt(2,new ExpandUrl(),parallelism).shuffleGrouping(1);

    builder.setBolt(2,new ExpandUrl(),parallelism).fieldsGrouping(1,new Fields("url"));

  5. 計(jì)算top N

    比如你有一個(gè)bolt發(fā)射這樣的tuple:"value","count"并且你想一個(gè)bolt基于這些信息算出top N的tuple。最簡(jiǎn)單的辦法是有一個(gè)bolt可以做一個(gè)全局的grouping的動(dòng)作并且在內(nèi)存里面保持著top N的值。

    這個(gè)方式對(duì)于大數(shù)據(jù)量的流顯然是沒(méi)有擴(kuò)展性的,因?yàn)樗械臄?shù)據(jù)會(huì)被發(fā)到同一臺(tái)機(jī)器。一個(gè)更好的方法是在多臺(tái)機(jī)器上面并行的計(jì)算這個(gè)流每一部分的top N,然后再由一個(gè)bolt合并這些機(jī)器上面所算出來(lái)的top N以算出最后的top N,代碼大概是這樣的:

    builder.setBolt(2,new RankObjects(),parallellism).fieldsGrouping(1,new Fields("value"));

    builder.setBolt(3,new MergeObjects()).globalGrouping(2);

    這個(gè)模式之所以可以成功是因?yàn)榈谝粋€(gè)bolt的fieldsgrouping使得這種并行算法在語(yǔ)義上是正確的。

  6. 用TimeCacheMap來(lái)高效地保存一個(gè)最近被更新的對(duì)象的緩存:

    有時(shí)候你想在內(nèi)存里面保存一些最近活躍的對(duì)象,以及那些不再活躍的對(duì)象。TimeCacheMap是一個(gè)非常高效地?cái)?shù)據(jù)結(jié)構(gòu),它提供了一些callback函數(shù)使得我們?cè)趯?duì)象不再活躍的時(shí)候我們可以做一些事情。

  7. 分布式RPC:CoordinatedBolt和KeyedFairBolt:

    用storm做分布式RPC應(yīng)用的時(shí)候有兩種比較常見(jiàn)的模式:它們被封裝在CoordinatedBolt和KeyedFairBolt里面。

    CoordinatedBolt包裝你的bolt,并且確定什么時(shí)候你的bolt已經(jīng)接收到所有的tuple,它主要使用Direct Stream來(lái)做這個(gè)。

    KeyedFairBolt同樣包裝你的bolt并且保證你的topology同時(shí)處理多個(gè)DRPC調(diào)用,而不是串行的一次只執(zhí)行一個(gè)。

另外有需要云服務(wù)器可以了解下創(chuàng)新互聯(lián)scvps.cn,海內(nèi)外云服務(wù)器15元起步,三天無(wú)理由+7*72小時(shí)售后在線,公司持有idc許可證,提供“云服務(wù)器、裸金屬服務(wù)器、高防服務(wù)器、香港服務(wù)器、美國(guó)服務(wù)器、虛擬主機(jī)、免備案服務(wù)器”等云主機(jī)租用服務(wù)以及企業(yè)上云的綜合解決方案,具有“安全穩(wěn)定、簡(jiǎn)單易用、服務(wù)可用性高、性價(jià)比高”等特點(diǎn)與優(yōu)勢(shì),專為企業(yè)上云打造定制,能夠滿足用戶豐富、多元化的應(yīng)用場(chǎng)景需求。

網(wǎng)頁(yè)題目:storm記錄--4--Storm適用場(chǎng)景-創(chuàng)新互聯(lián)
網(wǎng)站URL:http://muchs.cn/article34/coegse.html

成都網(wǎng)站建設(shè)公司_創(chuàng)新互聯(lián),為您提供網(wǎng)站內(nèi)鏈、域名注冊(cè)、微信小程序、電子商務(wù)、網(wǎng)站改版、App設(shè)計(jì)

廣告

聲明:本網(wǎng)站發(fā)布的內(nèi)容(圖片、視頻和文字)以用戶投稿、用戶轉(zhuǎn)載內(nèi)容為主,如果涉及侵權(quán)請(qǐng)盡快告知,我們將會(huì)在第一時(shí)間刪除。文章觀點(diǎn)不代表本網(wǎng)站立場(chǎng),如需處理請(qǐng)聯(lián)系客服。電話:028-86922220;郵箱:631063699@qq.com。內(nèi)容未經(jīng)允許不得轉(zhuǎn)載,或轉(zhuǎn)載時(shí)需注明來(lái)源: 創(chuàng)新互聯(lián)

成都定制網(wǎng)站網(wǎng)頁(yè)設(shè)計(jì)