ApacheCalcite官方文檔中文版-進(jìn)階-4.Lattices-創(chuàng)新互聯(lián)

第二部分 進(jìn)階(Advanced)

1. Lattices

  Lattice是一個創(chuàng)建并填充物化視圖的框架,可以識別以及解決特定查詢的物化視圖。
  一個Lattice代表一個星型(或雪花)模型,不是通用的schema。特別地,所有的連接關(guān)系必須是多對一,圍繞星型模型的事實(shí)表建立。
  Lattice的名字來源于數(shù)學(xué): lattice是一個部分有序的集合,任何兩個元素都有一個唯一的大的下界和最小的上界。
  [HRU96]發(fā)現(xiàn),多維數(shù)據(jù)集可能的物化集合構(gòu)成一個lattice,并且使用一種算法來選擇一組較為優(yōu)化的物化組合。Calcite的推薦算法也是源于此。
 Lattice使用SQL statement來代表星型模型,以此來進(jìn)行定義自身。SQL是一種有用的能表示多個table join關(guān)系的短語,并且可以為列名指定別名(與發(fā)明一種新的語言來表示關(guān)系,join 條件和基數(shù)相比,SQL表達(dá)更為方便)。
  和常規(guī)sql不同,順序在這里很重要。如果你在from模塊中將A放在B前面,并且實(shí)現(xiàn)一個A和B的join關(guān)系,可以說是從A到B有一個多對一的關(guān)系。(例如,在lattice例子中,Sales事實(shí)表在時間維度表和產(chǎn)品維度表之前先被觸發(fā),產(chǎn)品維度表在產(chǎn)品分類維度表之前被觸發(fā),further down an arm of a snowflake.))
  一個Lattice意味著一系列的約束。在A到B的關(guān)系中,A表上存在一個外鍵(例如,每一個A表中的外鍵都對應(yīng)B表key中的一個值),和B表中的一個唯一key(例如,key值只會出現(xiàn)一次)。這些約束條件都非常重要,因?yàn)樗试S計劃器來移除沒有用到的列的join關(guān)系,并且知道查詢結(jié)果是不會改變的。
  Calcite不會去校驗(yàn)約束條件,如果違反約束規(guī)則,Calcite會直接返回錯誤的結(jié)果。
  Lattice是一個大的虛擬的join視圖。它不是物化的(由于反規(guī)范化,它可能會比星型模型大好幾倍),并且你可能并不想去對它進(jìn)行查詢(columns太多了)。所以它到底是干什么的呢?
1)如上面所說,lattice聲明了許多有用的主鍵和外鍵的約束。
2)它幫助查詢執(zhí)行器將用戶的查詢行為映射到filter-join-aggregate 物化視圖(針對DW查詢最有用的物化視圖類型)
3)給Calcite一個框架來收集關(guān)于數(shù)據(jù)卷和用戶查詢的統(tǒng)計信息
4)允許Calcite去自動設(shè)計和填充物化視圖
  大多數(shù)星型模型會強(qiáng)制用戶去定義一個column到底是維度還是指標(biāo)。在lattice中,每一個column都是維度列(也就是說,它可以成為GROUP BY子句中的一列,用于在特定維度上查詢星型模式)。所有的column也同樣可以用作度量(指標(biāo)),你可以為指定列指定聚合函數(shù)來定義一個度量(指標(biāo))。
  如果“unit_sales”通常更傾向于作為度量使用而不是維度,也沒有影響。Calcite算法在不久的將來會注意到它很少被聚合,就不會傾向于在它上面創(chuàng)建聚合層(當(dāng)前算法在設(shè)計tiles時不會參考查詢歷史)。
  但有人或許想知道,少于5的訂單和多于100的訂單利潤是會更多還是更少。在這種場景下,“unit_sales”突然就成為一個維度了。如果聲明一個列為維度列的成本為0,我想我們應(yīng)該讓所有的列都成為維度列。
  該模型允許一個指定表以不同的表別名被多次使用??梢栽谀P椭卸xOrderDate和ShipDate兩個時間維度。
  大多數(shù)SQL系統(tǒng)要求一個視圖的中的列名是唯一的,在lattice中比較難達(dá)到,因?yàn)榻?jīng)常會在一次join中同時包含主鍵和外鍵列。因此,Calcite允許用戶通過兩種方式引用列,如果列是唯一的,可以直接使用它的名字【‘unit_sales’】。不管列在lattice是否唯一,它在自己的table中都是唯一的,因此你可以通過它的表名來對它進(jìn)行引用。如下例?

10年積累的成都做網(wǎng)站、成都網(wǎng)站設(shè)計經(jīng)驗(yàn),可以快速應(yīng)對客戶對網(wǎng)站的新想法和需求。提供各種問題對應(yīng)的解決方案。讓選擇我們的客戶得到更好、更有力的網(wǎng)絡(luò)服務(wù)。我雖然不認(rèn)識你,你也不認(rèn)識我。但先網(wǎng)站設(shè)計后付款的網(wǎng)站建設(shè)流程,更有常山免費(fèi)網(wǎng)站建設(shè)讓你可以放心的選擇與我們合作。
  • [“sales”, “unit_sales”]
  • [“ship_date”, “time_id”]
  • [“order_date”, “time_id”]
      一個“tile”是lattice中的一個帶有一些特定維度(在Kylin中被稱為cuboid——Cube則包含了所有維度的不同的兩兩組合,每一種組合即為一個Cuboid)的物化表。Lattice JSON元素中的tiles屬性定義了一個初始的物化tile集合。
      如果運(yùn)行算法,可以省略tiles屬性。Calcite會選擇一個初始集合。如果定義了tiles屬性,算法就會以定義的list開始啟動運(yùn)行,然后開始尋找其他互補(bǔ)的tiles(eg fill in the gaps left by the initail tiles)?

另外有需要云服務(wù)器可以了解下創(chuàng)新互聯(lián)scvps.cn,海內(nèi)外云服務(wù)器15元起步,三天無理由+7*72小時售后在線,公司持有idc許可證,提供“云服務(wù)器、裸金屬服務(wù)器、高防服務(wù)器、香港服務(wù)器、美國服務(wù)器、虛擬主機(jī)、免備案服務(wù)器”等云主機(jī)租用服務(wù)以及企業(yè)上云的綜合解決方案,具有“安全穩(wěn)定、簡單易用、服務(wù)可用性高、性價比高”等特點(diǎn)與優(yōu)勢,專為企業(yè)上云打造定制,能夠滿足用戶豐富、多元化的應(yīng)用場景需求。

本文題目:ApacheCalcite官方文檔中文版-進(jìn)階-4.Lattices-創(chuàng)新互聯(lián)
轉(zhuǎn)載來于:http://muchs.cn/article48/dgcohp.html

成都網(wǎng)站建設(shè)公司_創(chuàng)新互聯(lián),為您提供自適應(yīng)網(wǎng)站網(wǎng)站維護(hù)、軟件開發(fā)ChatGPT、網(wǎng)站改版域名注冊

廣告

聲明:本網(wǎng)站發(fā)布的內(nèi)容(圖片、視頻和文字)以用戶投稿、用戶轉(zhuǎn)載內(nèi)容為主,如果涉及侵權(quán)請盡快告知,我們將會在第一時間刪除。文章觀點(diǎn)不代表本網(wǎng)站立場,如需處理請聯(lián)系客服。電話:028-86922220;郵箱:631063699@qq.com。內(nèi)容未經(jīng)允許不得轉(zhuǎn)載,或轉(zhuǎn)載時需注明來源: 創(chuàng)新互聯(lián)

成都定制網(wǎng)站網(wǎng)頁設(shè)計