架構(gòu)
在確定和整理好不同的數(shù)據(jù)類型之后,就可以清晰確定各種數(shù)據(jù)特征——包括數(shù)據(jù)類型、關(guān)聯(lián)的元數(shù)據(jù)、可以標(biāo)識為主數(shù)據(jù)元素的重要數(shù)據(jù)元素、數(shù)據(jù)復(fù)雜度及擁有和管理數(shù)據(jù)的業(yè)務(wù)用戶。
工作負(fù)載
處理大數(shù)據(jù)的最大需求是前面章節(jié)所介紹的工作負(fù)載管理。
圖2
有了數(shù)據(jù)架構(gòu)和分類,我們就可以分配可以執(zhí)行該類數(shù)據(jù)工作負(fù)載需求的基礎(chǔ)架構(gòu)。
我們可以根據(jù)數(shù)據(jù)容量和數(shù)據(jù)延遲時(shí)間將工作負(fù)載大體分成4類(圖2)。然后,我們再根據(jù)類別將數(shù)據(jù)分配到物理基礎(chǔ)架構(gòu)層進(jìn)行處理。該管理方法可以為數(shù)據(jù)倉庫的各個(gè)部分創(chuàng)建一種動(dòng)態(tài)可擴(kuò)展需求,它們可以高效利用當(dāng)前及未來的新基礎(chǔ)方法。在這個(gè)時(shí)候,一定要注意的關(guān)鍵問題是要保持處理邏輯的靈活性,使它能夠在不同的物理基礎(chǔ)架構(gòu)組件上發(fā)揮作用,因?yàn)閿?shù)據(jù)是根據(jù)處理緊迫性進(jìn)行分類的,這樣相同的數(shù)據(jù)就可能會(huì)被歸類到不同的工作負(fù)載上。