StorageGRID 中抹除編碼的優點、缺點和要求
在決定使用複寫還是銷毀編碼來保護物件資料免於遺失之前,您應該先了解銷毀編碼的優點、缺點和要求。
銷毀編碼的優點
與複寫相比,銷毀編碼提供了更高的可靠性、可用度和儲存效率。
-
可靠性:以在不發生資料遺失的情況下能夠持續的同時故障次數來衡量。
-
複寫:多個相同的物件複本儲存在不同的節點和不同的站台上。
-
銷毀編碼:將物件編碼成資料片段和同位元檢查片段,並分散到多個節點和站台。這種分散方式可同時提供站台和節點故障保護。
-
-
可用度:指在儲存節點發生故障或無法存取時取得物件的能力。與複寫相比,銷毀編碼在儲存設備成本相近的情況下提供了更高的可用度。
-
儲存效率:在可用度和可靠性相近的情況下,銷毀編碼物件比複寫物件佔用更少的磁碟空間。例如,一個 10 MB 的物件複寫到兩個站台會佔用 20 MB 的磁碟空間(兩份複本),而一個使用 6+3 銷毀編碼方案跨三個站台進行銷毀編碼的物件僅佔用 15 MB 的磁碟空間。
銷毀編碼物件的磁碟空間是以物件大小加上儲存負荷來計算。儲存負荷百分比為同位元檢查片段數除以資料片段數。
銷毀編碼的缺點
與複寫相比,銷毀編碼有以下缺點:
-
根據銷毀編碼方案的不同,建議增加儲存節點和站點的數量。相反,如果複寫物件資料,則每個複本只需要一個儲存節點。請參閱"包含三個或更多站台的儲存資源池銷毀編碼方案"和"單一站台儲存資源池的銷毀編碼方案"。
-
儲存設備擴充的成本和複雜性增加。若要擴充使用複寫的部署,需要在每個建立物件複本的位置增加儲存容量。若要擴充使用銷毀編碼的部署,必須同時考慮所使用的銷毀編碼方案以及現有儲存節點的容量使用情況。例如,如果等到現有節點 100% 滿才進行擴充,則至少需要新增 `k+m`個儲存節點;但如果在現有節點 70% 滿時進行擴充,則每個站台可以新增兩個節點,並且仍然可以最大化可用儲存容量。如需詳細資訊,請參閱"增加銷毀編碼物件的儲存容量"。
-
在地理位置分散的站台上使用銷毀編碼會增加擷取延遲。對於經過銷毀編碼處理並分佈在遠端站台上的物件,透過 WAN 連線擷取物件片段所需的時間,比本地複寫且可用的物件(用戶端所連線的相同站台)要長。
-
當您在地理位置分散的站台上使用銷毀編碼時,擷取和修復作業會產生較高的 WAN 網路流量,特別是對於經常擷取的物件或透過 WAN 網路連線進行物件修復的情況。
-
當跨站台使用銷毀編碼時,隨著站台間網路延遲的增加,最大物件處理量會急劇下降。這種下降是由於 TCP 網路處理量的降低,會影響 StorageGRID 系統儲存和擷取物件片段的速度。
-
運算資源利用率更高。
何時使用銷毀編碼
請使用銷毀編碼來滿足以下要求:
-
大於 1 MB 的物件。
銷毀編碼最適合大於 1 MB 的物件。不要對小於 200 KB 的物件使用銷毀編碼,以免管理非常小的銷毀編碼片段帶來例行成本。 -
用於不常擷取內容的長期或冷儲存設備。
-
高資料可用度和可靠性。
-
防止站台和節點完全故障。
-
儲存效率。
-
單一站台部署需要有效率的資料保護,只需單一銷毀編碼複本,而非多個複寫複本。
-
多站台部署,站台間延遲小於 100 毫秒。