數據備份與災難復原

很多公司以為「我有做備份」就等於安全,直到真正需要還原的一刻,才發現備份損壞、還原太慢,或者根本救不回關鍵資料。備份與災難復原(Disaster Recovery,簡稱 DR)是兩個相關但不同的概念,把兩者混為一談,往往是企業在災難面前失守的主因。本文釐清兩者分別,講解 3-2-1 備份原則、RPO 與 RTO 概念、常見策略與測試的重要性、雲端在 DR 中的角色,並提供中小企的務實落地建議。

備份與災難復原的分別

兩個詞常被交替使用,但它們回答的其實是不同的問題:

  • 備份(Backup)回答的是:「我的資料有沒有一份可靠的副本?」它聚焦於資料本身——把檔案、資料庫、設定複製並保存起來,以便在資料遺失、損毀或被加密時能夠取回。
  • 災難復原(Disaster Recovery)回答的是:「當整個系統或環境倒下,我多快能夠重新運作?」它聚焦於恢復營運的能力——不只是取回資料,還包括伺服器、應用程式、網絡與整體服務如何重新站起來。

打個比方:備份就像把重要文件影印一份鎖進保險箱;而災難復原則是整套「萬一辦公室發生火災,如何在最短時間內於另一地點恢復營業」的計劃。只有備份而沒有 DR 計劃,你可能保住了資料,卻仍要花上數天甚至更久,才能讓生意重新運轉——這段停擺,本身就是巨大的損失。備份是 DR 的必要基礎,但遠遠不是全部。

3-2-1 備份原則

要判斷備份是否可靠,業界廣泛採用的經典基準是「3-2-1 原則」,簡單易記卻非常有效:

  • 3 份副本:保留至少三份資料——一份正在使用的正本,加上兩份備份。副本越多,同時全部失效的機會就越低。
  • 2 種媒介:把備份存放在至少兩種不同類型的儲存上(例如本地磁碟加上雲端),避免單一媒介的共同弱點一次過令所有備份報銷。
  • 1 份異地:其中至少一份備份要存放在異地(off-site),與主要環境實體分隔。這樣即使辦公室發生火災、水浸、盜竊或勒索軟件橫掃內網,異地那份仍然安全。

近年面對勒索軟件威脅,不少人會把原則延伸為「3-2-1-1」,額外強調其中一份備份應為離線或不可篡改(immutable),確保攻擊者即使入侵內網,也無法一併刪除或加密你的救命副本。對重視安全的中小企而言,這一點尤其值得考慮;相關威脅的背景可參考我們關於中小企網絡安全基礎的文章。

RPO 與 RTO:兩個關鍵指標

制訂備份與 DR 計劃時,有兩個核心指標必須先想清楚,因為它們直接決定你需要投入多少資源。

RPO(復原點目標)

RPO(Recovery Point Objective)指的是「你最多可以承受失去多少資料」,以時間衡量。例如 RPO 為一小時,代表最壞情況下,你可能失去故障前一小時內的資料。RPO 越短,備份就要越頻密——每小時備份的 RPO 是一小時,每日備份的 RPO 則是一日。關鍵是問自己:對這個系統來說,遺失多少資料是「可以接受」的?

RTO(復原時間目標)

RTO(Recovery Time Objective)指的是「從故障發生到系統恢復運作,最多可以花多少時間」。例如 RTO 為四小時,代表你的目標是在四小時內讓服務重新上線。RTO 越短,通常需要越自動化、越即時的復原方案,成本也越高。

RPO 與 RTO 沒有「越短越好」的標準答案,而是業務需要與成本之間的平衡。核心交易系統可能需要很短的 RPO 與 RTO,而一些內部參考資料則可以寬鬆得多。先為不同系統定出合理目標,再據此設計方案,才不會過度投資或保護不足。

關鍵要點

  • 備份保住「資料」,災難復原保住「重新運作的能力」,兩者缺一不可。
  • 3-2-1 原則是可靠備份的基準;面對勒索軟件,宜再加一份離線或不可篡改的副本。
  • RPO 決定「可接受失去多少資料」,RTO 決定「可接受停機多久」,兩者驅動整個方案設計。
  • 未經測試的備份,等於沒有備份——定期演練還原才是真正的保障。

常見備份策略與測試的重要性

在實務上,備份策略通常是幾種方式的組合,以在儲存成本與復原速度之間取得平衡:

  • 完整備份(Full):複製全部資料。還原最簡單直接,但佔用最多空間與時間,通常不會過於頻繁執行。
  • 增量備份(Incremental):只備份自上次備份以來變動的部分。省空間、速度快,但還原時需要依序套用多個備份。
  • 差異備份(Differential):備份自上次完整備份以來的所有變動。介乎兩者之間,還原比增量簡單,佔用則比完整少。

常見做法是「定期完整備份 + 頻密增量/差異備份」的組合,並保留多個歷史版本,以應付「幾天前的檔案才是好的」這類情況。

但無論策略多完善,最容易被忽略、卻最致命的一環,是測試。太多公司從未真正演練過還原,直到災難來臨才發現備份檔損壞、缺漏了關鍵資料、或還原耗時遠超預期。請謹記:你要的從來不是「備份」,而是「還原」的能力。因此應該定期進行還原演練,驗證資料完整、還原流程可行、實際時間符合 RTO,並把演練中發現的問題逐一修正。一份從未測試過的備份,只能給你虛假的安全感。

雲端在災難復原中的角色

雲端的普及,讓過去只有大企業才負擔得起的 DR 能力,變得中小企也可觸及。雲端在 DR 中主要扮演幾個角色:

  • 天然的異地備份:把備份複製到雲端,本身就滿足 3-2-1 中「異地」的要求,且不必自行建設與維護第二個機房。
  • 彈性的復原環境:災難發生時,可在雲端快速調配運算資源,臨時重建服務,避免受制於實體硬件的採購與安裝時間。
  • 按需付費、成本可控:不必為「可能永遠用不上」的備援硬件長期埋單,而是在真正需要時才擴充,較符合中小企的資源現實。
  • 地域分散:把備份與復原環境放在不同地理區域,降低單一地點天災或事故一次過癱瘓全部資源的風險。

不過,雲端不是「上了就自動安全」的萬靈丹。仍要留意權責分工(雲供應商保障基礎設施,資料與設定的備份責任通常在你一方)、還原時的網絡頻寬、以及資料合規要求。若你的系統正考慮上雲,可延伸閱讀我們關於企業系統上雲遷移指南的文章,一併規劃遷移與復原。

中小企落地建議

把上述概念化為行動,中小企可以循以下步驟務實推進:

  1. 盤點與分級資料:先弄清楚有哪些資料與系統、哪些最關鍵,並為它們分別定出合理的 RPO 與 RTO。
  2. 落實 3-2-1:確保關鍵資料至少三份副本、兩種媒介、一份異地,並考慮加入離線或不可篡改的副本以防勒索軟件。
  3. 自動化備份:盡量以自動化取代人手,減少「忘記備份」與人為出錯,並主動監控備份是否成功。
  4. 定期演練還原:把還原測試排入日程,實際驗證資料完整與時間符合目標,並修正發現的問題。
  5. 寫下 DR 計劃:明確記錄「發生災難時,由誰負責、按什麼次序、如何恢復各系統」,讓團隊在壓力下仍有章可循。
  6. 定期檢討更新:隨業務、系統與威脅演變,定期回顧計劃是否仍然適用,並持續改善。

備份與災難復原,本質上是一種對「最壞情況」的投保。平時看似多餘,真正出事時卻可能是公司能否撐過去的關鍵。當災難在非辦公時間發生,能否即時啟動復原,也與可靠的24/7 技術支援息息相關。對香港中小企而言,重點不在於一步到位建立昂貴的方案,而是先把最關鍵的資料與系統保護好,再按需要逐步完善。WeTech 以 AI-First 的方式提供技術支援與維運服務,協助企業設計、落實並定期驗證備份與 DR 安排,讓你在最壞情況下也有底氣。

想確保公司在災難面前撐得住?

WeTech 提供 AI-First 的技術支援與維運服務,協助香港企業建立可靠的備份與災難復原安排,並定期驗證還原能力。

預約免費諮詢