
Artur Debat/Getty Images
現代企業的斷鏈故障會像骨牌一樣跨部門擴散,但傳統高階主管往往只各自處理局部問題,陷入無人統籌整體復原的困境。為此,企業開始設立「韌性長」,將韌性從營運成本升級為治理戰略,確保組織在不利情況下仍能維持關鍵職能並存活下來。
當造成斷鏈的事件衝擊現代企業時,最大的損害往往不是來自最初事件,而是故障如何在相互連結的系統之間擴散。技術故障會使數位基礎設施停擺,而停擺又會中斷營運、延誤產品與服務交付,並對顧客造成影響。隨之而來的還有財務損失與法規後果。每項故障或許始於某個特定系統,影響卻會擴及整個組織。
2024年7月,CrowdStrike軟體全球停擺,讓這個問題成為焦點。CrowdStrike的Falcon軟體進行例行更新,卻在全球航空公司、醫院與物流系統引發連鎖故障,估計影響850萬台微軟(Microsoft)裝置,造成龐大財務損失。各技術團隊分別修復受影響的系統,但復原進度不一、延宕許久。挑戰不只在於找出中斷原因,更在於跨越營運、科技與組織界線,協調復原工作。然而沒有任何一位高階主管負責確保組織的關鍵職能,以整合系統的方式恢復運作。
這項缺口反映出多數組織的結構性現實。風險主管評估威脅、風險曝險與法遵狀況;資安主管保護數位基礎設施;營運主管確保正常情況下的營運表現;策略主管著眼於長期成長;永續主管處理環境與法規方面的依賴關係。每個角色都不可或缺。然而,沒有人對企業韌性負責,也就是在斷鏈事件同時影響多個系統時,...

