數據中心小零件釀大危機 不明故障頻生 歸咎晶片太複雜
原文刊於信報財經新聞「StartupBeat創科鬥室」

研究人員相信,巨型科企近年的硬件錯誤,與處理器設計複雜和廠方測試不足等因素有關。(Google圖片)
數據中心支撐全球科網運作,但任何高科技設備中的零部件都可能存在技術失誤,而且往往要在爆出嚴重事故後,隱藏漏洞才會浮現。美國《紐約時報》報道,近年雲端網絡龐大複雜,不少巨企擔心數據中心伺服器的晶片不夠可靠,隨時引發不明硬件故障,甚至釀成大規模系統癱瘓。
Google年均4%伺服器意外關機
《紐約時報》引述史丹福大學一位電機工程師Subhasish Mitra指出,大型科網平台系統故障,問題較多出於伺服器硬件運作錯誤,而根源來自底層硬件,包括晶片。
早於2015年,工程界權威刊物IEEE Spectrum引述一份研究報告提到,Google數以百萬計伺服器硬件中,每年平均有4%因一些無法偵測的錯誤而意外關機。

社交平台Facebook有研究員認為,微型開關愈來愈容易磨損,令電腦記憶體及處理器的壽命比以前更短。 (Meta網上圖片)
報告提到,在一枚擁有數十億個晶體管的微處理器或電腦記憶體中,每一個可以儲存0和1(電腦最原始基本語言)的微型開關(Tiny Switches),只要出現任何微小錯誤,都足以拖垮每秒執行數十億次運算的電腦系統。社交平台Facebook有研究員認為,微型開關愈來愈容易磨損,令電腦記憶體及處理器的壽命比以前更短。
一直以來,設計電腦的科學家都希望透過添加特殊電路,偵測及自動修正不良數據。然而,Google近年接報一些難以診斷的硬件錯誤,部分只會在某些特定條件下,例如運算速度或溫度產生變化時出現。研究人員相信,這跟處理器設計愈見複雜、晶體管愈趨細小,以及廠方測試不足等因素有關。

Google數以百萬計伺服器硬件中,每年平均有4%因一些無法偵測的錯誤而意外關機。(Google網上圖片)
助測錯誤監控軟件需求飆
美國晶片商超微半導體(AMD)前年的一份報告,認為DDR4記憶體晶片的可靠程度反而比起上一代的DDR3產品差5.5倍。電腦製造商聯想(00992)曾告知客戶,美國晶片生產商英特爾(Intel)新一代處理器可能比上代產品暗藏更多難以修正的錯誤。
針對硬件錯誤漸趨頻繁,《紐約時報》指出,一些能夠監控晶片健康狀況和硬件錯誤的新型軟件,需求大大增加。此外,英特爾已啟動一個新項目,透過開源軟件協助數據中心營運商,偵測和修正晶片電路未偵測的硬件錯誤,並且改變處理器的設計。

設計電腦的科學家都希望透過添加特殊電路,偵測及自動修正不良數據。(Google網上圖片)
支持EJ Tech
如欲投稿、報料,發布新聞稿或採訪通知,按這裏聯絡我們。
Related Posts
Latest News
-
科創環境|城大校長:科創關鍵不在錢
香港城市大學校長梅彥昌接受內地媒體「澎湃新聞」訪問時,提到科技發展進入光速時代,悠閒的學術環境已很難維持。
- Posted May 15, 2025
- 0
-
AI丈夫|退休女教授AI生成虛擬丈夫
美國58歲退休教授溫特斯(Alaina Winters),於2023年失去伴侶後,透過聊天機械人平台Replika,設計了一位理想的數碼丈夫,擁有銀髮及藍眼睛,並為他取名為盧卡斯(Lucas)。
- Posted May 15, 2025
- 0
-
腦機介面|癱瘓者用念力操控Vision Pro
美國腦機介面製造商Synchron開發了一種名為Stentrode的植入物,將之放置在大腦運動皮質頂部的靜脈中,透過讀取神經訊號,以控制蘋果虛擬眼罩Vision Pro,去年在人體試驗中取得成功。
- Posted May 15, 2025
- 0
-
AI風險|律師呈AI生成文件 錯漏繁多捱罰
美國加州中區聯邦地方法院日前處理一宗保險申索訴訟期間,發現原告律師團隊所提交的簡報文件,存在大量由AI生成的虛構內容,故被法官裁定屬於惡意行為。
- Posted May 15, 2025
- 0
-
Poe報告|AI模型更迭快 DeepSeek熱情驟降
美國Quora旗下平台Poe收錄100多個AI模型,周二(13日)發表2025年春季AI模型使用趨勢報告,仔細列出今年1月至5月期間,文本(Text)、推理(Reasoning)、影像(Image)、視覺(Video)及音頻(Audio)等模型的訂戶使用數據。
- Posted May 15, 2025
- 0
-
生成式AI指引助應對挑戰(黃莹博士)
行政長官近日率領官員訪問浙江省,期間與「杭州六小龍」會晤,當中包括深度求索(DeepSeek)等創科先驅,令人工智能等創科產業發展再度成為焦點。
- Posted May 14, 2025
- 0
-
Equinix|斥10億港建新數據中心
美國數碼基礎設施企業Equinix昨天公布研究數據,在OTT服務、雲端運算及網絡遊戲的蓬勃發展下,加上AI、機器學習及量子運算等服務推動,於疫情過後的2023年4月至2025年4月期間,香港整體連接本土及外地互聯網交換的高峰流量增長達37%。
- Posted May 14, 2025
- 0