數據中心小零件釀大危機 不明故障頻生 歸咎晶片太複雜
原文刊於信報財經新聞「StartupBeat創科鬥室」

研究人員相信,巨型科企近年的硬件錯誤,與處理器設計複雜和廠方測試不足等因素有關。(Google圖片)
數據中心支撐全球科網運作,但任何高科技設備中的零部件都可能存在技術失誤,而且往往要在爆出嚴重事故後,隱藏漏洞才會浮現。美國《紐約時報》報道,近年雲端網絡龐大複雜,不少巨企擔心數據中心伺服器的晶片不夠可靠,隨時引發不明硬件故障,甚至釀成大規模系統癱瘓。
Google年均4%伺服器意外關機
《紐約時報》引述史丹福大學一位電機工程師Subhasish Mitra指出,大型科網平台系統故障,問題較多出於伺服器硬件運作錯誤,而根源來自底層硬件,包括晶片。
早於2015年,工程界權威刊物IEEE Spectrum引述一份研究報告提到,Google數以百萬計伺服器硬件中,每年平均有4%因一些無法偵測的錯誤而意外關機。

社交平台Facebook有研究員認為,微型開關愈來愈容易磨損,令電腦記憶體及處理器的壽命比以前更短。 (Meta網上圖片)
報告提到,在一枚擁有數十億個晶體管的微處理器或電腦記憶體中,每一個可以儲存0和1(電腦最原始基本語言)的微型開關(Tiny Switches),只要出現任何微小錯誤,都足以拖垮每秒執行數十億次運算的電腦系統。社交平台Facebook有研究員認為,微型開關愈來愈容易磨損,令電腦記憶體及處理器的壽命比以前更短。
一直以來,設計電腦的科學家都希望透過添加特殊電路,偵測及自動修正不良數據。然而,Google近年接報一些難以診斷的硬件錯誤,部分只會在某些特定條件下,例如運算速度或溫度產生變化時出現。研究人員相信,這跟處理器設計愈見複雜、晶體管愈趨細小,以及廠方測試不足等因素有關。

Google數以百萬計伺服器硬件中,每年平均有4%因一些無法偵測的錯誤而意外關機。(Google網上圖片)
助測錯誤監控軟件需求飆
美國晶片商超微半導體(AMD)前年的一份報告,認為DDR4記憶體晶片的可靠程度反而比起上一代的DDR3產品差5.5倍。電腦製造商聯想(00992)曾告知客戶,美國晶片生產商英特爾(Intel)新一代處理器可能比上代產品暗藏更多難以修正的錯誤。
針對硬件錯誤漸趨頻繁,《紐約時報》指出,一些能夠監控晶片健康狀況和硬件錯誤的新型軟件,需求大大增加。此外,英特爾已啟動一個新項目,透過開源軟件協助數據中心營運商,偵測和修正晶片電路未偵測的硬件錯誤,並且改變處理器的設計。

設計電腦的科學家都希望透過添加特殊電路,偵測及自動修正不良數據。(Google網上圖片)
支持EJ Tech
如欲投稿、報料,發布新聞稿或採訪通知,按這裏聯絡我們。
Related Posts
Latest News
-
AI趨勢|OpenAI多地推AI代理工具Operator
聊天機械人ChatGPT開發商OpenAI在社交平台發文表示,正在向澳洲、巴西、加拿大、印度、日本、新加坡、南韓、英國等地的ChatGPT Pro用戶推出人工智能(AI)代理工具「Operator」,可以代表用戶執行任務。
- Posted February 21, 2025
- 0
-
AI大戰丨OpenAI擬下周推GPT-4.5 GPT-5或5月登場
美國傳媒報道,OpenAI將最快下周公布其最新人工智能(AI)模型GPT-4.5,而GPT-5則有望於5月下旬發布。更新後的GPT-5將對ChatGPT的使用方式進行重大改進,統一OpenAI的o系列和GPT系列模型,減少使用者選擇模型的困惑。
- Posted February 21, 2025
- 0
-
AI Pin|襟章策略失利 新星初創被HP收購
美國科技巨企惠普(HP)擬斥資1.16億美元(約9億港元),收購當地初創Humane大部分股權,接收對方多數員工、人工智能(AI)平台Cosmos,以及超過300項專利權,有關交易預計本月底完成。
- Posted February 21, 2025
- 0
-
全新視角觀賞熊貓寶寶生活(林國誠)
「熊貓TV」正式進入第二階段,新增設置於「大熊貓之旅」的6支鏡頭並引入多項嶄新功能,讓市民能以全新視角、多角度、更自由的方式觀賞「盈盈」、「樂樂」,以及牠們的龍鳳胎寶寶「家姐」與「細佬」的生活點滴。隨着這些升級功能的推出,熊貓熱潮勢必再掀高潮!
- Posted February 21, 2025
- 0
-
進軍電玩界|微軟推Muse動作模型 生成式AI闖遊戲開發
利用生成式人工智能(Generative AI),有助改革創新工業發展。微軟(Microsoft)研究團隊介紹一款名為Muse的「世界及人類動作模型」(WHAM),有關成果由微軟研究院旗下「遊戲智能」、「可教學AI體驗」兩組人員,跟英國劍橋遊戲開發工作室Ninja Theory合作完成。
- Posted February 21, 2025
- 0
-
理大夥中移香港拓6G應用
香港理工大學與中國移動(香港)創新研究院達成合作協議,並簽署合作備忘錄及合作項目協議。校長滕錦光(後排左二)稱,今次合作充分發揮學術界與業界的協同優勢,雙方將聚焦戰略性的科技領域,包括人工智能(AI)、6G及Web3等範疇的技術革新及應用。
- Posted February 21, 2025
- 0
-
Apple新機|iPhone 16e今預訂 入門版售5099元
Apple 發布最新款智能手機iPhone 16e,搭載最新一代A18晶片及4核心圖像處理器(GPU),可流暢運行Apple Intelligence,例如AI寫作工具、Genmoji、Image Playground等人工智能(AI)功能。
- Posted February 21, 2025
- 0
EJ Tech Video
POPULAR POSTS
-
Grok 3|馬斯克「最醒」AI模型登場 Grok 3香港可用 月費170元
-
點語成丹青|港首辦成語變畫作AI比賽 120間中小學參與 收逾千作品
-
AI「炒散」|AI模型接編程散工 獨立開發力遜人類
-
EzyGreenPak|環保袋減廢遇熱水即溶 港EzyGreenPak專利 今屆渣馬採用
-
EzyGreenPak|自家平台監控碳排 助家族工廠轉型
-
DeepSeek|據報新增互聯網訊息服務
-
AI大戰|馬斯克聊天機械人Grok 3亮相 稱性能勝DeepSeek
-
神經元記錄|哈佛研CMOS矽晶片 記錄神經細胞活動
-
X危機?|馬斯克旗下X傳以3432億估值洽融資
-
AI研究院|理大成立「人工智能+研究院」