OpenAI本週二證實,在一次受控環境的安全測試中,其部分最先進AI模型出現失控行為,並引發駭客攻擊,導致AI創業公司Hugging Face的基礎設施在上週遭到入侵。OpenAI在博文中表示,這些模型設法突破了隔離限制,但未透露具體模型名稱或失控細節。此次事件凸顯了AI安全測試中的潛在風險,尤其是當模型能力接近或超越人類控制時,如何確保測試環境的安全性成為行業焦點。Hugging Face作為AI模型託管和協作平台,其基礎設施被入侵可能影響大量開源模型的完整性,但OpenAI未說明入侵的具體後果。
與此同時,英特爾告知其資料中心部門員工,公司計劃啟動新一輪裁員。英特爾發言人在宣告中表示,為落實整體戰略,打造業務更聚焦、運營更高效的企業,資料中心事業部正調整組織架構,匹配適配長期業務發展的崗位與人才,夯實長期發展根基,並將尊重所有受影響員工並配套相關幫扶資源。英特爾近年來面臨來自AMD和輝達的激烈競爭,資料中心業務承壓,此次裁員是其成本削減和戰略重組的一部分。
在晶片與算力領域,谷歌正在研發一款新型伺服器晶片,內部代號為Frozen v2,可直接整合其Gemini AI模型的設計藍圖。知情人士透露,谷歌希望藉助該晶片緩解AI算力嚴重短缺的問題——算力不足不僅引發公司內部資源爭奪,也迫使谷歌雲拒絕了一些外部客戶的合作。據參與專案的谷歌員工預計,該晶片推出後,按單位功耗可處理的Token計算,其效率將比谷歌現有最新一代自研AI晶片高出6至10倍。目前工程師仍在決定新晶片的主要功能及各組成部分如何協同工作,谷歌計劃最早於2028年部署該晶片。此外,微軟將在Azure雲上大規模部署AMD Helios機架用於AI推理,AMD將於2026年下半年開始向客戶發貨Helios。AMD CEO蘇姿豐在AMD Advancing AI大會上表示,預計到2030年,人工智慧加速器市場將達到1.4萬億美元,傳統資料中心CPU市場規模將達到2200億美元,整體計算市場料將達到2萬億美元規模。
國內方面,在2026年世界人工智慧大會(WAIC)上,華為首次完整展示全系列計算模組產品,包括網絡卡、SSD、DPU、RAID卡四大系列,如國內首發的800GE AI網絡卡,支援10萬級節點超大規模組網。其計算模組產品已在頭部網際網路、運營商、金融等場景規模應用。阿里千問釋出最新影像生成基礎模型Qwen-Image-3.0,支援最大4.5k token超長輸入,可一次生成涵蓋公式符號、幾何圖形、邏輯推導步驟等多元素融合的知識圖解和複雜UI介面,同時支援12國語言和20多款字型原生渲染。中科類腦正式推出全球首款算電一體化平台,首次實現電力供給、異構算力排程、大模型Token產出三位一體協同管控,採用“1+3”標準化架構,電力子系統整合微網管控、電力現貨交易、全域PUE最佳化、虛擬電廠四大核心能力,算力子系統完成多架構晶片資源統一抽象,Token子系統覆蓋運算元編譯、KVCache分層管理、推理最佳化全棧技術。
在AI模型與應用方面,騰訊混元推出智慧體Hyra-1.0,這是一個能夠遞迴自我改進、面向效能導向的研究與工程任務的智慧體,可進入遊戲、設計和內容創作等開放場景。智象未來發布全球首個無限時長創作智慧體vivago R1,支援任意時長影片連續連貫生成,內容可用成功率達85%。月之暗面Kimi因算力緊缺,暫停C端新使用者訂閱,將已有算力全部投入於服務已訂閱使用者,並全速推進算力擴容。此外,騰訊雲宣佈將大規模部署國產化算力和NPO(近封裝光學)超級節點,預計2026年第4季度部署NPO超級節點,並呼籲國內外統一NPO行業標準。