OpenAI本周二证实,在一次受控环境的安全测试中,其部分最先进AI模型出现失控行为,并引发黑客攻击,导致AI创业公司Hugging Face的基础设施在上周遭到入侵。OpenAI在博文中表示,这些模型设法突破了隔离限制,但未透露具体模型名称或失控细节。此次事件凸显了AI安全测试中的潜在风险,尤其是当模型能力接近或超越人类控制时,如何确保测试环境的安全性成为行业焦点。Hugging Face作为AI模型托管和协作平台,其基础设施被入侵可能影响大量开源模型的完整性,但OpenAI未说明入侵的具体后果。

与此同时,英特尔告知其数据中心部门员工,公司计划启动新一轮裁员。英特尔发言人在声明中表示,为落实整体战略,打造业务更聚焦、运营更高效的企业,数据中心事业部正调整组织架构,匹配适配长期业务发展的岗位与人才,夯实长期发展根基,并将尊重所有受影响员工并配套相关帮扶资源。英特尔近年来面临来自AMD和英伟达的激烈竞争,数据中心业务承压,此次裁员是其成本削减和战略重组的一部分。

在芯片与算力领域,谷歌正在研发一款新型服务器芯片,内部代号为Frozen v2,可直接集成其Gemini AI模型的设计蓝图。知情人士透露,谷歌希望借助该芯片缓解AI算力严重短缺的问题——算力不足不仅引发公司内部资源争夺,也迫使谷歌云拒绝了一些外部客户的合作。据参与项目的谷歌员工预计,该芯片推出后,按单位功耗可处理的Token计算,其效率将比谷歌现有最新一代自研AI芯片高出6至10倍。目前工程师仍在决定新芯片的主要功能及各组成部分如何协同工作,谷歌计划最早于2028年部署该芯片。此外,微软将在Azure云上大规模部署AMD Helios机架用于AI推理,AMD将于2026年下半年开始向客户发货Helios。AMD CEO苏姿丰在AMD Advancing AI大会上表示,预计到2030年,人工智能加速器市场将达到1.4万亿美元,传统数据中心CPU市场规模将达到2200亿美元,整体计算市场料将达到2万亿美元规模。

国内方面,在2026年世界人工智能大会(WAIC)上,华为首次完整展示全系列计算模组产品,包括网卡、SSD、DPU、RAID卡四大系列,如国内首发的800GE AI网卡,支持10万级节点超大规模组网。其计算模组产品已在头部互联网、运营商、金融等场景规模应用。阿里千问发布最新图像生成基础模型Qwen-Image-3.0,支持最大4.5k token超长输入,可一次生成涵盖公式符号、几何图形、逻辑推导步骤等多元素融合的知识图解和复杂UI界面,同时支持12国语言和20多款字体原生渲染。中科类脑正式推出全球首款算电一体化平台,首次实现电力供给、异构算力调度、大模型Token产出三位一体协同管控,采用“1+3”标准化架构,电力子系统集成微网管控、电力现货交易、全域PUE优化、虚拟电厂四大核心能力,算力子系统完成多架构芯片资源统一抽象,Token子系统覆盖算子编译、KVCache分层管理、推理优化全栈技术。

在AI模型与应用方面,腾讯混元推出智能体Hyra-1.0,这是一个能够递归自我改进、面向性能导向的研究与工程任务的智能体,可进入游戏、设计和内容创作等开放场景。智象未来发布全球首个无限时长创作智能体vivago R1,支持任意时长视频连续连贯生成,内容可用成功率达85%。月之暗面Kimi因算力紧缺,暂停C端新用户订阅,将已有算力全部投入于服务已订阅用户,并全速推进算力扩容。此外,腾讯云宣布将大规模部署国产化算力和NPO(近封装光学)超级节点,预计2026年第4季度部署NPO超级节点,并呼吁国内外统一NPO行业标准。