AI行业在争相解决“缺电”问题的同时,一个更隐蔽的“电脏”难题正成为算力稳定性的隐形杀手。所谓“电脏”,指的是电压暂降、谐波等毫秒级电能质量扰动——它们不构成停电,却足以让训练中断、硬件损坏,而这一成本往往未计入算力账单。
据行业测算,2026年全球AI数据中心用电量将达945TWh,美国弗吉尼亚州新建数据中心并网排队长达3至5年,国内智算规模已达78万PFLOPS,电力变压器交付周期拉长至12至18个月。然而,这些“量”的问题尚可通过排队和投资解决,真正棘手的是“质”的问题:电压暂降持续10毫秒至2秒,虽不触发停电统计,却足以让GPU集群错乱。亚洲电能质量联盟2015年对200个用户的监测显示,电压不稳占全部电能质量事件的89.2%,工业用户年均遭遇20.5次。
单次电压暂降的直接损失或许有限,但级联效应惊人。以万卡H100集群为例,按GMI Cloud租价每卡每小时2至3.9美元折算,断电一次上限损失约15万至28万元人民币;若checkpoint损坏、硬件损坏并触发违约金,损失可超200万元。头部玩家早已将断电视为常态:Meta在2024年训练LLaMA-3时,1.6万张H100在54天内中断466次,其中419次非预期,平均每3小时一次,恢复目标控制在10分钟内。
讽刺的是,半导体晶圆厂有SEMI F47标准,要求设备扛住0.5个周期(约8至10毫秒)的电压暂降,而数据中心却无对等标准。更关键的是,UPS并非万能:英伟达GB300 NVL72电源架已集成能量存储,每GPU提供65焦耳,峰值电网需求降低约30%;GB200则内置超级电容。这些设计绕开了UPS的后段保护,因为UPS在毫秒级脉冲面前反应不及。历史案例也证明UPS可能失效:2016年AWS悉尼因超长电压暂降导致DRUPS打穿;2025年3月Google Cloud us-east5-c因电压骤升宕机约6小时。
电网层面,2024年7月北弗吉尼亚一次避雷器故障引发6次电压凹陷,虽在ANSI C84.1标准带内,却导致约60个数据中心的UPS集体切换,82秒内约1.5GW负载从PJM电网消失,频率飙升,电网紧急切除发电。2025年2月,约40家数据中心同步脱网,PJM频率冲至60.047Hz,NERC成立大型负荷工作组,FERC启动专项调查。GPU开关电源的谐波畸变率(THD)达5%,与UPS电容谐振可致变压器过热、继电保护误动。国内统计显示,2025年约32%的数据中心非计划宕机与晃电相关。
中国电网虽稳,但同样面临“电脏”挑战。2024年全国用户平均停电6.71小时/户,供电可靠率99.924%,优于美国;但电压暂降并不计入停电统计。2026年4月,发改委、国家能源局印发《全面提升供电质量服务新质生产力发展专项行动方案(2026-2028)》,点名“算力设施”。能源局市场监管司司长郝瑞锋直言,2025年上海、海南等地出现电压暂降影响企业生产。南方电网梳理出芯片制造等21个敏感行业。制造业已有前车之鉴:广州粤芯半导体2019年投产初期每年因电压暂降损失超百万元;深圳对TCL华星光电一次60毫秒暂降主动预警。西部乌兰察布零碳智算基地已部署高压静止无功发生器(SVG)进行毫秒级补偿。
产业链正分层填补“电脏”缺口:板卡级瞬态由超级电容(LIC)应对,英伟达GB300已标配,单柜数百颗,光大证券预计2030年AIDC超级电容市场约255亿元;机柜级秒级至120秒桥接由电池备份单元(BBU)承担;机房级备电由UPS/高压直流(HVDC)负责,国投证券预计HVDC市场从2025年32亿元增至2030年728亿元(CAGR约86%);进线级由动态电压恢复器(DVR)和SVG/APF治理谐波。民生证券测算,全球数据中心电能质量设备市场2024至2026年分别为48/60/76亿元,CAGR约26%;长城证券预计2026年全行业电能质量治理全球3319亿元、中国635亿元。
个股层面,盛弘股份已兑现业绩:电能质量业务2025上半年收入2.8亿元(+11.42%),毛利率58.66%,占总营收约20.5%,处于AIDC低压设备第一梯队。警示案例是爱科赛博和新风光:爱科赛博电能质量控制设备2024年收入1.59亿元(-4.53%),毛利率26.54%,当年归母净利-47%;新风光电能质量类产品占2025年营收47.17%(约9.5亿元),但归母净利-47%,电网侧SVG需求下滑。灿能电力(北交所)主营电能质量在线监测,2025年营收1.27亿元(+8.95%),净利2513万元(+2.74%)。
业内观点认为,电能质量设备市场虽小(约76亿元),但具备高增速、高毛利、格局集中的特点,类似“维生素”般的刚需。然而,爱科赛博和新风光的教训表明,概念若不兑现,故事便只是故事。随着AI算力规模持续扩大,电能质量问题将愈发突出,这一“看不见的算力标准”或将成为产业链新的增长点。