OpenAI自研芯片Jalapeño(下称“小辣椒”)从初始设计到流片仅用9个月,这是OpenAI官方披露的数字。前端设计验证工程师穆洋估算,相比没有AI辅助的传统流程,这一速度大约快了半年。但多位产业链从业者提醒,9个月只覆盖了芯片设计全流程的部分环节,若把前期的需求定义、架构规划以及后续的制造、调试与部署全链路算进去,一颗定制ASIC从立项到真正落地依然需要以年为单位。
OpenAI的造芯野心至少可以追溯到2023年,当时首席执行官奥尔特曼一度想推动30多座晶圆厂的建设。但高昂的成本和漫长的周期让这家连Fabless都不是的模型公司调整了策略。到2024年,OpenAI把重心放在自己更有优势的部分——围绕自家模型和推理服务来定义芯片需要什么。
AI在“小辣椒”项目中的参与程度,比外界想象的更深。据OpenAI披露,AI已经介入实现方案探索、“设计—测量—验证”循环以及部分算术电路优化,并继续参与芯片回片后的调试和编程。但拆解这9个月的速度会发现,博通成熟的工程能力同样是不可缺少的一块拼图。多位产业链从业者指出,博通的硅实现能力、网络互连能力、接口IP以及多年积累的工程体系,为OpenAI省去了大量从头搭建底层能力的时间。这些私有知识体系并不会随着通用大模型能力变强就自动转化为OpenAI自身的能力。
不过,这并不意味着博通的加持削弱了AI的价值。某芯片企业产品总监陆吉年强调,对第一代芯片而言,更重要的意义在于从头跑通了一套AI参与芯片设计的工作流。一旦这套流程能够复用,下一代就不用再重新摸索同样的路径,人工介入还有继续减少的空间。基于“小辣椒”结构的复杂程度,陆吉年认为9个月已经“很不错”,但OpenAI完全有能力实现6个月的设计周期。
目前OpenAI披露得最明确的,是AI已经进入RTL(寄存器传输级)这一芯片设计的核心环节。简单来说,就是芯片架构确定以后,AI开始参与把这些想法写成描述数字电路代码的过程。从未接触过这一领域的穆洋也曾靠AI完成首战——在给出性能目标、设计约束和测试要求后,她成功利用AI生成和修改某一RISC-V CPU开发项目里的RTL。
把RTL写出来只是其中一环,AI对芯片开发的另一加持在于解决了最耗费工程师时间的验证设计环节。据穆洋表述,同一项目里一项过去需要两名有经验工程师花费约4个月完成的UT(单元测试)验证任务,如今在AI加持下,她一人就能在3周左右跑完从测试点拆解到最终结果确认的整个闭环,按天数计算节省超100天,效率提升80%。
这种变化已经进入成熟芯片公司的真实开发流程。英伟达今年公开披露,已将Cadence的AI Agent用于RTL验证,使得一项过去需要5周才能完成的工作,如今只需不到一天。Cadence方面的人员透露,包括老牌FPGA企业Altera、高通、Tenstorrent在内的多家芯片公司也已开始部署类似Agent,其中Altera称部分验证工作量已压缩至约原来的十分之一。
模型能力本身的变化,也在继续拓宽AI可处理的信息形式。陆吉年提到,最新一代模型GPT-6已经具有完整的能力去读波形,对图形、空间关系等信息的理解能力进一步增强。这意味着AI能够介入的芯片设计范围,正逐渐从“怎么把电路写出来”延伸至“电路怎么在芯片上摆放和连接”。
但即使局部环节提效,芯片的完整开发周期与模型迭代速度之间仍存在难以跨越的时间鸿沟。以初代“小辣椒”为例,仅从2024年10月底项目被公开报道,到OpenAI计划于2026年底前初步部署芯片,中间就横跨约26个月。大模型从业者Jim认为,只有当AI Agent将整条开发链条进一步压缩至18个月左右,自研ASIC才具备真正的商业吸引力。
好在模型更新并不意味着硬件也得推倒重来。Jim解释,如果只是同个模型换了一套权重、部分计算方式发生调整,或者矩阵的大小和排列发生变化,通常还能通过Kernel(计算内核)、编译器和调度方式进行适配。真正让芯片设计者头疼的,是原本按某种比例匹配好的算力、内存和通信能力,可能不再适合下一代模型。
MoE(混合专家模型)就是一个典型例子。模型从稠密结构转向MoE以后,芯片要做的基础计算并没有完全改变,但数据需要在不同专家、不同芯片之间流动,通信和存储压力可能一下子变大。此外,Attention算子结构怎么变、Token未来更多是串行还是并行生成,同样可能重新改变存储、带宽和算力之间的比例。
针对“哪些能力值得固化进硬件,哪些变化可以由软件调控”,Jim认为企业最重要的是算三笔账:为了保留灵活性愿意额外付出多少面积、功耗和开发成本;这项能力未来能覆盖多少种模型和场景;专用化带来的性能和成本收益是否足以覆盖押错方向的风险。
“小辣椒”本身已经在处理这样的不确定性。OpenAI透露,项目早期曾考虑过更加偏向Decode(解码)的设计,但最终还是选择让同一块芯片同时支持Prefill和Decode两个阶段,将调整空间留给软件。在Jim看来,这恰恰也是AI正在发挥作用的另一面:AI不只是让专用芯片更快被设计出来,也在让留给软件的那部分适配变得更快、更便宜。
不过,无论软硬件如何被AI加速,最终的决策仍离不开人类的智慧。AI设计芯片企业Novasilicon创始人李林阳指出,目前AI表现优异的仍是RTL代码实现等边界清晰的任务,越往顶层的架构与规格定义走,Agent越难介入,因为连人类架构师自身都难以在这个庞大的探索空间中界定清晰的边界。结果验收同样如此——穆洋认为当前仍需要有10-15年经验的工程师来完成判断,只有等AI自身的验证和判断能力进一步成熟,才可能真正走到“小白也能做芯片”的阶段。