Positron AI 于 2026 年 9 月 10 日宣布完成 8.75 亿美元 C 轮融资,投后估值达 50 亿美元。本轮由 NEA、Atreides Management、Valor Equity Partners、Andra Capital、Dylan Patel 旗下的 SemiAnalysis Capital 以及 Silicon Graphics 与 Netscape 创始人 Jim Clark 联合领投。作为融资安排的一部分,NEA 的 Forest Baskett、Atreides Management 的 Gavin Baker、Jim Clark Office 的 Thomas Jermoluk 以及 Dylan Patel 将加入 Positron 董事会。
本轮融资分两批完成。C 轮为 3.75 亿美元,投前估值 35 亿美元,由 NEA、Andra Capital、Atreides Management、Valor Equity Partners 和 SemiAnalysis Capital 联合领投;C-1 轮规模最高 5 亿美元,由 NEA 和 Jim Clark 领投。其他投资方包括 DFJ Growth、卡塔尔投资局(QIA)、Resilience Reserve、Arena Private Wealth、Natural Capital、Helena、1517 Fund、Flume Ventures、Unless、Boardman Bay Capital Management、Fincadia Advisors、Banyan Ventures、U First Capital,以及战略投资方 VentureTech Alliance、Hudson River Trading、Cisco Investments 和 Naver Ventures。
资金用途明确指向三个方向:为下一代芯片 Asimov 的流片提供全额资金;建设一座 2MW 以上的工程数据中心与仿真平台;以及推动下一代推理系统 Titan 的量产爬坡,涵盖 LPDDR5X 内存供应承诺、产能建设、系统集成和市场化拓展。
Positron 的核心逻辑是「内存优先」的推理架构。公司认为,AI 的重心正从训练模型转向运行模型——每一个智能体、助手和 copilot 都依赖推理,而规模化满足这一需求正日益受限于内存容量、内存带宽和功耗。Positron 的下一代系统可实现其可用内存带宽的 90% 以上,并基于通用 LPDDR5X 内存构建,从而绕开供应紧张的 HBM 和 CoWoS 供应链,在每美元 token 数和每瓦 token 数上取得领先。由于架构能效较高,其产品可部署在风冷或液冷数据中心,适应不同机架密度。
从产品节奏看,Asimov 将于 2026 年底在 台积电 N3P 工艺上流片,2027 年下半年量产,每颗芯片搭配 288GB 至 2304GB 内存。Titan 则将 4 至 8 颗 Asimov 芯片集成到单一系统中,设计目标是在单节点内服务超过 16 万亿参数的模型和超过 1000 万 token 的上下文窗口,并可扩展至数千节点。
部署方面,Positron 正在甲骨文云基础设施(OCI)部署超过 50 机架的第一代推理系统 Atlas。合作伙伴 Parasail 利用该算力运行其自有推理服务。Atlas 的其他生产客户还包括 Jump Trading 和 i3d.net。
Positron CEO Mitesh Agrawal 表示,速度在这个市场至关重要,既包括新代芯片的出货速度,也包括触达客户的速度;规模化部署 Atlas 让公司深入了解了推理客户的实际需求,并将这些经验直接带入 Asimov 和 Titan。当前重点是完成 Asimov 流片、推动 Titan 量产并扩大制造以满足需求,本轮融资为此提供了资源。
Jim Clark 评论称,Positron 的推理架构在算力、所需的海量内存带宽以及超大上下文和权重存储之间取得了平衡,其优化的功耗、成本和密度,对于参数规模达数万亿的下一代前沿大语言模型的推理需求而言接近理想状态。
从产业视角看,这笔融资反映出推理算力赛道正在吸引大额资本。与依赖 HBM 和 CoWoS 的 GPU 路线不同,Positron 选择 LPDDR5X 作为内存基础,试图在供应链约束和能效上建立差异化。若 Asimov 按计划在 2026 年底流片、2027 年下半年量产,其能否在台积电 N3P 产能分配、LPDDR5X 供应保障以及超长上下文推理的实际性能上兑现承诺,将是观察这一路线能否规模化的关键节点。