美国东部时间2026年9月23日,美国FDA分子与临床遗传学专家委员会就GRAIL公司的多癌种早期检测产品Galleri完成审议,三项关键投票结果分别为:10:0认为该产品具有合理的安全性保证,6:4认为其有效性具有合理保证,7:2(1票弃权)认为其临床获益超过风险。FDA的最终全国销售审批决定仍需在未来几个月内做出,但专家委员会的背书已显著提振市场信心。Guggenheim分析师Subbu Nambi对此表示,这几乎消除了风险。
Galleri的技术路线与传统液体活检不同。多数液体活检方案聚焦于寻找血液中肿瘤释放的特定基因突变,而Galleri利用的是肿瘤细胞死亡后释放进入血液的游离DNA(cfDNA)上所保留的甲基化模式。这些模式具有组织和肿瘤特异性。Galleri通过靶向甲基化测序读取这些信号,再交由机器学习模型处理。模型需要完成两项任务:判断样本中是否存在癌症信号,以及预测该信号最可能来自哪个器官。从技术和商业本质来看,GRAIL提供的并非传统意义上的检测试剂,而是一套由分子检测、算法分类和临床解释共同组成的AI癌症识别系统。
Galleri的性能数据呈现出一种克制的产品哲学。在美国PATHFINDER 2研究中,Galleri总体12个月的敏感性约为35.0%,意味着相当一部分癌症在检测时并未被发现。但另一个数据解释了FDA专家为何仍投出支持票:99.85%的特异性。在面向数千万甚至上亿普通健康人群的筛查场景中,最大的风险不是漏诊,而是假阳性。哪怕只有几个百分点的假阳性率,放大到人口级别也会制造海量恐慌,并引发大量不必要的CT、PET、内镜甚至穿刺活检,足以压垮现有医疗体系。Galleri的高特异性确保了它极少制造假警报。同时,其阳性预测值(PPV)达到约77.0%,意味着一旦报警,确诊癌症的概率已相当高。
数据显示,对于目前缺乏成熟筛查手段的12类高致死性癌症——包括胰腺癌、卵巢癌、胆道癌等——Galleri的敏感性达到约61.3%。这12类癌症造成了美国约三分之二的癌症死亡。FDA委员会明确强调,Galleri的定位是现有标准筛查手段(如乳腺钼靶、肠镜)的补充,而非替代。其目标市场是补足现有癌症筛查体系中最明显的空白。
围绕Galleri最大的争议来自规模超过14万人的英国NHS-Galleri随机对照试验。该试验试图回答一个终极公共卫生问题:将Galleri加入医疗体系,能否减少晚期(III/IV期)癌症?从严格的统计学意义上看,该试验未达到预设的主要终点。但在第二和第三轮筛查中,最致命的晚期癌症患者分别减少了22%和26%。该试验成功将原本在晚期暴露的致命癌症提前至早中期发现,促使FDA专家组以7比2的投票结果认定其获益大于风险。
在癌症早筛领域,发现得多并不等于筛查成功,因为可能存在过度诊断。真正的成功是将原本要在IV期才暴露的致命癌症提前到I/II期。这正是FDA投票出现6:4有效性分歧、却最终以7:2认定获益大于风险的核心原因。专家们认为,Galleri虽不完美,但其减少晚期癌症的潜力已经跨过了值得进入临床的门槛。
Galleri带来的是一场筛查范式的转移。过去几十年,癌症筛查按器官划分:查肺做低剂量CT,查肠做肠镜。Galleri将基本单位从器官变成了人。未来的体检可能先抽一管血进行全身信号扫描,一旦AI提示异常,再根据算法指引的器官进行定向精查。
在这一变革中,AI的应用机会才刚刚开始。纵向时间轴上的AI追踪是一个方向:癌症是动态的,如果一个人连续5年抽血,单一信号可能始终未达阳性标准,但在AI眼中,这5年的细微变化轨迹可能已经暴露了高风险趋势。打通阳性后的决策闭环是另一个方向:当血液查出异常后,患者应该先做CT还是MRI、什么时候该停止检查,未来结合病历和家族史的大语言模型与多模态AI,可能成为指导医生决策的工具。此外,GRAIL目前手握CCGA、PATHFINDER系列以及超过14万人的NHS-Galleri真实世界数据。当这些甲基化数据与患者最终的生存期、治疗方式等临床结局彻底打通,GRAIL将拥有一个不断进化的真实世界AI训练平台。
当然,AI不能无中生有。如果极早期的微小肿瘤没有向血液释放足够的cfDNA,再强的算法也无济于事。为了保障人口级别筛查的安全性,FDA目前审评的Galleri采用的是锁定的机器学习分类器,这意味着它在现阶段还不能在临床应用中每天自动更新学习。
无论如何,2026年9月23日的这场专家投票,不仅是一项血液检测产品的通关文牒。它证明了在茫茫血海中同时捕捉几十种癌症信号在技术上已经可行。如果未来几年,它能在真实世界中进一步证明可以降低癌症死亡率,并跑通商业化落地的成本测算,那么今天或许正站在未来癌症筛查新纪元的起点。