内容提要
COMPASS是一种泛癌症AI基础模型,基于33种癌症的转录组数据训练,用于预测免疫检查点抑制剂治疗响应。该模型通过44个生物学概念编码基因表达,在16个临床队列中优于22种现有方法,准确率提升8.5%,AUPRC提升15.7%,并能泛化至未涉及的癌症类型和治疗方案,为个体化治疗提供可解释的机制线索。
延伸解读
从单一指标到系统建模:COMPASS的预测逻辑
传统生物标志物如TMB和PD-L1表达只能反映肿瘤免疫状态的某个侧面,而COMPASS通过44个生物学概念(如免疫细胞状态、信号通路)对转录组进行编码,将数万个基因的表达模式转化为可解释的中间层。这种设计不仅提升了预测性能,还提供了机制层面的线索,有助于理解为何某些患者对免疫治疗响应更好。
跨癌种与跨治疗方案的泛化能力
COMPASS在未参与微调的癌症类型(如肺腺癌)和治疗方案(如抗CTLA-4)中仍能保持较高准确率,表明其捕获了免疫治疗响应的共性特征。这提示不同癌症和免疫检查点抑制剂之间可能存在共享的免疫机制,为拓展模型应用范围提供了依据,但需注意其在不同队列中的表现仍有差异。
模型局限与临床转化挑战
研究指出,COMPASS依赖bulk RNA-seq数据,空间分辨率有限,可能掩盖低丰度免疫细胞信号。此外,模型目前仍属探索性工具,需前瞻性临床试验验证才能进入临床决策。因此,在解读预测结果时,应结合其他临床指标,并警惕模型在特定亚群中的不确定性。
Q&A
COMPASS模型是什么?它有什么主要功能?
COMPASS是一种泛癌症AI基础模型,基于33种癌症类型的转录组数据训练,用于预测免疫检查点抑制剂治疗响应。它通过44个生物学概念编码基因表达,在16个临床队列中优于22种现有方法,并能泛化至未涉及的癌症类型和治疗方案。
COMPASS模型是如何训练的?使用了哪些数据?
COMPASS在预训练阶段使用了TCGA数据库中的泛癌种RNA测序数据,包括11,274个样本和60,660个基因,经筛选后使用15,672个蛋白编码基因。微调阶段使用了16个临床队列中1,133名患者的治疗前整体RNA测序数据及临床治疗结果。
COMPASS模型相比现有方法性能提升了多少?
COMPASS在16个临床队列中平均将预测准确率提升了8.5%,AUPRC提升了15.7%,MCC指标提升了12.3%。
COMPASS模型在跨癌种和跨治疗方案预测中表现如何?
COMPASS在跨适应症预测中,当训练数据排除肺腺癌后,仍能达到76.5%的准确率;在跨治疗方案预测中,仅用抗PD-1/PD-L1数据训练,预测抗CTLA-4治疗响应准确率达70.8%。这表明其具有较强的泛化能力。
COMPASS模型的可解释性体现在哪里?
COMPASS采用概念瓶颈架构,通过44个具有生物学基础的免疫概念(如免疫细胞状态、肿瘤-微环境相互作用、信号通路)对基因表达进行编码,使预测结果可解释,并提供机制假设线索。
COMPASS模型目前有哪些局限性?
COMPASS依赖bulk RNA-seq数据,空间分辨能力有限,可能掩盖低丰度免疫细胞信号;且需要更多前瞻性临床试验验证才能进入临床决策体系。
COMPASS模型有哪些不同的微调方式?
COMPASS支持多种适配方式,包括无需重新训练的零样本预测(NFT)、仅调整分类层的轻量微调(LFT)、部分参数微调(PFT)以及全模型微调(FFT),并提出了多阶段微调策略(MSFT)。