菏泽万能胶厂 哈佛医学院等提出泛症模型COMPASS, 平均能优于22种现有法

过去十余年,疫检查点抑制剂(immune checkpoint inhibitors, ICIs)已经改变了症疗格局,但其并非对所有患者有菏泽万能胶厂,即使接受同种疫检查点抑制剂疗,不同患者之间仍然存在明显疗差异。部分患者能够获得长期缓解,而另部分患者则几乎法产生疗响应。因此,提疫检查点抑制剂响应预测能力,并识别影响疗响应与耐药的关键机制,对于指个体化疗和患者预后至关重要。
目前,临床研究已经探索了多种预测疫疗疗的生物标志物,其中,突变负荷(TMB)、程序死亡配体 1(PD-L1)疫组织化学检测(IHC)等指标已经被用于部分临床决策,然而这些指标仍存在明显局限。随着通量测序技术的发展,RNA 测序(RNA-seq)提供了种观察疫状态的新式,但如何从数万个基因表达数据中提取真正与疗响应相关的生物学规律,仍然是项巨大挑战。
在此背景下,来自哈佛医学院、罗氏制药及浙江大学的研究团队提出种泛症基础模型(pan-cancer foundation model)COMPASS。该模型基于来自 33 种症类型的 10,184 个样本进行训练,并在 7 种症、6 种疫检查点抑制剂覆盖的 16 个临床队列中进行评估。结果显示,COMPASS 的平均能优于 22 种现有法,在不同队列中平均将预测准确率提升了 8.5,将精确率-召回率曲线下面积(area under the precision-recall curve, AUPRC)提升了 15.7。此外,COMPASS 能够泛化至在微调阶段未涉及的症类型和疗案,有望用于辅助疗适应症选择和患者分层。
相关研究成果以「Generalizable AI predicts immunotherapy outcomes across cancers and treatments」为题,已刊登 Nature Medicine。
研究亮点
COMPASS 利用概念瓶颈 Transformer(concept bottleneck transformer),基于整体转录组数据预测疫疗响应情况
COMPASS 通过 44 个具有生物学基础的疫概念对基因表达进行编码,这些概念涵盖疫细胞状态、—微环境相互作用以及信号通路等关键生物过程
COMPASS 不仅能够预测疫疗响应,还能够提供用于临床试验设计和转化医学研究的机制假设线索。
论文地址:
https://www.nature.com/articles/s41591-026-04502-7
覆盖多种、多疗案的大规模数据集
为了建立具有泛化能力的模型,研究团队并未局限于单种或单临床试验数据,而是整了多个公开数据库中的转录组数据和疫疗队列。
在模型预训练阶段,研究团队利用了症基因组图谱(The Cancer Genome Atlas,TCGA)数据库中的泛种 RNA 测序数据。初始数据包括 11,274 个样本和 60,660 个基因,经过去除正常组织样本、去除既往接受疗的样本、去除非福尔马林固定石蜡包埋(non-FFPE)样本筛选,并根据「bcr patient barcode」患者编号进行患者别聚,终选择 15,672 个蛋白编码基因作为模型输入。
随后,为了训练模型预测疫疗响应能力菏泽万能胶厂,研究团队进步收集了 16 个临床队列中 1,133 名患者的疗前整体 RNA 测序数据(bulk RNA-seq)以及临床疗结果(如下图)。
临床队列概览(该数据集涵盖了不同规模的临床队列、患者症类型、药物疗案以及疗响应结果)
这些队列覆盖 7 种症类型,包括膀胱、肾透明细胞、黑素瘤、肺腺、肺鳞、胃以及胶质母细胞瘤等;在疗案面,数据涵盖多种疫检查点抑制剂疗案,包括抗 PD-1/PD-L1 疗、抗 CTLA-4 疗以及联疗案。
不同队列规模从 16 名患者到 298 名患者不等,根据疗结果,患者被分为:
响应者(responders):346 人,占 30.5,包括缓解(complete remission)或部分缓解(partial remission)患者;
非响应者(non-responders):787 人,占 69.5 ,包括进展(progressive disease)或稳定(stable disease)患者。
该数据集覆盖了不同症适应症、疗案、测序平台以及研究设计所带来的度异质。
COMPASS 种能够跨种应用的基础模型
COMPASS 是种能够跨种应用的基础模型(pan-cancer foundation model),该模型能够从转录组数据中学习具有可解释的—疫概念(tumor-immune concepts)。COMPASS 采用概念瓶颈架构,将患者的转录组数据通过系列人类可理解的生物学概念进行映射。例如,在视网膜影像分析域,此类模型可以先预测组织和病灶图谱,再利用这些中间预测结果辅助诊断分流。
COMPASS 模型由三个主要部分组成,整体架构如下图所示:
基因语言模型(gene language model, GLM):作为模型的编码器(encoder),用于生成单个基因的上下文表征;
分层投影器(hierarchical projector):将基因层面的嵌入表示转换为层次生物学概念,包括疫细胞类型、信号通路等。;
分类器(classifier):基于概念表示完成疫疗响应预测。
COMPASS 模型架构
①基于 Transformer 的基因语言模型(Gene Language Model)
研究团队借鉴自然语言处理域 Transformer 架构,将每个基因视为个“token”,通过模型学习不同基因之间的上下文关系。不同于语言中的词语具有固定顺序,基因表达数据本质上是序的。因此,COMPASS 引入了可学习的基因位置偏置,使模型能够根据训练数据自动学习不同基因之间潜在关联。
②基于概念的分层投影器(Concept-based hierarchical projector)
COMPASS 遵循概念瓶颈(concept bottleneck)范式。在该范式中,输入数据并不是直接从潜在特征映射到预测结果,而是先经过层人类可理解的概念层。COMPASS 次将这架构引入症转录组分析域,通过利用疫相关基因集,并建立:基因(gene)→ 基因集(gene set)→ 概念(concept)的层映射关系,用于表征每位患者的疫微环境。
③预测模块(Prediction module)
COMPASS 利用这些疫概念特征,万能胶厂家对患者接受疫疗后的响应概率进行预测。同时,模型支持多种适式,包括需重新训练的样本预测(NFT)、仅调整分类层的轻量微调(LFT)、部分参数微调(PFT)以及全模型微调(FFT)。
此外,研究团队还提出了多阶段微调策略(Multi-stage Fine-tuning,MSFT)。该法先利用泛疫疗数据学习通用疫响应规律,再针对具体药物或症类型进行进步优化,从而提升模型在新疗场景中的预测能力。
COMPASS 在跨种、跨药物预测中展现优势
多项研究结果显示,COMPASS 在多个测试场景中均表现出了较强的预测能力。
1.COMPASS 在 16 个疫疗队列中实现先预测能
面对 16 个临床队列,研究人员将 COMPASS 与 22 种广泛应用于 ICI 响应预测的法进行了比较。这些法包括:单基因预测模型、疫特征评分法,以及基于网络和机器学习的预测模型,并采用准确率、精确率-召回率曲线下面积(AUPRC)、ROC曲线下面积(AUROC)和 Matthews 相关系数(MCC)指标评估模型能:
准确率(accuracy菏泽万能胶厂, )结果和精确率-召回率曲线下面积(AUPRC)结果
如上图所示,COMPASS 在所有队列规模和评价指标中均显著优于现有 ICI 响应预测法。其中,部分微调模式(COMPASS-PFT)和线探测模式(COMPASS-LFT) consistently取得的整体预测能。
与排名二的法相比:
COMPASS-PFT 和 COMPASS-LFT 平均提升了 8.5 的准确率;
平均提升了 15.7 的 AUPRC;
平均提升了 12.3 的 MCC 指标。
这些结果证明,COMPASS在疫疗响应预测面具有强的预测能力。论面对大型、中型还是小型临床队列,模型能均保持稳定,其中 COMPASS-PFT 和 COMPASS-LFT 在不同应用场景下均展现出持续优异的表现。
2.COMPASS 在疫疗队列内部及跨队列中均具备泛化能力
研究人员进步评估了在训练数据仅来自单队列的情况下,COMPASS 预测疫疗响应的准确。研究采用两种基准评估策略:队列内部留患者验证(intra-cohort leave-one-patient-out validation)和跨研究队列迁移预测(cohort-to-cohort transfer across studies)。
在队列内部验证中,COMPASS 在所有队列中均取得了佳平均能(部分结果如下图)。不过,模型表现会因具体应用场景而有所差异,在部分队列和精确率-召回率(precision-recall)比较中,已有法仍然优于 COMPASS。其中,COMPASS-PFT、COMPASS-LFT 和 COMPASS-FFT 在中型和大型队列中取得了准确率;对于小型队列(患者数量少于30人),需微调版本(COMPASS-NFT)表现佳。
COMPASS 患者表征学习策略基准评估
在跨队列迁移分析中,研究人员使用基于个队列训练的模型,预测另个不同队列中的疗响应情况,共完成:240 次两两队列迁移评估。结果显示:COMPASS-LFT 表现佳,在 240 次迁移任务中成功完成 163 次模型迁移;其次为 COMPASS-PFT,成功完成 155 次模型迁移。这表现明显优于此前发表的佳法,包括:PGM:130/240次成功迁移;Teff:118/240次成功迁移;NetBio:117/240次成功迁移,整体预测准确率和AUPRC结果如下图所示:
240 次立跨队列迁移任务中的平均准确率以及平均 AUPRC 表现
3.COMPASS 在跨疗案预测中展现出较强能力
在跨适应症预测(cross-indication prediction)任务中(如下图),COMPASS-PFT 能够识别训练数据中未包含症类型中的疗响应患者。例如:当训练数据中排除肺腺(LUAD)后,COMPASS-PFT 仍然能够在立测试队列中达到 76.5 的预测准确率。这结果表明,COMPASS 能够识别抗疫过程中具有普适的关键特征,而不是仅捕获某种症类型特异的转录变化。
模型在不同生物学场景下的泛化能力评估(跨类型泛化)
在跨疗案和跨疫检查点靶点评估中(如下图),COMPASS-PFT 同样表现出良好的泛化能力。例如:当模型仅利用抗 PD-1/PD-L1 疗队列进行训练时,COMPASS-PFT 仍能够预测抗 CTLA-4 疗患者的响应情况,并达到70.8 的准确率。这结果提示,不同疫检查点疗之间可能存在共享的疫作用机制,而 COMPASS 能够捕获这些共特征。
模型在不同生物学场景下的泛化能力评估(跨疗案泛化和跨靶点泛化)
研究还进步测试了模型在不同技术因素下的泛化能力,结果显示:COMPASS-PFT 保持稳定能,而基于基因特征签名的法容易受到测序平台和样本来源差异的影响。这表明,COMPASS 不仅能够适应复杂的临床异质,同时具备强的跨技术条件泛化能力。
结语
如今,疫疗的发展正在进入加化的新阶段。过去,临床研究多依赖单指标判断患者是否可能获益,例如 PD-L1 表达水平或 TMB,但疫系统本身是个度复杂的动态网络,仅靠单指标难以完整描述患者真实疫状态。COMPASS 提供了种新的思路:通过人工智能从大规模转录组数据中学习复杂疫模式,并将这些模式转化为可解释的生物学概念。
当然,研究团队也指出,COMPASS 目前仍属于探索工具。由于模型依赖 bulk RNA-seq 数据,其空间分辨能力有限,部分低丰度疫细胞信号可能被掩盖。同时,该模型仍需要多前瞻临床试验验证,才能真正进入临床决策体系。但从技术发展趋势来看,COMPASS 代表了种重要向——未来的医疗 AI 不应只是提预测准确率,需要帮助医生理解机制,并为个体化疗提供加透明、可靠的依据。相关词条:铁皮保温 塑料挤出机 钢绞线 玻璃卷毡厂家 保温护角专用胶
奥力斯 泡沫板橡塑板专用胶报价 联系人:王经理 手机:18232851235(微信同号) 地址:河北省任丘市北辛庄乡南代河工业区
1.本网站以及本平台支持关于《新广告法》实施的“极限词“用语属“违词”的规定,并在网站的各个栏目、产品主图、详情页等描述中规避“违禁词”。
2.本店欢迎所有用户指出有“违禁词”“广告法”出现的地方,并积极配合修改。
3.凡用户访问本网页,均表示默认详情页的描述,不支持任何以极限化“违禁词”“广告法”为借口理由投诉违反《新广告法》,以此来变相勒索商家索要赔偿的违法恶意行为。
