拓冰建站拓冰建站
首页 / 资讯中心 / 正文

病理AI换一个任务就得重训一个模型?SPARK用4个智能体以语言为接口、零训练自造分析工具,18个队列5400余例验证参数与预后/MSI/PD-L1显著相关

一、研究背景过去十年人工智能在癌症病理学中进步飞快但绝大多数系统停在同一种形态里为某一个封闭任务专门训练的预测模型。想判断淋巴结转移就训练一个淋巴结转移分类器想预测免疫治疗响应就再训练一个响应预测器。这些模型在特定指标上可以很准但有三个绕不开的硬伤。第一依赖手工特征或大量重训。传统方法要靠病理专家预先定义看什么而新一代基础模型虽然能从海量切片里学到通用组织规律但离开具体数据集和临床问题就不够准换一个任务往往又得从头微调一遍。第二黑箱且碎片化。单个模型只回答一个孤立问题要拼成一个完整分析流程就得把十几个模型拼起来中间还缺可解释性——医生说不出它为什么这么判断。第三语言模型看不懂病理图像。大语言模型LLM在文本推理上很强却无法直接处理病理切片连视觉-语言模型VLM在面对简单的定量或推理问题时也常常给出不可靠的答案。2026 年 4 月 29 日德国科隆大学医院Universitätsmedizin Köln病理研究所 Yuri Tolkach 团队在Nature Medicine发表研究给出了一条不同的路SPARKSystem of Pathology Agents for Research and Knowledge——一个由多个 AI 智能体协作、以语言为通用接口自主完成科学发现的病理框架。二、研究创新点SPARK 的核心定位是做一个病理学的大脑一组相互连接的 AI 智能体用自然语言彼此交流自主地提出、实现并验证具有生物学意义的假说——而且全程不需要额外训练模型。它和以往病理 AI 的根本区别在于把分析能力从预先写死的模型变成了现场生成的分析工具。具体有三个创新点。其一让智能体自己造工具而不是调用现成模型。研究者只要用自然语言告诉 SPARK 研究目标和可用数据它就能自主提出生物学假说并把假说转化成可执行的定量参数也就是一段能在患者队列上跑的分析代码。新任务来了它靠推理和工具构建去适应而不是重新训练。其二四个智能体分工协作语言做黏合剂。想法生成、想法精炼、参数编码、参数验证四个环节由不同智能体串联完成彼此用自然语言传递中间结果像一支分工明确的科研小组。其三保留人在回路。SPARK 额外提供一个模块允许研究者直接输入自己的假说由系统把朴素的自然语言想法转译成结构化的、可统计检验的分析方案。人机各自所长AI 负责规模化探索人负责提出方向和把关。三、技术原理SPARK 把一次从切片到科学发现拆成数据准备和智能体协作两层。数据准备层把全切片图像变成标准数字对象。原始输入是千兆像素级 HE 染色全切片图像WSI。预处理分三步多类组织分割。用器官特异的语义分割模型UNetEfficientNet 架构独立验证 Dice 系数 0.89把切片自动切成肿瘤、肿瘤基质、坏死、淋巴聚集区等不同类型。过滤肿瘤区域。只保留肿瘤 肿瘤基质核心区域排除正常组织、脂肪和空白减少噪声。单细胞检测与分类。用 HoverNext 算法勾出每个细胞核的精确边界并自动分类为病理中最关键的7 种细胞类型肿瘤细胞、淋巴细胞、中性粒细胞、嗜酸性粒细胞、巨噬细胞、成纤维细胞、浆细胞。最终输出一个统一的WSI 对象——包含组织分割掩码和完整单细胞数据坐标、边界、类型、形态这是 SPARK 所有分析的标准输入。智能体协作层四个串联模块。想法生成智能体Idea generation agent扮演首席科学家基于 OpenAI o1根据研究目标和那 7 类细胞自主提出预测生存或肿瘤进展的分析方法和假说。想法精炼智能体Idea refinement agent对生成的想法去重、过滤、打磨避免饱和后的低质重复。参数编码智能体Parameter coding agent基于 Claude Sonnet 3.5把精炼后的想法翻译成可在队列上运行的统计参数代码。参数验证智能体Parameter verification agent检验生成的参数是否真的与生物学意义、临床变量相关完成闭环。值得强调的是四个智能体之间、智能体与数据之间全部用自然语言作为通用接口。这让它既能处理结构化统计也能理解肿瘤基质里巨噬细胞的密度这类生物学语义。四、实验结果团队在18 个患者队列、5 种癌症类型肺腺癌 LUAD、肺鳞癌 LUSC、结直肠癌 COAD、乳腺癌、口咽鳞癌 OPSCC上评测覆盖5,400 余名拥有组织学图像与临床随访信息的患者并在一个特征明确的空间组学乳腺癌数据集n625上做了专项验证。SPARK 自动生成的参数与临床和生物学变量显著相关。在多个肿瘤队列中SPARK 参数与预后总生存期、已知病理变量pN 淋巴结转移状态、pT 分期以及预测性生物标志物微卫星不稳定 MSI、PD-L1 TPS 表达呈显著相关性FDR 校正后的 Spearman 检验。用这些参数训练的 XGBoost 模型在独立测试集上取得了可靠的 AUROC。能从静态切片推断时间演变。这是最出乎意料的结果之一SPARK 仅凭一张静态 HE 图像就推断出了肿瘤进展模式以及随时间变化的轨迹——把看一张图拓展成了读一段病程。人机对比AI 探索更广人提出的想法更朴素。研究者让 SPARK 处理人类直接输入的概念发现人提出的假说通常更简单、对空间信息的利用较少而 SPARK 自主生成的想法语义更多样、覆盖更广。但即便是最简朴的人提假说也能被系统转译成具有统计学意义的预后指标——这说明人提方向、AI 落地的协作模式是可行的。全部开放。论文中所有代码、参数和结果都已公开释放github.com/cpath-ukk/SPARK供研究者复现和继续深挖。五、应用前景对做医疗智能体定制的团队SPARK 打开的不是又一个诊断模型而是一类新工具会做研究的 AI 协作者。在病理科研侧它最直接的价值是加速假设生成与验证。过去一个研究生要花数月做的某类细胞密度与预后的关系分析SPARK 可以在大规模队列上批量探索并把有统计显著性的方向交回人类专家判断。这为生物标志物发现和精准肿瘤学提供了一条可扩展的路径。在方法学侧它印证了多智能体 语言接口 无需重训的范式在复杂医学图像分析上的可行性。相比为每个任务单独训练模型这种推理即工具构建的思路更灵活也更容易解释——每个参数都对应一条可追溯的生物学想法。但边界必须说清。作者明确指出SPARK 目前产出的是研究用分析工具其临床效用仍需前瞻性验证系统在病理图像之外的模态、以及更复杂的临床决策闭环上尚未覆盖。它应该被理解为科研加速器而非诊断替代。六、结论SPARK 回答了一个病理 AI 长期没解决的问题AI 能不能不只做预测而是主动去发现四个专用智能体以语言为接口协作无需额外训练就能从 HE 切片自主提出、实现并验证肿瘤生物学假说——在 18 个队列、5,400 余名患者中自动生成的参数与预后、病理变量和预测性生物标志物显著相关甚至从静态图像推断出了肿瘤的时间演变。它把病理 AI 从预测工具往前推了一步变成了一个可协作的科学发现引擎。但更清醒的结论是这一步发生在科研侧落到临床还需要前瞻性验证。对正在构建医疗智能体的团队SPARK 最值得借鉴的不是某个具体模型而是那种让智能体自己造工具、用语言串联、把人留在回路里的架构哲学。论文原文信息链接病理 AI 如何从『预测工具』进化为『科学发现引擎』SPARK 多智能体框架让 AI 自主提出并验证肿瘤生物学假说本文基于 2026 年最新论文/开源项目的独立解读立场与原作者无关仅作技术交流。参考文献Trost F, Zhang B, Aring I, Glamann L, Wessolly M, Johnson K, Göbel H, Lerbs T, Sangenne T, Herrmann P, Mairinger F, Kopp C, Michels S, Rasokat A, Heldwein M, Wagner S, Schömig-Markiefka B, Wolf J, Hartmann S, Wickenhauser C, Bychkov A, Klussmann JP, Quaas A, Buettner R, Tolkach Y. An agentic framework for autonomous scientific discovery in cancer pathology.Nature Medicine, 2026. DOI: 10.1038/s41591-026-04357-y | PMID: 42056496Chen W, Dong Y, Ding Z, et al. Interpretable agentic AI system with localized reasoning for radiology.npj Digital Medicine, 2026. DOI: 10.1038/s41746-026-02994-8 | PMID: 42457975Zhao K, Sun Q, Kang D, Yu T, Han W, Yao R, Agrawal R, Ying GS, Grzybowski A, Jin K. An autonomous multimodal AI agent for evidence-grounded ophthalmic diagnosis.Cell Reports Medicine, 2026. DOI: 10.1016/j.xcrm.2026.102969 | PMID: 42556343
分享:

看完干货,该让你的企业上线了

免费需求沟通 · 48 小时内出具建站方案 · 河南本地可上门