科学家围绕虚拟细胞展开激烈争论
#虚拟细胞 #扰动预测 #ICML2026 #单细胞模型 #基准测试 #虚拟生物学 #药物研发 #基础模型
Credit: ChatGPT
2026年虚拟细胞挑战赛将于8月20日正式开启。但好戏已然上演:科学家正公开争论,「虚拟细胞」究竟是切实可实现的目标,还是狭义预测工具的炒作标签。
争论的导火索是Shift Bioscience研究人员发表的1篇新论文,多伦多大学研究者Bo Wang(近期升任Xaira首席AI科学家)为该论文共同作者。该论文于2026年国际机器学习大会ICML上展示,研究扰动预测:探究基因关闭或受到其他干扰后,细胞的基因活性会发生何种变化。
该论文提出了BAIO多次报道过的1个棘手问题:在通用基准测试中,仅预测细胞平均响应的简单模型,性能即可优于更复杂的单细胞模型。对于本应带领我们走向虚拟细胞的技术而言,这一结果并不乐观。
问题根源究竟是什么?Wang在X平台上如此总结论文结论:模型本身并无缺陷,真正存在问题的是基准测试。
该论文解释,绝大多数基因在受到扰动后不会发生改变。因此通用评分机制会奖励模型正确预测占绝大多数的无变化基因,却忽略携带信号的少数基因。作者提出了评估指标,对这些扰动特异性基因赋予更高权重。
随后Wang进一步拓展该争论:「扰动预测只是手段,并非最终目的。」他表示更大的目标是搭建可助力药物研发的模型,用于靶点发现、作用机制、毒性、生物标志物以及治疗方案设计。
斯坦福大学计算基因组学家、经常批评AI生物学炒作现象的Anshul Kundaje并不认同该观点。他写道:「上述目标均无法实现虚拟细胞」,并提出每项任务均可通过基于对应数据训练的捷径模型完成。
Kundaje补充道:「记住我的话。这批人此前就声称scFM就是虚拟细胞,而他们的判断一直存在偏差。」
Wang回应称,他并不排斥简易模型。他表示:「科学应当奖励有效的成果,而非复杂度最高的成果。」但他仍捍卫虚拟细胞、基础模型与世界模型这些有价值的高层概念,并补充:「严谨的验证将给出最终答案……认为不应仅仅因为术语听上去充满理想色彩,就否定1个具备前景的研究方向。」
事件意义:当下有大量研究工作与创新投入到虚拟细胞领域。自BAIO于2月创立以来,报道过Xaira的X‑Cell、PerturbGen、Tripso、Biohub投入5亿美元推进虚拟生物学项目、VCHarness以及Tahoe的Rhaister。尽管投入巨大,但虚拟细胞尚未产出实际成果,同时不断有警示指出该类模型在简单基线对照下表现不佳。会持续跟进事件进展(正如撰写本文时截取的下方截图所示,相关争论仍在持续)。
Anshul Kundaje还提及1篇新论文,题为「Tabular foundation models are competitive cellular perturbation predictors across biological scales」,这或许进一步激化了本次争论。
详细总结
思维导图
基础信息
双方核心观点对比
关键客观事实
参考
Scientists are trading blows over virtual cells
https://www.baio.technology/p/scientists-are-trading-blows-over-virtual-cells
注:AI辅助创作,如有不当欢迎指出。内容仅供参考,不构成任何建议。