2026-09-09 10:44 1002 次浏览

谷歌AI新模型一口气评估90亿种基因变异,罕见病诊断迎来突破

谷歌发布AI模型,可一次性评估约9000种基因变异对蛋白质功能的影响,为罕见病研究提供新工具,有望加速诊断与治疗。

AI模型实现大规模基因变异功能预测

谷歌近期公布了一项人工智能研究进展,其构建的模型能够一次性评估约90亿种DNA变化对蛋白质功能的影响。这一能力远超传统实验方法,后者通常只能针对少数变异进行逐一验证。该模型基于深度学习技术,通过分析基因序列与蛋白质结构之间的关联,预测单个核苷酸改变可能引发的功能后果,从而为罕见遗传病的机制研究提供高并发的筛选手段。

在遗传病领域,许多罕见病由单个基因的特定变异导致,但变异是否致病往往需要结合临床数据与实验证据判断。谷歌此次推出的AI工具,将变异影响评估的规模从数千种提升至数十亿量级,意味着研究人员可以在更短的时间内缩小候选致病位点的范围,尤其适用于那些患者数量少、表型复杂的罕见病研究。

技术路径与行业背景

该模型的设计思路与蛋白质语言模型类似,它利用大规模无标注的蛋白质序列进行预训练,学习氨基酸序列与功能之间的隐含规则,随后针对变异效应预测任务进行微调。与同类工具相比,其核心优势在于覆盖范围:模型不仅评估错义突变,还能处理剪接位点、非编码区等更广泛的DNA变化类型,从而提供更全面的基因组解读。

近年来,AI在基因组学中的应用日益深入。从AlphaFold解决蛋白质结构预测,到DeepVariant提高测序变异检出精度,谷歌一直试图将通用AI能力迁移至生物医学场景。此次发布的新模型,被视为其向临床遗传学渗透的又一布局。与此同时,其他科技企业与研究机构也在开发类似的变异效应预测工具,但大多受限于训练数据规模或计算资源,难以达到同等量级的评估能力。

对罕见病研究与临床诊断的潜在影响

对于罕见病群体而言,基因诊断是漫长求医过程中的关键一环。目前仍有大量患者无法获得明确的遗传学解释,部分原因在于临床实验室难以对检出的未知变异进行功能分类。谷歌此次展示的大规模预测能力,有望帮助实验室将变异解读的优先级排序,减少对动物实验或细胞系实验的依赖,从而降低诊断成本与周期。

不过,专家也指出,AI预测结果仅为功能影响提供概率性证据,并不能直接等同于致病性判定。临床决策仍需结合家族共分离数据、患者表型以及ACMG指南等综合评估。此外,模型在训练数据中可能存在的群体偏差,也会影响其对不同族裔变异的预测准确性,这需要在推广应用中谨慎处理。

未来展望

谷歌表示,下一步将开放该模型的API或数据库,供科研与临床机构使用,并计划与更多罕见病中心合作,验证其在实际诊断流程中的效用。随着模型不断迭代,预计其预测精度与解释性将进一步提升,未来或可覆盖全基因组范围的变异解读。

从技术演进看,AI正在从单点工具走向系统化平台,基因变异解读有望从“人工查阅数据库”过渡到“AI辅助决策”。这一变化不仅影响罕见病领域,也可能为肿瘤精准用药、药物不良反应预测等更广泛的医学场景带来新范式。然而,如何将模型输出转化为临床可操作的证据,仍需跨学科协作与监管框架的同步完善。