正文内容 评论(0

浙大推出“女娲”AI模型!破解基因组密码 全球领先
2025-07-09 14:46:22  出处:快科技 作者:随心 编辑:随心     评论(0)点击可以复制本篇文章的标题和链接复制对文章内容进行纠错纠错

快科技7月9日消息,浙江大学郭国骥教授团队在《细胞》杂志发表重要成果。

他们开发多任务深度学习模型女娲CE(NvwaCE),实现从基因组序列到单细胞水平调控序列图谱的直接预测,在基因组AI领域取得重大突破。

基因组由DNA构成,包含编码蛋白质的序列及大量调控序列,二者共同决定生物体的复杂特征。自2003年人类基因组计划绘制出基因图谱后,对其中遗传信息的破译却不足10%。

AI的出现为解读基因序列提供了新途径,但基因组AI模型受数据质量制约。

郭国骥团队基于自主研发的超高通量超灵敏单核ATAC测序技术(UUATAC-seq),为基因组AI模型训练打造了高质量“教材”。

浙大推出“女娲”AI模型!破解基因组密码 全球领先

通过学习UUATAC-seq产生的高质量数据,该模型掌握了脊椎动物调控序列编码规则,可基于一维DNA序列预测单细胞中的染色质可及性水平,且具备高泛化能力,能预测未经训练物种的染色质可及性图谱,其对人类调控元件可及性的预测与实验测量相关性良好。

在实际应用中,“女娲CE”表现出色,超越现有基因组AI模型,可精准预测合成突变对谱系特异性调控序列功能的影响,还能结合疾病表型设计治疗位点。

团队通过基因编辑实验,验证了“女娲CE”预测的镰刀型贫血症治疗性基因位点HBG1-68:A>G,经基因治疗后胎儿血红蛋白表达量显著提升,这是世界首例由人工智能设计的人类疾病治疗位点。

相比国外同类模型,“女娲CE”基于高质量单细胞图谱数据,对几乎所有细胞类型实现了AUROC>0.90的预测准确率。

未来,“女娲CE”将在生命科学、医学和农学等领域发挥重要作用,助力全面解读基因组语言、建立数字生命模型。

【本文结束】如需转载请务必注明出处:快科技

责任编辑:随心

文章内容举报

  • 支持打赏
  • 支持0

  • 反对

  • 打赏

文章价值打分

当前文章打分0 分,共有0人打分
  • 分享好友:
  • |

  • 热门文章
  • 换一波

  • 好物推荐
  • 换一波

  • 关注我们

  • 微博

    微博:快科技官方

    快科技官方微博
  • 今日头条

    今日头条:快科技

    带来硬件软件、手机数码最快资讯!
  • 抖音

    抖音:kkjcn

    科技快讯、手机开箱、产品体验、应用推荐...