浙大推出“女娲”AI模型!破解基因组密码 全球领先
时间:2025-07-09 | 作者: | 阅读:07月9日消息,浙江大学郭国骥教授团队在《细胞》杂志发表重要成果。
他们开发多任务深度学习模型女娲CE(NvwaCE),实现从基因组序列到单细胞水平调控序列图谱的直接预测,在基因组AI领域取得重大突破。
基因组由DNA构成,包含编码蛋白质的序列及大量调控序列,二者共同决定生物体的复杂特征。自2003年人类基因组计划绘制出基因图谱后,对其中遗传信息的破译却不足10%。
AI的出现为解读基因序列提供了新途径,但基因组AI模型受数据质量制约。
郭国骥团队基于自主研发的超高通量超灵敏单核ATAC测序技术(UUATAC-seq),为基因组AI模型训练打造了高质量“教材”。
通过学习UUATAC-seq产生的高质量数据,该模型掌握了脊椎动物调控序列编码规则,可基于一维DNA序列预测单细胞中的染色质可及性水平,且具备高泛化能力,能预测未经训练物种的染色质可及性图谱,其对人类调控元件可及性的预测与实验测量相关性良好。
在实际应用中,“女娲CE”表现出色,超越现有基因组AI模型,可精准预测合成突变对谱系特异性调控序列功能的影响,还能结合疾病表型设计治疗位点。
团队通过基因编辑实验,验证了“女娲CE”预测的镰刀型贫血症治疗性基因位点HBG1-68:A>G,经基因治疗后胎儿血红蛋白表达量显著提升,这是世界首例由人工智能设计的人类疾病治疗位点。
相比国外同类模型,“女娲CE”基于高质量单细胞图谱数据,对几乎所有细胞类型实现了AUROC>0.90的预测准确率。
未来,“女娲CE”将在生命科学、医学和农学等领域发挥重要作用,助力全面解读基因组语言、建立数字生命模型。
福利游戏
相关文章
更多-
- 如何测试多模态AI的效果 多模态能力评估方法与实践技巧
- 时间:2025-07-09
-
- 多模态输入的限制有哪些 输入内容类型与格式注意事项
- 时间:2025-07-09
-
- DeepSeek能做代码生成吗 使用DeepSeek进行编程任务的能力测试
- 时间:2025-07-09
-
- Gemini是否具备联网功能 Gemini在线信息检索能力解析
- 时间:2025-07-09
-
- ChatGPT能与本地数据库结合吗 ChatGPT本地数据调用解决方案
- 时间:2025-07-09
-
- Perplexity AI是否会泄露用户信息 数据安全机制与用户隐私保障详解
- 时间:2025-07-09
-
- DeepSeek能否用于翻译任务 多语言翻译能力评测与建议
- 时间:2025-07-09
-
- 雷军52亿北京买房6年了!今日小米科技园6周年庆
- 时间:2025-07-09
大家都在玩
大家都在看
更多-
- 2025年十大安全虚拟货币交易App
- 时间:2025-07-09
-
- 点外卖不领券就是浪费钱!教你玩转美团优惠券! 每天最高可省50元,这些平台券别错过!
- 时间:2025-07-09
-
- SOL能否超越ETH?潜力对比分析
- 时间:2025-07-09
-
- 这个方法太绝了!美团优惠券+红包叠加使用技巧大公开!
- 时间:2025-07-09
-
- 6000米!75岁大爷连续16年横渡长江
- 时间:2025-07-09
-
- 美团优惠券领取+使用全流程指南来了
- 时间:2025-07-09
-
- 华为智驾有多牛!余承东:问界事故率相较于行业下降了近90% 未来还会更低
- 时间:2025-07-09
-
- 浙大推出“女娲”AI模型!破解基因组密码 全球领先
- 时间:2025-07-09