|新一代信息技术 信息基础设施建设 互联网+ 大数据 人工智能 高端信息技术核心产业
|高端制造 机器人 智能制造 新材料
|生物产业 生物医药 生物农业 生物技术
|绿色低碳 清洁能源汽车 环保产业 高效节能产业 生态修复 资源循环利用
|数字创意 数创装备 内容创新 设计创新
|产业资讯
|地方亮点及地方发改委动态
|独家内容
|杂志订阅
✍️ 投稿
您的位置:首页 > 生物产业 > 生物医药
新人工智能模型可精确预测人体细胞基因表达
2025-01-13 10:01
来源:新华网
字体: [   ]
  美国研究人员开发出一个新的人工智能模型,经过大量数据的训练后,该模型能精确预测各种人体细胞内部的基因表达情况,将为生物和医学研究带来便利。

  这个名为“通用表达转换器”(GET)的模型由美国哥伦比亚大学和卡内基-梅隆大学等机构研究人员联合开发,其准确性和有效性已得到实验验证,论文发表在新一期英国《自然》杂志上。

  在基因表达过程中,以DNA形式储存的基因“蓝图”转录成为RNA形式的“抄本”,后者指导合成出蛋白质,执行具体的生理功能。参与转录调控的生物分子种类繁多,相互作用极为复杂,此前相关预测模型局限于几种特定的细胞,尤其是癌细胞,缺乏适用于人体多种细胞类型的通用工具。

  研究人员根据转录调控机制的特点设计出机器学习模型,然后用来自1.3万个人体细胞的基因测序和表达数据对其进行训练。这些细胞涵盖213种人类胚胎细胞和成体细胞,都来自没有病变的正常人体组织。

  就像ChatGPT等人工智能工具能根据大量语料总结出通用语法规则,GET模型也能从训练数据中总结出关于转录调控的“语法”,在此基础上能对其没有接触过的细胞类型进行基因表达预测。

  该模型可用于揭示致病基因的作用机制,指导癌症和遗传疾病研究。例如某种儿童白血病的患者携带一个功能不明的变异基因,GET模型预测该基因会扰乱细胞中两种转录因子的相互作用,实验数据证实了这一结论。

  研究人员说,该模型还可用于探寻基因组中“暗物质”的作用。蛋白质编码基因序列只占人类基因组的一小部分,占比达98%的非编码区域就像宇宙中的暗物质一样,其属性和功能目前难以捉摸。

  本网站转载的所有的文章、图片、音频视频文件等资料的版权归版权所有人所有。如因无法联系到作者侵犯到您的权益,请与本网站联系,我们将采取适当措施。

关注微信公众号:

官方账号直达 | 关于我们 | 联系我们 | 招聘 | 广告刊例 | 版权声明

地址(Address):北京市西城区广内大街315号信息大厦B座8-13层(8-13 Floor, IT Center B Block, No.315 GuangNei Street, Xicheng District, Beijing, China)

邮编:100053 传真:010-63691514 Post Code:100053 Fax:010-63691514

Copyright 中国战略新兴产业网 京ICP备09051002号-3 技术支持:wicep