400 128 6709

行业新闻

数百万晶体数据训练,解决晶体学相位问题,深度学习方法PhAI登Science

发布时间:2024-08-09点击次数:

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

数百万晶体数据训练,解决晶体学相位问题,深度学习方法phai登science

编辑 | KX

时至今日,晶体学所测定的结构细节和精度,从简单的金属到大型膜蛋白,是任何其他方法都无法比拟的。然而,最大的挑战——所谓的相位问题,仍然是从实验确定的振幅中检索相位信息。

丹麦哥本哈根大学研究人员,开发了一种解决晶体相问题的深度学习方法 PhAI,利用数百万人工晶体结构及其相应的合成衍射数据训练的深度学习神经网络,可以生成准确的电子密度图。

研究表明,这种基于深度学习的从头算结构解决方案方法,可以以仅 2 埃的分辨率解决相位问题,该分辨率仅相当于原子分辨率可用数据的 10% 到 20%,而传统的从头算方法通常需要原子分辨率。

相关研究以《PhAI: A deep-learning approach to solve the crystallographic phase problem》为题,于 8 月 1 日发布在《Science》上。

数百万晶体数据训练,解决晶体学相位问题,深度学习方法PhAI登Science

论文链接:https://www.science.org/doi/10.1126/science.adn2777

晶体学是自然科学中的核心分析技术之一。X 射线晶体学为晶体的三维结构提供了独特的视角。

为了重建电子密度图,必须知道足够多的衍射反射的复杂结构因子 $F$。在传统实验中,只能获得振幅 $|F|$,而相位 $phi$ 会丢失。这是晶体学相位问题。

数百万晶体数据训练,解决晶体学相位问题,深度学习方法PhAI登Science

图示:标准晶体结构测定流程图。(来源:论文)

20 世纪 50 年代和 60 年代取得了重大突破,KarleHauptmann** 开发了用于解决相位问题的所谓直接方法。但直接法需要原子分辨率的衍射数据。然而,原子分辨率的要求是一种经验观察。

近年来,传统的直接方法已被对偶空间方法所补充。目前可用的从头算方法似乎已达到极限。相位问题的普遍解决方案仍然未知。

从数学上讲,结构因子振幅与相位的任何组合都可以进行逆傅里叶变换。然而,物理和化学要求(例如具有原子状电子密度分布)对与一组振幅一致的相位的可能组合施加了规则。深度学习的进步使得人们能够探索这种关系,也许比目前的从头算方法更深入。

在此,哥本哈根大学的研究人员采用了数据驱动的方法,使用数百万个人造晶体结构及其相应的衍射数据,旨在解决晶体学中的相位问题。

码上飞 码上飞

码上飞(CodeFlying) 是一款AI自动化开发平台,通过自然语言描述即可自动生成完整应用程序。

码上飞 430 查看详情 码上飞

研究表明,这种基于深度学习的从头算结构解决方案方法,可以在仅最小晶格平面距离(dmin)= 2.0 Å 的分辨率下执行,只需要使用直接方法所需数据的 10% 到 20%。

神经网络的设计与训练

构建的人工神经网络称之为 PhAI,接受结构因子振幅 |F| 并输出相应的相位值 ϕPhAI 的架构如下图所示。

数百万晶体数据训练,解决晶体学相位问题,深度学习方法PhAI登Science

图示:PhAI 神经网络方法解决相位问题。(来源:论文)晶体结构的结构因子数量取决于晶胞大小。根据计算资源,对输入数据的大小设置了限制。输入结构因子振幅是根据 Miller 指数 (h、k、l) 服从

数百万晶体数据训练,解决晶体学相位问题,深度学习方法PhAI登Science

1. 反射来选择的。
也就是,限制在原子分辨率下晶胞尺寸约为 10 Å 的结构。此外,选择了最常见的中心对称空间群 P21/c。中心对称性将可能的相位值限制为零或 π rad。
  1. 研究使用主要包含有机分子的人工晶体结构训练神经网络。创建了大约 49,000,000 个结构,其中有机晶体结构占 94.29%,金属有机晶体结构占 5.66%,无机晶体结构占 0.05%。
  2. 神经网络的输入由振幅和相位组成,它们由卷积输入块处理,添加并输入到一系列卷积块(Conv3D)中,然后是一系列多层感知器(MLP)块。来自线性分类器(相位分类器)的预测相位通过网络循环 Nc 次。训练数据是通过将 GDB-13 数据库中的金属原子和有机分子插入到晶胞中生成的。生成的结构被组织成训练数据,从中可以计算出在采样温度因子、分辨率和完整性时的真实相位和结构因子振幅。
    解决真实结构问题
  3. 经过训练的神经网络在标准计算机上运行,计算需求适中。它接受 hkl 索引列表和相应的结构因子振幅作为输入。不需要其他输入信息,甚至不需要结构的晶胞参数。这与所有其他现代从头算方法有着根本区别。网络可以即时预测并输出相位值。
  4. 研究人员使用计算得出的真实晶体结构的衍射数据测试了神经网络的性能。共获得 2387 个测试用例。对于所有收集的结构,考虑了多个数据分辨率值,范围从 1.0 到 2.0 Å。为了进行比较,还使用了电荷翻转方法来检索相位信息。

    数百万晶体数据训练,解决晶体学相位问题,深度学习方法PhAI登Science

    图示:相位和真实电子密度图之间的相关系数 r 的直方图。
    (来源:论文)

经过训练的神经网络表现出色;如果相应的衍射数据分辨率良好,它可以解决所有测试结构(N = 2387),并且在从低分辨率数据中解决结构方面表现出色。尽管神经网络几乎没有针对无机结构进行训练,但它可以完美地解决此类结构。

电荷翻转法在处理高分辨率数据时表现优异,但随着数据分辨率的降低,其产生合理正确解的能力逐渐下降;然而,它仍然以 1.6Å 的分辨率解决了大约 32% 的结构。通过进一步试验和更改输入参数(例如翻转阈值),可以改善通过电荷翻转确定的结构数量。

在 PhAI 方法中,这种元优化是在训练期间执行的,不需要由用户执行。这些结果表明,在晶体学中必须有原子分辨率数据才能从头算相位的普遍观念可能被打破。PhAI 仅需要 10% 至 20% 的原子分辨率数据。

这一结果清楚地表明,原子分辨率对于从头算方法来说不是必需的,并为基于深度学习的结构测定开辟了新途径。

这种深度学习方法的挑战是扩展神经网络,也就是说,较大晶胞的衍射数据将需要大量的输入和输出数据以及训练期间的计算成本。未来,需要进一步研究,将该方法扩展到一般情况。

以上就是数百万晶体数据训练,解决晶体学相位问题,深度学习方法PhAI登Science的详细内容,更多请关注其它相关文章!


# 领跑  # 网站建设优化服务精英  # seo网站推广高手  # 网站制作简历优化方案  # 重庆seo软件十年乐云seo品牌  # 天津推荐的网站建设操作  # 网络推广的营销词汇  # 潍坊seo外包策略  # 沁阳短视频seo  # 推广购物网站优惠券挣钱  # 美团营销推广图怎么做好看  # 理论  # 语言表达  # 大比拼  # 一言  # 梦中  # 太平洋  # 不需要  # 丰田  # 哥本哈根  # 数百万 


相关栏目: 【 行业新闻62819 】 【 科技资讯67470


相关推荐: 五个IntelliJ IDEA插件,高效编写代码  朝鲜出现国产大型察打一体无人机,实力世界第二,太意外了  AI拉动PCB发展|行业发现  苹果AR头显商标与华为撞车,在中国或改名  360°/180°双模式,佳能公布可折叠小体积的VR全景相机  奥比中光子公司和斯坦德机器人深度合作,共同推进新一代激光雷达的研发  昇思开源社区理事会成立,基于昇思AI框架的全模态大模型“紫东.太初2.0”发布  盘古大模型3.0正式发布 AI开发正走向新“工业化开发模式”  MiracleVision视觉大模型功能介绍  网友自制 AI 版《流浪地球 3》预告片,登上 CCTV6  警惕!AI或致虚假信息泛滥  AMD在ChinaJoy展示全新的锐龙AI笔记本,开创了人工智能领域的新时代!  全国体育人工智能大会举办,专家聚焦体育人工智能领域人才培养  AI连线 | 专访风平智能CEO林洪祥:让AI数字人拥有漂亮的外表和有趣的灵魂,安全问题是重要考量  BLIP-2、InstructBLIP稳居前三!十二大模型,十六份榜单,全面测评「多模态大语言模型」  MetaGPT AI 模型开源:可模拟软件公司开发过程,生成高质量代码  通用医疗人工智能如何革新医疗行业?  抛媚眼给瞎子看?微软、谷歌的AI广告被广告主抵制  即将到来:AI婚纱设计软件实际测试,人工智能即将开创婚纱设计新纪元  华为发布大模型时代AI存储新品  Vision Pro 太贵,苹果基于 iPhone 的 VR 头显专利曝光  张勇对话多位诺奖得主 人工智能将无处不在  利亚德加码AI战略,与光年无限图灵机器人全面开展AI研发业务合作  华为即将推出HarmonyOS 4,再度领先行业的AI技术  到中国科技馆体验“一滴油的奇妙旅行”,线上元宇宙展厅同步开启  海南科技职业大学第25届中国机器人及人工智能大赛海南赛区荣获一等奖等114项  插画师对AI绘画软件的态度是怎样的?  生成式人工智能如何改变云安全的游戏规则  英国前首相:AI可能被用来制造“生物恐怖武器”  寻求能源转型最优解  Meta发布音频AI模型,仅需2秒片段模拟真人语音  创作音乐/音频的Meta开源AI工具AudioCraft,让用户通过文本提示实现  利用AI探索抗体“钥匙”、加速药物研发——访百图生科团队  塑造全能智能管家:华为小艺AI加成应对大模型挑战  全新“AI助手”!讯飞星火助手中心人机协作共创新生态  【|直播|预告】人工智能高峰论坛将于7月2日13:30准时开播!  【搞事】时隔4年 谷歌更新安卓logo 机器人头更饱满了  1分钟做出苹果Vision Pro「官网」?上班8小时搞出480个网页,同事被卷疯了  pixivFANBOX 更新运营规则,禁止通过外链绕开 AI 生成禁令  2025世界人工智能大会前沿科技共绘“未来”图景, 这家这家独角兽企业的通用大脑将在AI领域大放异彩  WHEE功能介绍  美图公司吴欣鸿:AI技术重构影像产业  学生作文评分的新趋势:教师与AI的合作模式  数据显示:人工智能相关专业热度上升最快 考古、美术、生物医学工程等小众专业火了  人工智能正在弥合认知和表达之间的鸿沟  喜马拉雅在国际会议挑战赛中突破语音重叠难题斩获第一 加速AI创新  科普:什么是AI大模型  微软在德国举办MR研讨会,向女性分享元宇宙潜力  Meta 发布 Voicebox AI 模型:可生成音频信息,用于 NPC 对话等  搭载星火认知大模型 讯飞听见智慧屏开启AI办公新体验 

400 128 6709
E-mail

contact@tlftec.cn

扫一扫,添加微信

©  云南淘乐房科技有限公司 版权所有  滇ICP备2025071560号  

云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司