学术分享|无惧数据匮乏!上海交大博士后周子宜详解蛋白质语言模型的小样本学习方法 FSFP

本文主要是介绍学术分享|无惧数据匮乏!上海交大博士后周子宜详解蛋白质语言模型的小样本学习方法 FSFP,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

预训练蛋白质语言模型 (PLMs) 能够以无监督的方式学习数百万蛋白质中氨基酸序列的分布特征,在揭示蛋白质序列与其功能之间的隐含关系方面显示出了巨大的潜力。

在此背景下,上海交通大学自然科学研究院/物理天文学院/张江高研院/药学院洪亮教授课题组,联合上海人工智能实验室青年研究员谈攀,开发了一种针对蛋白质语言模型的小样本学习方法,能够在使用极少数湿实验数据的情况下大幅提升传统蛋白质语言模型的突变效果预测性能, 在实际应用中显示出了巨大的潜力。

在「Meet AI4S」系列直播第三期中,HyperAI超神经有幸邀请到了该研究成果的论文第一作者——上海交通大学自然科学研究院 & 上海国家应用数学中心博士后周子宜。9 月 25 日,周子宜博士将以线上直播的形式进一步为大家分享蛋白质语言模型的小样本学习方法,探讨 AI 辅助下定向进化的新思路。

点击预约直播:

https://hdxu.cn/6Bjom

扫码备注「AI4S」加入讨论群↓

在这里插入图片描述

活动详情

在这里插入图片描述

分享主题

蛋白质语言模型的小样本学习方法

内容简介

蛋白质语言模型 (PLM) 在蛋白质功能预测方面取得了突破,然而其往往需要大量实验数据微调才能达到较高的精度。本次介绍一种针对 PLM 的小样本学习方法,能在只使用数十个训练样本的情况下显著提升 PLM 的突变效果预测性能。

论文回顾

HyperAI超神经此前曾解读分享了周子宜博士为第一作者的研究论文「Enhancing efficiency of protein language models with minimal wet-lab data through few-shot learning」。

点击查看详细报道:20个实验数据创造AI蛋白质里程碑!上海交大联合上海AI Lab发布FSFP,有效优化蛋白质预训练模型

FSFP 方法包含 3 个阶段

为元学习构建辅助任务 (Build auxiliary tasks for meta-training)、在辅助任务上训练 PLMs (Meta-train PLMs on the auxiliary tasks)、以及将 PLMs 转移到目标任务 (Transfer PLMs to the target task via LTR)。

其中,FSFP 使用 ListMLE 损失来学习对突变适应度进行排名。在每次训练迭代中,把 PLM 对训练样本的预测排列向它们的真实排列修正。该排序学习方法被同时应用于元训练阶段的内部优化和迁移学习阶段。

数据集的获取

该研究选择蛋白质突变数据集 (ProteinGym) 作为基准测试数据集。数据集共包含来自 87 个 DMS 测序实验的大约 150 万个错义变体。

ProteinGym 蛋白质突变数据集下载地址:
https://go.hyper.ai/6GvFD

FSFP 方法评估

  • 在平均性能方面,通过 FSFP 训练的 PLMs 在所有训练数据规模上始终优于其他基线。

  • 在外推性能评估方面,FSFP 训练 PLMs 的 Spearman 相关性评估更优。

  • FSFP 被成功应用于 Phi29 DNA 聚合酶的工程改造,显著提升了阳性率。

观众收益:

  1. 了解 PLM 的基本原理以及在蛋白质工程中的应用

  2. 了解 PLM 的基本原理以及在蛋白质工程中的应用

  3. 探讨 AI 辅助下定向进化的新思路

上海交通大学洪亮课题组

在这里插入图片描述

上海交通大学洪亮课题组隶属于上海交通大学自然科学研究院。课题组研究方向主要为 AI 蛋白和药物设计、分子生物物理,具体包括:

  • 基于人工智能技术的蛋白质定向改造、酶工程定向进化、和辅助药物设计;

  • 中子散射,同步辐射国家大科学装置,单分子荧光,分子动力学模拟和人工智能算法等,研究生物大分子的动力学、生物大分子低温保存技术及原理。

该课题组研究成果颇丰,截止目前共发表研究论文 77 篇,其中多篇登顶 Nature 期刊。

Meet AI4S 系列直播

HyperAI超神经 (hyper.ai) 是中国最⼤的数据科学领域搜索引擎,聚焦 AI for Science 的最新科研成果,实时追踪 Nature、Science 等顶级刊物的学术论文,至今已完成百余篇 AI for Science 论文的解读。

此外,我们还运营了国内唯一 AI for Science 开源项目 awesome-ai4s。

项目地址:

https://github.com/hyperai/awesome-ai4s

为了进一步推进 AI4S 的普适化,将学术机构的科研成果进一步降低传播壁垒,分享给更广泛的行业学者、科技爱好者及产业单位,HyperAI超神经策划了「Meet AI4S」视频栏目,邀请深耕 AI for Science 领域的科研人员或相关单位,以视频的形式分享研究成果、方法思路,共同探讨 AI for Science 在科研进展及推进落地过程中面临的机遇和挑战,促进 AI for Science 的科学普及和传播。

欢迎高效课题组及研究机构共同参与到我们的直播活动中!扫描二维码添加「神经星星」微信,了解详情↓

在这里插入图片描述

这篇关于学术分享|无惧数据匮乏!上海交大博士后周子宜详解蛋白质语言模型的小样本学习方法 FSFP的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!


原文地址:
本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.chinasem.cn/article/1141730

相关文章

MySQL 8 中的一个强大功能 JSON_TABLE示例详解

《MySQL8中的一个强大功能JSON_TABLE示例详解》JSON_TABLE是MySQL8中引入的一个强大功能,它允许用户将JSON数据转换为关系表格式,从而可以更方便地在SQL查询中处理J... 目录基本语法示例示例查询解释应用场景不适用场景1. ‌jsON 数据结构过于复杂或动态变化‌2. ‌性能要

postgresql使用UUID函数的方法

《postgresql使用UUID函数的方法》本文给大家介绍postgresql使用UUID函数的方法,本文给大家介绍的非常详细,对大家的学习或工作具有一定的参考借鉴价值,需要的朋友参考下吧... 目录PostgreSQL有两种生成uuid的方法。可以先通过sql查看是否已安装扩展函数,和可以安装的扩展函数

Python实现终端清屏的几种方式详解

《Python实现终端清屏的几种方式详解》在使用Python进行终端交互式编程时,我们经常需要清空当前终端屏幕的内容,本文为大家整理了几种常见的实现方法,有需要的小伙伴可以参考下... 目录方法一:使用 `os` 模块调用系统命令方法二:使用 `subprocess` 模块执行命令方法三:打印多个换行符模拟

MySQL字符串常用函数详解

《MySQL字符串常用函数详解》本文给大家介绍MySQL字符串常用函数,本文结合实例代码给大家介绍的非常详细,对大家学习或工作具有一定的参考借鉴价值,需要的朋友参考下吧... 目录mysql字符串常用函数一、获取二、大小写转换三、拼接四、截取五、比较、反转、替换六、去空白、填充MySQL字符串常用函数一、

Java中Arrays类和Collections类常用方法示例详解

《Java中Arrays类和Collections类常用方法示例详解》本文总结了Java中Arrays和Collections类的常用方法,涵盖数组填充、排序、搜索、复制、列表转换等操作,帮助开发者高... 目录Arrays.fill()相关用法Arrays.toString()Arrays.sort()A

Python 字典 (Dictionary)使用详解

《Python字典(Dictionary)使用详解》字典是python中最重要,最常用的数据结构之一,它提供了高效的键值对存储和查找能力,:本文主要介绍Python字典(Dictionary)... 目录字典1.基本特性2.创建字典3.访问元素4.修改字典5.删除元素6.字典遍历7.字典的高级特性默认字典

Nginx安全防护的多种方法

《Nginx安全防护的多种方法》在生产环境中,需要隐藏Nginx的版本号,以避免泄漏Nginx的版本,使攻击者不能针对特定版本进行攻击,下面就来介绍一下Nginx安全防护的方法,感兴趣的可以了解一下... 目录核心安全配置1.编译安装 Nginx2.隐藏版本号3.限制危险请求方法4.请求限制(CC攻击防御)

MySQL 主从复制部署及验证(示例详解)

《MySQL主从复制部署及验证(示例详解)》本文介绍MySQL主从复制部署步骤及学校管理数据库创建脚本,包含表结构设计、示例数据插入和查询语句,用于验证主从同步功能,感兴趣的朋友一起看看吧... 目录mysql 主从复制部署指南部署步骤1.环境准备2. 主服务器配置3. 创建复制用户4. 获取主服务器状态5

python生成随机唯一id的几种实现方法

《python生成随机唯一id的几种实现方法》在Python中生成随机唯一ID有多种方法,根据不同的需求场景可以选择最适合的方案,文中通过示例代码介绍的非常详细,需要的朋友们下面随着小编来一起学习学习... 目录方法 1:使用 UUID 模块(推荐)方法 2:使用 Secrets 模块(安全敏感场景)方法

一文详解如何使用Java获取PDF页面信息

《一文详解如何使用Java获取PDF页面信息》了解PDF页面属性是我们在处理文档、内容提取、打印设置或页面重组等任务时不可或缺的一环,下面我们就来看看如何使用Java语言获取这些信息吧... 目录引言一、安装和引入PDF处理库引入依赖二、获取 PDF 页数三、获取页面尺寸(宽高)四、获取页面旋转角度五、判断