【Nature. Mach. Intell. 】基于Transformer的多肽-HLA I类结合预测和疫苗的新生抗原序列设计...

本文主要是介绍【Nature. Mach. Intell. 】基于Transformer的多肽-HLA I类结合预测和疫苗的新生抗原序列设计...,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

f8f740662d34158d340e645821168c2f.png

来源:专知
本文1000字,建议阅读5分钟TransPHLA设计了Transformer衍生模型来预测pHLA的结合。

近日,国际知名期刊《Nature Machine Intelligence》在线发表了上海交通大学生命科学技术学院魏冬青团队的研究论文《A transformer-based model to predict peptide–HLA class I binding and optimize mutated peptides for vaccine design》。生命科学技术学院2017级博士研究生褚晏伊和香港大学深圳医院的张艳博士为该论文的共同第一作者。生命科学技术学院魏冬青教授和熊毅副研究员为该论文的共同通讯作者。

8584194c20db0241aa95349c428f64eb.png

人类白细胞抗原(HLA)和肽(pHLA)之间相互作用的计算预测可以加快表位筛选和疫苗。该研究开发了TransMut框架,包含了用于pHLA结合预测的TransPHLA和用于突变肽优化的AOMP程序,它可以推广到生物分子的任何结合和突变任务(图1)。

TransPHLA设计了Transformer衍生模型来预测pHLA的结合。在pHLA结合预测、新抗原鉴定和HPV疫苗鉴定方面,TransPHLA均优于现有的14种方法。基于TransPHLA开发的AOMP程序可用于疫苗设计,它可以自动优化突变肽,以搜索对目标HLA具有更高亲和力并与源肽具有高度同源性的突变肽。在3660个非结合pHLA中,有3630个源肽被成功突变。其中,94%通过IEDB的推荐方法得到验证,88%与源肽的同源性高于80%。

11b8a377d59456353abd22e9619e41b0.png

图1.TransMut框架在webserver上的输入和输出

1.数据集

该研究包含112种HLA,肽长度从8到14,共有366种HLA-肽长度组合。详情见图2和图3。

aef81243dbc8cce0eb98ccb13796d658.png

图2.不同数据集中每个HLA相关的可结合的pHLA样本数

cd31219a84d1822d88923d1172a540e8.png

图3.不同数据集中肽长度相关的可结合的pHLA样本数

2.TransPHLA模型

TransPHLA的核心思想是自注意力机制的应用。TransPHLA由以下四个模块组成(图4):首先使用embedding block将positional embedding添加到amino acid embedding中,以生成sequence embedding,然后应用dropout技术来增强鲁棒性。通过embedding block,TransPHLA分别生成肽和HLA的embedding。接下来,这些embedding将分别作为Encoder block的输入。Encoder block包含masked multi-head self-attention mechanism和feature optimization block。Feature optimization block是先上升后下降的全连接层的组合,这个模块使得注意力机制得到的特征表示更好。然后,将输出的肽和HLA的特征表示连接,作为pHLA的embedding。在pHLA的embedding通过encoder block后,使用projection block预测pHLA的结合分数。

5a1801509d744baff9df549f9bc01077.png

图4.TransPHLA模型图

论文链接:

https://www.nature.com/articles/s42256-022-00459-7

参考链接:

https://news.sjtu.edu.cn/jdzh/20220325/169006.html

d7402b3e763ca59051441924c5b33d55.png

这篇关于【Nature. Mach. Intell. 】基于Transformer的多肽-HLA I类结合预测和疫苗的新生抗原序列设计...的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/900904

相关文章

Spring 中的切面与事务结合使用完整示例

《Spring中的切面与事务结合使用完整示例》本文给大家介绍Spring中的切面与事务结合使用完整示例,本文通过实例代码给大家介绍的非常详细,对大家的学习或工作具有一定的参考借鉴价值,需要的朋友参考... 目录 一、前置知识:Spring AOP 与 事务的关系 事务本质上就是一个“切面”二、核心组件三、完

C# LiteDB处理时间序列数据的高性能解决方案

《C#LiteDB处理时间序列数据的高性能解决方案》LiteDB作为.NET生态下的轻量级嵌入式NoSQL数据库,一直是时间序列处理的优选方案,本文将为大家大家简单介绍一下LiteDB处理时间序列数... 目录为什么选择LiteDB处理时间序列数据第一章:LiteDB时间序列数据模型设计1.1 核心设计原则

Linux中的自定义协议+序列反序列化用法

《Linux中的自定义协议+序列反序列化用法》文章探讨网络程序在应用层的实现,涉及TCP协议的数据传输机制、结构化数据的序列化与反序列化方法,以及通过JSON和自定义协议构建网络计算器的思路,强调分层... 目录一,再次理解协议二,序列化和反序列化三,实现网络计算器3.1 日志文件3.2Socket.hpp

SpringBoot结合Knife4j进行API分组授权管理配置详解

《SpringBoot结合Knife4j进行API分组授权管理配置详解》在现代的微服务架构中,API文档和授权管理是不可或缺的一部分,本文将介绍如何在SpringBoot应用中集成Knife4j,并进... 目录环境准备配置 Swagger配置 Swagger OpenAPI自定义 Swagger UI 底

Mysql中设计数据表的过程解析

《Mysql中设计数据表的过程解析》数据库约束通过NOTNULL、UNIQUE、DEFAULT、主键和外键等规则保障数据完整性,自动校验数据,减少人工错误,提升数据一致性和业务逻辑严谨性,本文介绍My... 目录1.引言2.NOT NULL——制定某列不可以存储NULL值2.UNIQUE——保证某一列的每一

Spring的RedisTemplate的json反序列泛型丢失问题解决

《Spring的RedisTemplate的json反序列泛型丢失问题解决》本文主要介绍了SpringRedisTemplate中使用JSON序列化时泛型信息丢失的问题及其提出三种解决方案,可以根据性... 目录背景解决方案方案一方案二方案三总结背景在使用RedisTemplate操作redis时我们针对

Spring Boot 结合 WxJava 实现文章上传微信公众号草稿箱与群发

《SpringBoot结合WxJava实现文章上传微信公众号草稿箱与群发》本文将详细介绍如何使用SpringBoot框架结合WxJava开发工具包,实现文章上传到微信公众号草稿箱以及群发功能,... 目录一、项目环境准备1.1 开发环境1.2 微信公众号准备二、Spring Boot 项目搭建2.1 创建

nginx -t、nginx -s stop 和 nginx -s reload 命令的详细解析(结合应用场景)

《nginx-t、nginx-sstop和nginx-sreload命令的详细解析(结合应用场景)》本文解析Nginx的-t、-sstop、-sreload命令,分别用于配置语法检... 以下是关于 nginx -t、nginx -s stop 和 nginx -s reload 命令的详细解析,结合实际应

SpringBoot结合Docker进行容器化处理指南

《SpringBoot结合Docker进行容器化处理指南》在当今快速发展的软件工程领域,SpringBoot和Docker已经成为现代Java开发者的必备工具,本文将深入讲解如何将一个SpringBo... 目录前言一、为什么选择 Spring Bootjavascript + docker1. 快速部署与

Python中re模块结合正则表达式的实际应用案例

《Python中re模块结合正则表达式的实际应用案例》Python中的re模块是用于处理正则表达式的强大工具,正则表达式是一种用来匹配字符串的模式,它可以在文本中搜索和匹配特定的字符串模式,这篇文章主... 目录前言re模块常用函数一、查看文本中是否包含 A 或 B 字符串二、替换多个关键词为统一格式三、提