更强的蛋白质突变效应预测!一键推理 DePLM 去噪蛋白质语言模型

为了设计出具备更高热稳定性、催化效率的蛋白质,科学家们可以通过改造蛋白质的氨基酸序列来改进其功能,这称为蛋白质优化。浙江大学陈华钧教授、张强研究员、王泽元博士等人提出的全新的去噪蛋白质语言模型 (DePLM),可以将蛋白质语言模型捕捉到的进化信息视为与优化目标特性相关和无关的混合体,其中无关信息被视为「噪音」并消除,进而提高模型在预测蛋白质适应性景观时的准确性,帮助识别功能最优序列以进行优化。

教程链接:https://go.openbayes.com/KXCsB

使用云平台:OpenBayes
http://openbayes.com/console/signup?r=sony_0m6v

登录 http://OpenBayes.com,在「公共教程」页面,选择键部署 「DePLM:用去噪的语言模型优化蛋白质(小样本)」教程。

页面跳转后,点击右上角「克隆」,将该教程克隆至自己的容器中。

选择「NVIDIA GeForce RTX 4090」以及「PyTorch」镜像,OpenBayes 平台上线了新的计费方式,大家可以按照需求选择「按量付费」或「包日/周/月」,点击「继续执行」。可以使用文章开头的邀请链接,获得 RTX 4090 使用时长!

稍等片刻,待系统分配好资源,当状态变为「运行中」后,点击「打开工作空间」,即可进入 Jupyter 工作页面。

进入 Jupyter 工作空间后,可以点击「README.ipynb」查看具体的操作步骤。

该演示选取数据集为 ProteinGym,已经被预处理为适合批量训练的格式。

模型为 ESM-2 (Evolutionary Scale Modeling 2),这是 Meta AI 开发的一种蛋白质语言模型。

平台已将所需要的环境与数据集配置完成。大家可通过直接执行下面命令进行训练和推理。

复制代码
!python ./archive/src/train.py data=batched_proteingym data.assay_index=196 data.split_index=0 dat
相关推荐
学历真的很重要4 小时前
VsCode+Roo Code+Gemini 2.5 Pro+Gemini Balance AI辅助编程环境搭建(理论上通过多个Api Key负载均衡达到无限免费Gemini 2.5 Pro)
前端·人工智能·vscode·后端·语言模型·负载均衡·ai编程
普通网友4 小时前
微服务注册中心与负载均衡实战精要,微软 2025 年 8 月更新:对固态硬盘与电脑功能有哪些潜在的影响。
人工智能·ai智能体·技术问答
苍何4 小时前
一人手搓!AI 漫剧从0到1详细教程
人工智能
苍何4 小时前
Gemini 3 刚刷屏,蚂蚁灵光又整活:一句话生成「闪游戏」
人工智能
苍何4 小时前
越来越对 AI 做的 PPT 敬佩了!(附7大用法)
人工智能
苍何4 小时前
超全Nano Banana Pro 提示词案例库来啦,小白也能轻松上手
人工智能
阿杰学AI5 小时前
AI核心知识39——大语言模型之World Model(简洁且通俗易懂版)
人工智能·ai·语言模型·aigc·世界模型·world model·sara
智慧地球(AI·Earth)5 小时前
Vibe Coding:你被取代了吗?
人工智能
大、男人6 小时前
DeepAgent学习
人工智能·学习
测试人社区—66796 小时前
提升测试覆盖率的有效手段剖析
人工智能·学习·flutter·ui·自动化·测试覆盖率