使用Deepchem构建化学分子的神经网络和图神经网络模型示例

2023-10-22 14:59

本文主要是介绍使用Deepchem构建化学分子的神经网络和图神经网络模型示例,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

首先,关于分子指纹,分子指纹是一个二进制向量,其中每个位代表是否存在该分子的某个子结构 ,例如苯环。 它通常很长,可能无法合并一些结构信息,例如手性 。
分子指纹

'''使用Deepchem构建化学分子的神经网络和图神经网络模型示例by wufeilDeepchem包含了很多的化学分子的数据集,同时也有将分子结构转换为机器学习能够识别的矩阵(序列)数据的方法,下面就来简单举几个例子,以便快速入门'''import numpy as np
import deepchem as dc
import tensorflow as tf#设定随机数,可重复再现
np.random.seed(88)
tf.random.set_seed(88)'''
Delaney(ESOL) 溶解度能数据集该数据集是Deepchem内置MoleculeNet数据集的一部分。首先,全连接神经网络多任务回归器
'''
#加载数据
tasks, datasets, transformers = dc.molnet.load_delaney() #默认是下载分子指纹
print(transformers)
print(tasks) #任务  #print: ['measured log solubility in mols per litre']
print(datasets[0])''''
划分数据集
'''
train_dataset, valid_dataset, test_dataset = datasets
print(train_dataset) #迭代对象
print(test_dataset)
print(valid_dataset)#模型的评价指标
avg_pearson_r2 = dc.metrics.Metric(dc.metrics.pearson_r2_score, np.mean)
#回归任务模型
'''
dc.models.MultitaskRegressor: deepchem的多任务回归的全连接网络模型
请参照:https://deepchem.readthedocs.io/en/latest/api_reference/models.html?highlight=MultitaskRegressor#deepchem.models.MultitaskRegressor.__init__'''
model = dc.models.MultitaskRegressor(len(tasks), #任务数量,这里为1n_features=datasets[0].X.shape[1], #每个分子的特征数量layer_sizes=[500])  #500层model.fit(train_dataset)train_score = model.evaluate(train_dataset, [avg_pearson_r2], transformers)
valid_score = model.evaluate(valid_dataset, [avg_pearson_r2], transformers)
assert train_score['mean-pearson_r2_score']>0.7, train_score
assert valid_score['mean-pearson_r2_score']>0.3, valid_score'''图卷积网络模型在全连接层神经网络模型中,输入的是ECFP的fingerprint在图神经网络中,这种ECFP的数据结构不适合,所以在导入数据的时候需要设置transformers=’GraphConv'dc.models.GraphConvModel有不同的参数需要设置,请见:https://deepchem.readthedocs.io/en/latest/api_reference/models.html#model
'''tasks, datasets, transformers = dc.molnet.load_delaney(featurizer='GraphConv')
train_dataset, valid_dataset, test_dataset = datasets
model = dc.models.GraphConvModel(len(tasks), mode='regression', dropout=0.5)
model.fit(train_dataset, nb_epoch=30)
train_score = model.evaluate(train_dataset, [avg_pearson_r2], transformers)
print(train_score)''''
这里要特别说明的是,数据结构的问题由于图神经网络的输入为特殊的链接矩阵和节点信息,因此,在这里的加载数据的时候使用了GraphConv的特征化方法生成的train_datset中, X保存的则是ConvMol的对象,专门用于图神经网络计算的计算。
详见:https://deepchem.readthedocs.io/en/latest/api_reference/dataclasses.html?highlight=ConvMol#deepchem.feat.mol_graphs.ConvMol如下例,返回链接表
'''
print(train_dataset.X[0].get_adjacency_list())
print(train_dataset.X[0].get_atom_features())

如何将一个分子转化为机器学习可以识别的数据类型(例如这里提到的分子指纹)呢?有力再写

这篇关于使用Deepchem构建化学分子的神经网络和图神经网络模型示例的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/262196

相关文章

Java使用ANTLR4对Lua脚本语法校验详解

《Java使用ANTLR4对Lua脚本语法校验详解》ANTLR是一个强大的解析器生成器,用于读取、处理、执行或翻译结构化文本或二进制文件,下面就跟随小编一起看看Java如何使用ANTLR4对Lua脚本... 目录什么是ANTLR?第一个例子ANTLR4 的工作流程Lua脚本语法校验准备一个Lua Gramm

Java字符串操作技巧之语法、示例与应用场景分析

《Java字符串操作技巧之语法、示例与应用场景分析》在Java算法题和日常开发中,字符串处理是必备的核心技能,本文全面梳理Java中字符串的常用操作语法,结合代码示例、应用场景和避坑指南,可快速掌握字... 目录引言1. 基础操作1.1 创建字符串1.2 获取长度1.3 访问字符2. 字符串处理2.1 子字

Java Optional的使用技巧与最佳实践

《JavaOptional的使用技巧与最佳实践》在Java中,Optional是用于优雅处理null的容器类,其核心目标是显式提醒开发者处理空值场景,避免NullPointerExce... 目录一、Optional 的核心用途二、使用技巧与最佳实践三、常见误区与反模式四、替代方案与扩展五、总结在 Java

使用Java将DOCX文档解析为Markdown文档的代码实现

《使用Java将DOCX文档解析为Markdown文档的代码实现》在现代文档处理中,Markdown(MD)因其简洁的语法和良好的可读性,逐渐成为开发者、技术写作者和内容创作者的首选格式,然而,许多文... 目录引言1. 工具和库介绍2. 安装依赖库3. 使用Apache POI解析DOCX文档4. 将解析

Qt中QUndoView控件的具体使用

《Qt中QUndoView控件的具体使用》QUndoView是Qt框架中用于可视化显示QUndoStack内容的控件,本文主要介绍了Qt中QUndoView控件的具体使用,具有一定的参考价值,感兴趣的... 目录引言一、QUndoView 的用途二、工作原理三、 如何与 QUnDOStack 配合使用四、自

C++使用printf语句实现进制转换的示例代码

《C++使用printf语句实现进制转换的示例代码》在C语言中,printf函数可以直接实现部分进制转换功能,通过格式说明符(formatspecifier)快速输出不同进制的数值,下面给大家分享C+... 目录一、printf 原生支持的进制转换1. 十进制、八进制、十六进制转换2. 显示进制前缀3. 指

使用Python构建一个Hexo博客发布工具

《使用Python构建一个Hexo博客发布工具》虽然Hexo的命令行工具非常强大,但对于日常的博客撰写和发布过程,我总觉得缺少一个直观的图形界面来简化操作,下面我们就来看看如何使用Python构建一个... 目录引言Hexo博客系统简介设计需求技术选择代码实现主框架界面设计核心功能实现1. 发布文章2. 加

前端CSS Grid 布局示例详解

《前端CSSGrid布局示例详解》CSSGrid是一种二维布局系统,可以同时控制行和列,相比Flex(一维布局),更适合用在整体页面布局或复杂模块结构中,:本文主要介绍前端CSSGri... 目录css Grid 布局详解(通俗易懂版)一、概述二、基础概念三、创建 Grid 容器四、定义网格行和列五、设置行

Node.js 数据库 CRUD 项目示例详解(完美解决方案)

《Node.js数据库CRUD项目示例详解(完美解决方案)》:本文主要介绍Node.js数据库CRUD项目示例详解(完美解决方案),本文给大家介绍的非常详细,对大家的学习或工作具有一定的参考... 目录项目结构1. 初始化项目2. 配置数据库连接 (config/db.js)3. 创建模型 (models/

shell编程之函数与数组的使用详解

《shell编程之函数与数组的使用详解》:本文主要介绍shell编程之函数与数组的使用,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录shell函数函数的用法俩个数求和系统资源监控并报警函数函数变量的作用范围函数的参数递归函数shell数组获取数组的长度读取某下的