【数据产品案例】如何将知识图谱特征学习应用到推荐系统?

2024-09-06 04:18

本文主要是介绍【数据产品案例】如何将知识图谱特征学习应用到推荐系统?,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

案例来源:@AI科技大本营
案例地址: https://mp.weixin.qq.com/s/_LuF4d0X_oHKuweo7Bt1Wg

1. 知识图谱应用到推荐系统中的三种方式
1)依次学习:先训练知识图谱模型,得到实体和实体关系的向量表示;再将该向量作为推荐模型的输入
2)联合学习:将知识图谱和推荐系统的目标函数结合,使用端到端的方式训练
3)交替学习:将知识图谱和推荐系统的训练放在一起,使用多任务学习的框架进行训练

2. 依次学习 - Deep Knowledge-Aware Network (DKN)
1)引入知识图谱特征:
a. 实体连接:将文中发现的词汇与实体进行匹配
b. 知识图谱构建:根据匹配的实体,从知识图谱中抽取出子图
c. 知识图谱特征学习:使用知识图谱特征学习算法(如TransE)学习实体的向量表示
d. 实体的上下文实体特征:一个实体e的上下文是实体的一跳近邻,e的上下文表示就是一跳近邻特征的平均值
2)构建推荐模型
a. 基于卷积神经网络的文本特征提取:新闻标题词向量、实体向量、实体上下文向量作为多通道,在CNN框架下进行融合
b. 基于注意力机制的用户历史兴趣融合:在判断用户对当前新闻的兴趣时,使用注意力网络给用户历史记录分配不同的权重
3)依次学习的优势在于将知识图谱训练与推荐系统训练分离,前者更新少、训练开销大。但缺点也来源于此,无法端到端训练,知识图谱的训练并不是为了推荐目标而来,不一定适应特定的推荐任务

3. 联合学习 - Collaborative Knowledge base Embedding (CKE)
1)对于结构数据(如导演、电影名):采用TransR进行学习,可以得到实体的特征表示
2)对于文本数据:采用去燥自编码器抽取向量化特征
3)对于图像数据:采用卷积-反卷积自编码器抽取向量化特征
4)将以上三种知识学习的目标函数与协同过滤的目标函数结合,得到以下联合损失函数
5)使用梯度下降法训练

4. 联合学习 - Ripple Network
1)基本思想:用户的兴趣以历史记录中的实体为中心,向外扩散并逐渐衰弱
2)过程【看不懂】:

5. 交替学习 - Multi-task Learning for KG enhanced Recommendation (MKR)
1)出发点:推荐算法中的物品和知识图谱中的实体存在重合,两者的学习存在相关性,两者信息可以互补
2)框架如图:
a. 左侧推荐任务的输入是用户和物品,输出是点击概率
b. 右侧知识图谱学习的任务输入是三元组和关系表示,输出是特征表示
c. 中间设计了交叉特征共享单元:

3)优势:知识图谱特征学习模块在下一次训练中可以继续使用,不用像联合学习一样从头开始学习

这篇关于【数据产品案例】如何将知识图谱特征学习应用到推荐系统?的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1140976

相关文章

Java深度学习库DJL实现Python的NumPy方式

《Java深度学习库DJL实现Python的NumPy方式》本文介绍了DJL库的背景和基本功能,包括NDArray的创建、数学运算、数据获取和设置等,同时,还展示了如何使用NDArray进行数据预处理... 目录1 NDArray 的背景介绍1.1 架构2 JavaDJL使用2.1 安装DJL2.2 基本操

在不同系统间迁移Python程序的方法与教程

《在不同系统间迁移Python程序的方法与教程》本文介绍了几种将Windows上编写的Python程序迁移到Linux服务器上的方法,包括使用虚拟环境和依赖冻结、容器化技术(如Docker)、使用An... 目录使用虚拟环境和依赖冻结1. 创建虚拟环境2. 冻结依赖使用容器化技术(如 docker)1. 创

使用Navicat工具比对两个数据库所有表结构的差异案例详解

《使用Navicat工具比对两个数据库所有表结构的差异案例详解》:本文主要介绍如何使用Navicat工具对比两个数据库test_old和test_new,并生成相应的DDLSQL语句,以便将te... 目录概要案例一、如图两个数据库test_old和test_new进行比较:二、开始比较总结概要公司存在多

Redis的数据过期策略和数据淘汰策略

《Redis的数据过期策略和数据淘汰策略》本文主要介绍了Redis的数据过期策略和数据淘汰策略,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一... 目录一、数据过期策略1、惰性删除2、定期删除二、数据淘汰策略1、数据淘汰策略概念2、8种数据淘汰策略

轻松上手MYSQL之JSON函数实现高效数据查询与操作

《轻松上手MYSQL之JSON函数实现高效数据查询与操作》:本文主要介绍轻松上手MYSQL之JSON函数实现高效数据查询与操作的相关资料,MySQL提供了多个JSON函数,用于处理和查询JSON数... 目录一、jsON_EXTRACT 提取指定数据二、JSON_UNQUOTE 取消双引号三、JSON_KE

CentOS系统Maven安装教程分享

《CentOS系统Maven安装教程分享》本文介绍了如何在CentOS系统中安装Maven,并提供了一个简单的实际应用案例,安装Maven需要先安装Java和设置环境变量,Maven可以自动管理项目的... 目录准备工作下载并安装Maven常见问题及解决方法实际应用案例总结Maven是一个流行的项目管理工具

Python给Excel写入数据的四种方法小结

《Python给Excel写入数据的四种方法小结》本文主要介绍了Python给Excel写入数据的四种方法小结,包含openpyxl库、xlsxwriter库、pandas库和win32com库,具有... 目录1. 使用 openpyxl 库2. 使用 xlsxwriter 库3. 使用 pandas 库

SpringBoot定制JSON响应数据的实现

《SpringBoot定制JSON响应数据的实现》本文主要介绍了SpringBoot定制JSON响应数据的实现,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们... 目录前言一、如何使用@jsonView这个注解?二、应用场景三、实战案例注解方式编程方式总结 前言

使用Python在Excel中创建和取消数据分组

《使用Python在Excel中创建和取消数据分组》Excel中的分组是一种通过添加层级结构将相邻行或列组织在一起的功能,当分组完成后,用户可以通过折叠或展开数据组来简化数据视图,这篇博客将介绍如何使... 目录引言使用工具python在Excel中创建行和列分组Python在Excel中创建嵌套分组Pyt

MySQL 缓存机制与架构解析(最新推荐)

《MySQL缓存机制与架构解析(最新推荐)》本文详细介绍了MySQL的缓存机制和整体架构,包括一级缓存(InnoDBBufferPool)和二级缓存(QueryCache),文章还探讨了SQL... 目录一、mysql缓存机制概述二、MySQL整体架构三、SQL查询执行全流程四、MySQL 8.0为何移除查