RDF Refine(Open Refine + RDF Refine)使用笔记

2023-10-08 16:38
文章标签 使用 笔记 open refine rdf

本文主要是介绍RDF Refine(Open Refine + RDF Refine)使用笔记,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

RDF Refine(Open Refine + RDF Refine)使用示例

Open Refine(原名 Google Refine)是一个用来管理杂乱数据,进行整理与扩展的工具。如今的最新版是2.5,beta版为2.6 beta。
本文使用Open Refine同时借助RDF Refine扩展,对一个图书管理csv文件进行整理与扩展操作。最后导出为RDF格式的语义数据。

Open Refine(used name: Gooele Refine)安装

官方网址:

https://github.com/OpenRefine/OpenRefine/wiki/Installation-Instructions#linux

1、下载对应平台的安装包

2、解压

3、运行(Linux下直接运行./refine)

4、输入127.0.0.1:3333即可访问Google Refine的网址

5、如果需要接收任何ip地址发出的请求,需要在命令行运行时输入./refine -i0.0.0.0

 

 

安装RDF Refine

http://refine.deri.ie/下载RDF Refine的extension包,放在Google Refine的webapp/extensions里面。重启Google Refine

在Project管理页面右上角看到下图所示RDF选项,说明加载成功。

 

增加reconciliation service

点击右上角RDF,选择Add reconciliationservice,在选择based on SPARQL

 

按照下图所示填写详细信息


注意Endpoint Type选择Virtuoso

在reconciliation结果的优化中可以对Label properties进行选择,可以选择other,然后手动键入URI

 

进行Reconciliation过程

如下图所示的上传内存中,我们点击name那里的下拉按钮,选择startreconciliation


然后选择DBpedia,经过一番计算与处理之后,中央的一个列表给出了一系列类型候选项。选择一项我们认为最为认可的type。

 

在持续了8分钟(具体耗时根据网络状况而定)的信息抽取与处理之后,pre-reconciliation终于给了我们一个列表:

 

我们选择dbo:Book这个类型,然后为了简便起见,直接点击StartReconciliation

 

这个提示框告诉我们reconciliation过程的进度

 

如下图所示,我们已经部分完成了reconciliation的过程


左侧边栏:


在name一栏有匹配到book name与未匹配到任何信息两类数据,exclude为删除对应的条目。

而下方的柱状图表可以用来拖拽,显示不同候选分值的条目用来显示。同时,点击change,我们可以对分值进行修改与自定义计算。

 

人工优化reconciliation结果


这里的两个勾选可以对user认为正确的条目进行确认。

 

在下面这个条目中有很多候选选项,本身的名字非常具有歧义性,所以需要用户进行更为细致的确认。

点击其中的候选项,查看详细信息。通过作者的匹配,基本上确认这本书在DBpedia中的具体条目。





 

同样对作者一栏进行reconciliation

 

结果中只有一个条目没有得到对应的匹配结果,我们选择新建这个条目


 

定义Schema信息

接下来定义schema信息


 

修改Base URI


 

添加主语属性:


 

添加类型信息:


点击这里的property修改谓语属性URI,先点击其中一个输入dc:title,点击确定加载,然后再相同操作输入一遍即可选择对应的谓语URI


 

修改后如下:



点击preview即可进行预览:


 

这里可以修改每一个宾语的类型信息。


 

添加一个property:

 

对添加的谓语所对应的宾语进行设置:


preview/edit对话框中,输入cell.recon.match.id


此时在预览框我们看到了和DBpedia中URI的对应关系:


 

添加另外一个属性:foaf:maker,同时选中Used As a URI

 

 

在预览框中我们可以看到新添加的内容:



我们点击OK,结束RDF Skeleton过程。

 

导出RDF文件

最后点击Export,选择RDF/XML,导出为RDF XML文件。

 

这篇关于RDF Refine(Open Refine + RDF Refine)使用笔记的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/166613

相关文章

如何使用Docker部署FTP和Nginx并通过HTTP访问FTP里的文件

《如何使用Docker部署FTP和Nginx并通过HTTP访问FTP里的文件》本文介绍了如何使用Docker部署FTP服务器和Nginx,并通过HTTP访问FTP中的文件,通过将FTP数据目录挂载到N... 目录docker部署FTP和Nginx并通过HTTP访问FTP里的文件1. 部署 FTP 服务器 (

MySQL 日期时间格式化函数 DATE_FORMAT() 的使用示例详解

《MySQL日期时间格式化函数DATE_FORMAT()的使用示例详解》`DATE_FORMAT()`是MySQL中用于格式化日期时间的函数,本文详细介绍了其语法、格式化字符串的含义以及常见日期... 目录一、DATE_FORMAT()语法二、格式化字符串详解三、常见日期时间格式组合四、业务场景五、总结一、

Python中配置文件的全面解析与使用

《Python中配置文件的全面解析与使用》在Python开发中,配置文件扮演着举足轻重的角色,它们允许开发者在不修改代码的情况下调整应用程序的行为,下面我们就来看看常见Python配置文件格式的使用吧... 目录一、INI配置文件二、YAML配置文件三、jsON配置文件四、TOML配置文件五、XML配置文件

Go使用pprof进行CPU,内存和阻塞情况分析

《Go使用pprof进行CPU,内存和阻塞情况分析》Go语言提供了强大的pprof工具,用于分析CPU、内存、Goroutine阻塞等性能问题,帮助开发者优化程序,提高运行效率,下面我们就来深入了解下... 目录1. pprof 介绍2. 快速上手:启用 pprof3. CPU Profiling:分析 C

MySQL InnoDB引擎ibdata文件损坏/删除后使用frm和ibd文件恢复数据

《MySQLInnoDB引擎ibdata文件损坏/删除后使用frm和ibd文件恢复数据》mysql的ibdata文件被误删、被恶意修改,没有从库和备份数据的情况下的数据恢复,不能保证数据库所有表数据... 参考:mysql Innodb表空间卸载、迁移、装载的使用方法注意!此方法只适用于innodb_fi

Python中conda虚拟环境创建及使用小结

《Python中conda虚拟环境创建及使用小结》本文主要介绍了Python中conda虚拟环境创建及使用小结,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们... 目录0.前言1.Miniconda安装2.conda本地基本操作3.创建conda虚拟环境4.激活c

Spring中@Lazy注解的使用技巧与实例解析

《Spring中@Lazy注解的使用技巧与实例解析》@Lazy注解在Spring框架中用于延迟Bean的初始化,优化应用启动性能,它不仅适用于@Bean和@Component,还可以用于注入点,通过将... 目录一、@Lazy注解的作用(一)延迟Bean的初始化(二)与@Autowired结合使用二、实例解

SpringBoot使用Jasypt对YML文件配置内容加密的方法(数据库密码加密)

《SpringBoot使用Jasypt对YML文件配置内容加密的方法(数据库密码加密)》本文介绍了如何在SpringBoot项目中使用Jasypt对application.yml文件中的敏感信息(如数... 目录SpringBoot使用Jasypt对YML文件配置内容进行加密(例:数据库密码加密)前言一、J

Spring Boot 中正确地在异步线程中使用 HttpServletRequest的方法

《SpringBoot中正确地在异步线程中使用HttpServletRequest的方法》文章讨论了在SpringBoot中如何在异步线程中正确使用HttpServletRequest的问题,... 目录前言一、问题的来源:为什么异步线程中无法访问 HttpServletRequest?1. 请求上下文与线

在 Spring Boot 中使用异步线程时的 HttpServletRequest 复用问题记录

《在SpringBoot中使用异步线程时的HttpServletRequest复用问题记录》文章讨论了在SpringBoot中使用异步线程时,由于HttpServletRequest复用导致... 目录一、问题描述:异步线程操作导致请求复用时 Cookie 解析失败1. 场景背景2. 问题根源二、问题详细分