JSON数据处理利器——Python JSONPath库详解

2024-04-15 22:04

本文主要是介绍JSON数据处理利器——Python JSONPath库详解,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

🍀 前言

博客地址:

  • CSDN:https://blog.csdn.net/powerbiubiu

👋 简介

JsonPath 是一种信息抽取类库,是从JSON文档中抽取指定信息的工具,提供多种语言实现版本,包括:Javascript、Python、PHP 和 Java。本文介绍Python中JsonPath模块的运用。

📖 正文

1 JSONPath的安装

pip install jsonpath -i https://pypi.tuna.tsinghua.edu.cn/simple

2 JSONPath的语法

JSONPath描述
$表示根元素
@当前元素
. 或者 []子元素
递归下降,JSONPath是从E4X借鉴的
*通配符,所有对象/元素
[,]连接操作符在XPath 结果合并其它结点集合。JSONP允许name或者数组索引
[start🔚step]数组分割操作从ES4借鉴
?()应用过滤表达式
()脚本表达式,使用底层脚本引擎

3 测试数据准备

data = {# 百货商店"store": {"books": [{# 书籍名称"title": "Python编程入门指南",# 书籍作者"author": "John Smith",# 发布日期"publication_date": "2022-01-01",# 书籍编号"isbn": "978-1-234567-89-0",# 出版商"publisher": "ABC Publishing",# 价格"price": 29.99},{"title": "JavaScript高级编程","author": "Emily Johnson","publication_date": "2021-09-15","isbn": "978-9-876543-21-0","publisher": "XYZ Books","price": 39.99},{"title": "数据结构与算法导论","author": "David Chen","publication_date": "2020-05-10","isbn": "978-6-789012-34-5","publisher": "DEF Publications","price": 49.99}],"pens": [{# 品牌"brand": "Pilot",# 模型"model": "G2",# 颜色"ink_color": "Blue",# 尺寸"tip_size_mm": 0.7,# 价格"price": 2.99}]}
}

4 JSONPath的使用

4.1 获取所有商品信息

包含商品名称,表达式等价 $.*

store = jsonpath.jsonpath(data, '$.store')
print(store)# [{'books': [{'title': 'Python编程入门指南', 'author': 'John Smith', 'publication_date': '2022-01-01', 'isbn': '978-1-234567-89-0', 'publisher': 'ABC Publishing', 'price': 29.99}, {'title': 'JavaScript高级编程', 'author': 'Emily Johnson', 'publication_date': '2021-09-15', 'isbn': '978-9-876543-21-0', 'publisher': 'XYZ Books', 'price': 39.99}, {'title': '数据结构与算法导论', 'author': 'David Chen', 'publication_date': '2020-05-10', 'isbn': '978-6-789012-34-5', 'publisher': 'DEF Publications', 'price': 49.99}], 'pens': [{'brand': 'Pilot', 'model': 'G2', 'ink_color': 'Blue', 'tip_size_mm': 0.7, 'price': 2.99}, {'brand': 'Uni-ball', 'model': 'Signo 207', 'ink_color': 'Black', 'tip_size_mm': 0.5, 'price': 3.49}, {'brand': 'Zebra', 'model': 'Sarasa', 'ink_color': 'Red', 'tip_size_mm': 0.7, 'price': 2.79}]}]

不包含商品名称

store = jsonpath.jsonpath(data, '$.store.*')
print(store)# [[{'title': 'Python编程入门指南', 'author': 'John Smith', 'publication_date': '2022-01-01', 'isbn': '978-1-234567-89-0', 'publisher': 'ABC Publishing', 'price': 29.99}, {'title': 'JavaScript高级编程', 'author': 'Emily Johnson', 'publication_date': '2021-09-15', 'isbn': '978-9-876543-21-0', 'publisher': 'XYZ Books', 'price': 39.99}, {'title': '数据结构与算法导论', 'author': 'David Chen', 'publication_date': '2020-05-10', 'isbn': '978-6-789012-34-5', 'publisher': 'DEF Publications', 'price': 49.99}], [{'brand': 'Pilot', 'model': 'G2', 'ink_color': 'Blue', 'tip_size_mm': 0.7, 'price': 2.99}, {'brand': 'Uni-ball', 'model': 'Signo 207', 'ink_color': 'Black', 'tip_size_mm': 0.5, 'price': 3.49}, {'brand': 'Zebra', 'model': 'Sarasa', 'ink_color': 'Red', 'tip_size_mm': 0.7, 'price': 2.79}]]
4.2 获取所有书籍信息
res = jsonpath.jsonpath(data,'$.store.books')
print(res)# [[{'title': 'Python编程入门指南', 'author': 'John Smith', 'publication_date': '2022-01-01', 'isbn': '978-1-234567-89-0', 'publisher': 'ABC Publishing', 'price': 29.99}, {'title': 'JavaScript高级编程', 'author': 'Emily Johnson', 'publication_date': '2021-09-15', 'isbn': '978-9-876543-21-0', 'publisher': 'XYZ Books', 'price': 39.99}, {'title': '数据结构与算法导论', 'author': 'David Chen', 'publication_date': '2020-05-10', 'isbn': '978-6-789012-34-5', 'publisher': 'DEF Publications', 'price': 49.99}]]
4.3 获取所有书籍名称
# 方式一
res1 = jsonpath.jsonpath(data,'$.store.books[*].title')
print(res1)
# 方式二
res2 = jsonpath.jsonpath(data, '$..title')
print(res2)# ['Python编程入门指南', 'JavaScript高级编程', '数据结构与算法导论']
# ['Python编程入门指南', 'JavaScript高级编程', '数据结构与算法导论']
4.4 获取第一本书籍的信息
res = jsonpath.jsonpath(data, '$.store.books[0]')
print(res)# [{'title': 'Python编程入门指南', 'author': 'John Smith', 'publication_date': '2022-01-01', 'isbn': '978-1-234567-89-0', 'publisher': 'ABC Publishing', 'price': 29.99}]
4.5 获取最后一本书籍的信息
res = jsonpath.jsonpath(data, '$.store.books[(@.length-1)]')
print(res)# [{'title': '数据结构与算法导论', 'author': 'David Chen', 'publication_date': '2020-05-10', 'isbn': '978-6-789012-34-5', 'publisher': 'DEF Publications', 'price': 49.99}]
4.6 获取前两本书籍的信息

表达式等价 . s t o r e . b o o k s [ 0 , 1 ] , .store.books[0,1], .store.books[0,1].store.books[:2]

# 获取前面的两本书
res = jsonpath.jsonpath(data, '$..books[0,1]') 
print(res)# [{'title': 'Python编程入门指南', 'author': 'John Smith', 'publication_date': '2022-01-01', 'isbn': '978-1-234567-89-0', 'publisher': 'ABC Publishing', 'price': 29.99}, {'title': 'JavaScript高级编程', 'author': 'Emily Johnson', 'publication_date': '2021-09-15', 'isbn': '978-9-876543-21-0', 'publisher': 'XYZ Books', 'price': 39.99}]
4.7 获取第一本书籍的作者
res = jsonpath.jsonpath(data,'$.store.books[0].author')
print(res)# ['John Smith']

Tips:
当前书籍只有3本,所以索引取值为[0,1,2],如果索引越界,返回的结果为false

4.8 获取所有商品的价格

会把store中所有商品(books,pens)的价格都获取出来

res = jsonpath.jsonpath(data, '$.store.*..price')
print(res)# [29.99, 39.99, 49.99, 2.99, 3.49, 2.79]
4.9 过滤有编号的书籍
res = jsonpath.jsonpath(data, '$..books[?(@.isbn)]')
print(res)# [{'title': 'Python编程入门指南', 'author': 'John Smith', 'publication_date': '2022-01-01', 'isbn': '978-1-234567-89-0', 'publisher': 'ABC Publishing', 'price': 29.99}, {'title': 'JavaScript高级编程', 'author': 'Emily Johnson', 'publication_date': '2021-09-15', 'isbn': '978-9-876543-21-0', 'publisher': 'XYZ Books', 'price': 39.99}, {'title': '数据结构与算法导论', 'author': 'David Chen', 'publication_date': '2020-05-10', 'isbn': '978-6-789012-34-5', 'publisher': 'DEF Publications', 'price': 49.99}]
4.10 过滤价格大于40的书籍
res = jsonpath.jsonpath(data, '$..books[?(@.price>40)]')
print(res)# [{'title': '数据结构与算法导论', 'author': 'David Chen', 'publication_date': '2020-05-10', 'isbn': '978-6-789012-34-5', 'publisher': 'DEF Publications', 'price': 49.99}]
4.11 过滤书籍名称包含Python的书籍
res = jsonpath.jsonpath(data, '$..books[?("Python" in @.title)]')
print(res)# [{'title': 'Python编程入门指南', 'author': 'John Smith', 'publication_date': '2022-01-01', 'isbn': '978-1-234567-89-0', 'publisher': 'ABC Publishing', 'price': 29.99}]

💖 欢迎关注我的公众号

在这里插入图片描述

这篇关于JSON数据处理利器——Python JSONPath库详解的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/907050

相关文章

Conda与Python venv虚拟环境的区别与使用方法详解

《Conda与Pythonvenv虚拟环境的区别与使用方法详解》随着Python社区的成长,虚拟环境的概念和技术也在不断发展,:本文主要介绍Conda与Pythonvenv虚拟环境的区别与使用... 目录前言一、Conda 与 python venv 的核心区别1. Conda 的特点2. Python v

Spring Boot中WebSocket常用使用方法详解

《SpringBoot中WebSocket常用使用方法详解》本文从WebSocket的基础概念出发,详细介绍了SpringBoot集成WebSocket的步骤,并重点讲解了常用的使用方法,包括简单消... 目录一、WebSocket基础概念1.1 什么是WebSocket1.2 WebSocket与HTTP

Python使用python-can实现合并BLF文件

《Python使用python-can实现合并BLF文件》python-can库是Python生态中专注于CAN总线通信与数据处理的强大工具,本文将使用python-can为BLF文件合并提供高效灵活... 目录一、python-can 库:CAN 数据处理的利器二、BLF 文件合并核心代码解析1. 基础合

java中反射Reflection的4个作用详解

《java中反射Reflection的4个作用详解》反射Reflection是Java等编程语言中的一个重要特性,它允许程序在运行时进行自我检查和对内部成员(如字段、方法、类等)的操作,本文将详细介绍... 目录作用1、在运行时判断任意一个对象所属的类作用2、在运行时构造任意一个类的对象作用3、在运行时判断

Python使用OpenCV实现获取视频时长的小工具

《Python使用OpenCV实现获取视频时长的小工具》在处理视频数据时,获取视频的时长是一项常见且基础的需求,本文将详细介绍如何使用Python和OpenCV获取视频时长,并对每一行代码进行深入解析... 目录一、代码实现二、代码解析1. 导入 OpenCV 库2. 定义获取视频时长的函数3. 打开视频文

MySQL 中的 CAST 函数详解及常见用法

《MySQL中的CAST函数详解及常见用法》CAST函数是MySQL中用于数据类型转换的重要函数,它允许你将一个值从一种数据类型转换为另一种数据类型,本文给大家介绍MySQL中的CAST... 目录mysql 中的 CAST 函数详解一、基本语法二、支持的数据类型三、常见用法示例1. 字符串转数字2. 数字

SpringBoot中SM2公钥加密、私钥解密的实现示例详解

《SpringBoot中SM2公钥加密、私钥解密的实现示例详解》本文介绍了如何在SpringBoot项目中实现SM2公钥加密和私钥解密的功能,通过使用Hutool库和BouncyCastle依赖,简化... 目录一、前言1、加密信息(示例)2、加密结果(示例)二、实现代码1、yml文件配置2、创建SM2工具

MyBatis-Plus 中 nested() 与 and() 方法详解(最佳实践场景)

《MyBatis-Plus中nested()与and()方法详解(最佳实践场景)》在MyBatis-Plus的条件构造器中,nested()和and()都是用于构建复杂查询条件的关键方法,但... 目录MyBATis-Plus 中nested()与and()方法详解一、核心区别对比二、方法详解1.and()

Python中你不知道的gzip高级用法分享

《Python中你不知道的gzip高级用法分享》在当今大数据时代,数据存储和传输成本已成为每个开发者必须考虑的问题,Python内置的gzip模块提供了一种简单高效的解决方案,下面小编就来和大家详细讲... 目录前言:为什么数据压缩如此重要1. gzip 模块基础介绍2. 基本压缩与解压缩操作2.1 压缩文

Spring IoC 容器的使用详解(最新整理)

《SpringIoC容器的使用详解(最新整理)》文章介绍了Spring框架中的应用分层思想与IoC容器原理,通过分层解耦业务逻辑、数据访问等模块,IoC容器利用@Component注解管理Bean... 目录1. 应用分层2. IoC 的介绍3. IoC 容器的使用3.1. bean 的存储3.2. 方法注