SQL的弱点(1):复杂SQL不易理解,以及软件工程如何来帮忙

2023-11-06 19:30

本文主要是介绍SQL的弱点(1):复杂SQL不易理解,以及软件工程如何来帮忙,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

1. SQL是经久不衰的基础

能经过时间考验的SQL,其优点毋庸置疑。

对于日常处理数据的朋友们(BI顾问,数据开发,数仓建模,数据研发,ETL工程师,AI工程师等),SQL更是一项非常重要的基础技能。

这里就不再列举SQL的优点了(很多),而只谈谈SQL使用中的一些问题,这里是系列文章的开篇:复杂SQL不易理解。

2. 讲故事

先讲个故事来示例,注:

  • 示例中的表和场景都是经过简化的,实际中可能复杂非常多
  • 示例的SQL都不保证是最优的写法
  • 示例中的表结构也只是示例作用

数据开发工程师小吴在一家零售企业工作,他最近的工作就是帮助运营小胡分析客户画像。

公司有2张表,都是直接存储在最简单好用的 Postgresql 12.2 数据库中:

  • orders:订单表
  • customers:客户表

具体内容如下:

orders:

customers

2.1 Step1 - 需要统计每个 customer_id 的总消费额

小吴快速的写了个SQL:

  1. SELECT
  2. customer_id,
  3. SUM(unit * unit_price *(1- discount)) AS total_sales
  4. FROM orders
  5. GROUP BY customer_id
  6. ORDER BY total_sales DESC

注:小吴是处女座的,所以SQL还是要经过排版的, 数据也是排好序的。

得到了如下结果:

2.2 Step2 - 加上客户名和过滤掉非正常用户

小胡很快给出了反馈:

  1. 虽然你是开发,你熟悉于直接用ID称呼客户,但是我不习惯, 我需要看中文名字
  2. 这个客户ID 2, 我记得很清楚, 是我们的测试用户,上次我们上线后,我就把它从数据库中标记 is_delete 为 True 了,你需要去除掉

小吴说:好的

在解决了如下问题后:

  1. 查阅了JOIN的几种语法
  2. 通过表别名解决了错误:column reference "customer_id" is ambiguous
  3. 通过 max() 解决了错误:column "customers.customer_name" must appear in the GROUP BY clause or be used in an aggregate function

得到了如下SQL (注意:修改散落在多个地方)

  1. SELECT
  2. orders.customer_id,
  3. MAX(customer_name) AS customer_name,
  4. SUM(unit * unit_price *(1- discount)) AS total_sales
  5. FROM orders JOIN customers
  6. ON orders.customer_id = customers.customer_id
  7. WHERE customers.is_delete=False
  8. GROUP BY orders.customer_id
  9. ORDER BY total_sales DESC

得到结果:

2.3 Step3 - 复杂的任务来了,要把客户分等级了

运营同学在阿里进修了一门《人人都可以当运营》课程,回来对数据小吴说:小吴呀,我们的会员体系要做起来呀,会员是我们以后上市的支柱,即使对我们的天使轮也是非常有用的呀。而且我学到了:“一定要结合客户所在地做会员分级”,所以,我决定:

  1. 对于所在地在”上海“的客户:如果他/她的消费额 >= 300, 那么他/她是白金会员,如果在区间 [100, 300), 则是黄金会员,否则就是普通会员
  2. 对于所在地为”杭州“的客户:如果他/她的消费额 >= 250, 那么他/她是白金会员,如果在区间 [80, 250), 则是黄金会员,否则就是普通会员

小吴这下要好好考虑这个问题了。

2.3.1 同一层SQL上改

首先,他试着在上步骤的SQL中,直接把会员等级这个直接算出来,

  1. SELECT
  2. orders.customer_id,
  3. MAX(customer_name) AS customer_name,
  4. SUM(unit * unit_price *(1

这篇关于SQL的弱点(1):复杂SQL不易理解,以及软件工程如何来帮忙的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/358612

相关文章

深入理解C++ 空类大小

《深入理解C++空类大小》本文主要介绍了C++空类大小,规定空类大小为1字节,主要是为了保证对象的唯一性和可区分性,满足数组元素地址连续的要求,下面就来了解一下... 目录1. 保证对象的唯一性和可区分性2. 满足数组元素地址连续的要求3. 与C++的对象模型和内存管理机制相适配查看类对象内存在C++中,规

Mysql 中的多表连接和连接类型详解

《Mysql中的多表连接和连接类型详解》这篇文章详细介绍了MySQL中的多表连接及其各种类型,包括内连接、左连接、右连接、全外连接、自连接和交叉连接,通过这些连接方式,可以将分散在不同表中的相关数据... 目录什么是多表连接?1. 内连接(INNER JOIN)2. 左连接(LEFT JOIN 或 LEFT

mysql重置root密码的完整步骤(适用于5.7和8.0)

《mysql重置root密码的完整步骤(适用于5.7和8.0)》:本文主要介绍mysql重置root密码的完整步骤,文中描述了如何停止MySQL服务、以管理员身份打开命令行、替换配置文件路径、修改... 目录第一步:先停止mysql服务,一定要停止!方式一:通过命令行关闭mysql服务方式二:通过服务项关闭

SQL Server数据库磁盘满了的解决办法

《SQLServer数据库磁盘满了的解决办法》系统再正常运行,我还在操作中,突然发现接口报错,后续所有接口都报错了,一查日志发现说是数据库磁盘满了,所以本文记录了SQLServer数据库磁盘满了的解... 目录问题解决方法删除数据库日志设置数据库日志大小问题今http://www.chinasem.cn天发

mysql主从及遇到的问题解决

《mysql主从及遇到的问题解决》本文详细介绍了如何使用Docker配置MySQL主从复制,首先创建了两个文件夹并分别配置了`my.cnf`文件,通过执行脚本启动容器并配置好主从关系,文中还提到了一些... 目录mysql主从及遇到问题解决遇到的问题说明总结mysql主从及遇到问题解决1.基于mysql

java poi实现Excel多级表头导出方式(多级表头,复杂表头)

《javapoi实现Excel多级表头导出方式(多级表头,复杂表头)》文章介绍了使用javapoi库实现Excel多级表头导出的方法,通过主代码、合并单元格、设置表头单元格宽度、填充数据、web下载... 目录Java poi实现Excel多级表头导出(多级表头,复杂表头)上代码1.主代码2.合并单元格3.

MySQL的索引失效的原因实例及解决方案

《MySQL的索引失效的原因实例及解决方案》这篇文章主要讨论了MySQL索引失效的常见原因及其解决方案,它涵盖了数据类型不匹配、隐式转换、函数或表达式、范围查询、LIKE查询、OR条件、全表扫描、索引... 目录1. 数据类型不匹配2. 隐式转换3. 函数或表达式4. 范围查询之后的列5. like 查询6

Linux下MySQL8.0.26安装教程

《Linux下MySQL8.0.26安装教程》文章详细介绍了如何在Linux系统上安装和配置MySQL,包括下载、解压、安装依赖、启动服务、获取默认密码、设置密码、支持远程登录以及创建表,感兴趣的朋友... 目录1.找到官网下载位置1.访问mysql存档2.下载社区版3.百度网盘中2.linux安装配置1.

PostgreSQL如何用psql运行SQL文件

《PostgreSQL如何用psql运行SQL文件》文章介绍了两种运行预写好的SQL文件的方式:首先连接数据库后执行,或者直接通过psql命令执行,需要注意的是,文件路径在Linux系统中应使用斜杠/... 目录PostgreSQ编程L用psql运行SQL文件方式一方式二总结PostgreSQL用psql运

SQL中的外键约束

外键约束用于表示两张表中的指标连接关系。外键约束的作用主要有以下三点: 1.确保子表中的某个字段(外键)只能引用父表中的有效记录2.主表中的列被删除时,子表中的关联列也会被删除3.主表中的列更新时,子表中的关联元素也会被更新 子表中的元素指向主表 以下是一个外键约束的实例展示