MySQL分库分表多维度查询——全表冗余

2023-10-12 17:30

本文主要是介绍MySQL分库分表多维度查询——全表冗余,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

分表分库面临的问题

MySQL分库分表,一般只能按照一个维度进行查询.
以订单表为例, 按照用户ID mod 64 分成 64个数据库.
按照用户的维度查询很快,因为最终的查询落在一台服务器上.

非分区逻辑字段查询

但是如果按照商户的维度查询,则代价非常高.
需要查询全部64台服务器.

分页查询

在分页的情况下,更加恶化.
比如某个商户查询第10页的数据(按照订单的创建时间).需要在每台数据库服务器上查询前100条数据,程序收到 64*100 条数据,然后按照订单的创建时间排序,截取排名90-100号的10条记录返回,然后抛弃其余的6390条记录.如果查询的是第100页,第1000页,则对数据库IO,网络,中间件CPU,都是不小的压力.

常见解决方案

分库分表之后,为了应对多维度查询,很多情况下会引入冗余.

  • 全表冗余

全表冗余

比如两个集群,一个按照用户ID分库分表,另外一个按照商户ID分库分表.
这样多维度查询的时候,各查各的.
但是有几个问题,一样不好解决.
比如,
每扩展一个维度,就需要引入一个集群.
集群间的数据,如何保证一致性.
冗余占用大量磁盘空间.
从朋友那里看到的订单表结构.做冗余会占用大量的磁盘空间.

用户ID分表分库和商户ID分表分库实际操作

关键问题:保持两份数据的一致性。
通过消息中间件保持事务操作,然后分表进行入库操作,保持最终一致性。

案例
create table TS_ORDER  
(  ORDER_ID        NUMBER(8) not null,  SN              VARCHAR2(50),  MEMBER_ID       NUMBER(8),  STATUS          NUMBER(2),  PAY_STATUS      NUMBER(2),  SHIP_STATUS     NUMBER(2),  SHIPPING_ID     NUMBER(8),  SHIPPING_TYPE   VARCHAR2(255),  SHIPPING_AREA   VARCHAR2(255),  PAYMENT_ID      NUMBER(8),  PAYMENT_NAME    VARCHAR2(50),  PAYMENT_TYPE    VARCHAR2(50),  PAYMONEY        NUMBER(20,2),  CREATE_TIME     NUMBER(20) not null,  SHIP_NAME       VARCHAR2(255),  SHIP_ADDR       VARCHAR2(255),  SHIP_ZIP        VARCHAR2(20),  SHIP_EMAIL      VARCHAR2(50),  SHIP_MOBILE     VARCHAR2(50),  SHIP_TEL        VARCHAR2(50),  SHIP_DAY        VARCHAR2(255),  SHIP_TIME       VARCHAR2(255),  IS_PROTECT      VARCHAR2(1),  PROTECT_PRICE   NUMBER(20,2),  GOODS_AMOUNT    NUMBER(20,2),  SHIPPING_AMOUNT NUMBER(20,2),  ORDER_AMOUNT    NUMBER(20,2),  WEIGHT          NUMBER(20,2),  GOODS_NUM       NUMBER(8),  GAINEDPOINT     NUMBER(11) default 0,  CONSUMEPOINT    NUMBER(11) default 0,  DISABLED        VARCHAR2(1),  DISCOUNT        NUMBER(20,2),  IMPORTED        NUMBER(2) default 0,  PIMPORTED       NUMBER(2) default 0,  COMPLETE_TIME   NUMBER(11) default 0,  CANCEL_REASON   VARCHAR2(255),  SIGNING_TIME    NUMBER(11),  THE_SIGN        VARCHAR2(255),  ALLOCATION_TIME NUMBER(11),  SHIP_PROVINCEID NUMBER(11),  SHIP_CITYID     NUMBER(11),  SHIP_REGIONID   NUMBER(11),  SALE_CMPL       NUMBER(2),  SALE_CMPL_TIME  NUMBER(11),  DEPOTID         NUMBER(11),  ADMIN_REMARK    VARCHAR2(1000),  COMPANY_CODE    VARCHAR2(32),  PARENT_SN       VARCHAR2(50),  REMARK          VARCHAR2(100),  GOODS           CLOB,  ORIGINAL_AMOUNT NUMBER(20,2),  IS_ONLINE       CHAR(1),  IS_COMMENTED    CHAR(1) default 0,  ORDER_FLAG      CHAR(1) default 1  
)  

可以试试用表代替索引的方法.
1.分库分表
2.最终一致性
3.用表代替索引的功能
在这里插入图片描述
首先,还是基于分库分表.订单表按照用户ID mod 64 分到不同的服务器上(按照查询最多的维度分)。

数据库服务器1 的数据库名称为 db_1
数据库服务器2 的数据库名称为 db_2

以db_1为例,创建如下表
1.订单表
TS_ORDER_1 分区表,每个月一个分区.

2.事务表
create table tran_log_1(
tran_id bigint primary key,
param varchar(2000)
);
分区表,每个月一个分区.

3.消息表
create table msg_log_1(
tran_id bigint,
shardKey varchar(20) not null,
primary key(tran_id,shardKey)
);
分区表,每个月一个分区.

4.维度索引表
create table shard_shop_1(
id bigint primary key auto_increment,
shopid int,
ts timestamp,
state int,
dbid int,
orderid bigint,
index(shopid,ts,state)
);
分区表,每个月一个分区.

关于使用事务表,消息表实现分库分表最终一致性请参考
http://blog.itpub.net/29254281/viewspace-1819422/

关于集群主键生成服务请参考
http://blog.itpub.net/29254281/viewspace-1811711/

订单创建的流程
Web服务器接收到用户订单,首先通过RPC获取一个事务ID(tran_id).
用事务ID mod 64 找到数据库服务器,
将事务ID,参数写入tran_log 表,
然后将事务ID,参数写入消息队列.
如果写入消息队列成功,则提交事务.否则回滚事务.
此时就可以返回用户界面.

后端处理服务收到消息队列的信息,首先查询tran_log 表,是否存在这个事务ID,如果不存在则不予处理.
然后将队列的消息,分为两个维度分别处理,一个是用户维度,一个是商户维度.
作为用户维度,
先根据用户ID mod 64 找到最终落地的数据库,查询那个数据库的消息表msg_log,在用户维度,是否存在这个事务ID,如果存在,则不予处理.
(select count(*) from msg_log_XX where shardKey=‘订单创建:用户维度’ and tran_id=?)
如果不存在,则开启一个事务
插入订单表,我觉得可以用tran_id直接作为订单的ID,
并且插入消息表 insert msg_log_XX(tran_id,shardKey) values(?,‘订单创建:用户维度’);
提交事务,commit.

作为商户维度,
则根据商户ID mod 64 找到最终的数据库,和用户维度的数据库,可能不是同一台服务器.
同样,也是先查询落地数据库的消息表,
(select count(*) from msg_log_XXX where shardKey=‘订单创建:商户维度’ and tran_id=?)
如果不存在记录,则开启事务,
插入维度索引表,
insert into shard_shop_XXX(shopid,ts,state,dbid,orderid) values(…)
shopid,ts,state 商户ID,订单时间,订单状态都是根据订单的原始信息.
dbid 指的是 根据用户维度(主维度),订单数据所在的数据库ID,
orderid 指的是 在用户维度(主维度),订单表的主键.

插入消息表,insert msg_log_XX(tran_id,shardKey) values(?,‘订单创建:商户维度’);
最后提交.

这样,作为商户维度查询的时候,先根据商户的ID mod 64 找到 维度索引表,获取该商户的订单信息
select * from shard_shop_1 where shopid=? and state=2 order by ts limit 300,10;
获取的信息可能如下
在这里插入图片描述
可以看到,符合条件的订单信息,分别来自 服务器1,2,16,32,64
获取了这部分信息,就可以直接去这些服务器上取数据,并且是主键查询,速度很快.

每隔一段时间,由后台程序,查看 tran_log和msg_log,如果发现有缺失的数据,则进行事务补偿.

扩展的时候,则新增维度索引表即可.

因为所有的表,都是按月的分区表,可以将过去的冷数据,在一个服务器集中存放,这个实例就同时存放64个数据库.毕竟都是冷数据,访问量很小.
能分还要能合.比如:

参考文章:
http://blog.itpub.net/29254281/viewspace-2086198/

这篇关于MySQL分库分表多维度查询——全表冗余的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/197345

相关文章

MySQL查询JSON数组字段包含特定字符串的方法

《MySQL查询JSON数组字段包含特定字符串的方法》在MySQL数据库中,当某个字段存储的是JSON数组,需要查询数组中包含特定字符串的记录时传统的LIKE语句无法直接使用,下面小编就为大家介绍两种... 目录问题背景解决方案对比1. 精确匹配方案(推荐)2. 模糊匹配方案参数化查询示例使用场景建议性能优

mysql表操作与查询功能详解

《mysql表操作与查询功能详解》本文系统讲解MySQL表操作与查询,涵盖创建、修改、复制表语法,基本查询结构及WHERE、GROUPBY等子句,本文结合实例代码给大家介绍的非常详细,感兴趣的朋友跟随... 目录01.表的操作1.1表操作概览1.2创建表1.3修改表1.4复制表02.基本查询操作2.1 SE

MySQL中的锁机制详解之全局锁,表级锁,行级锁

《MySQL中的锁机制详解之全局锁,表级锁,行级锁》MySQL锁机制通过全局、表级、行级锁控制并发,保障数据一致性与隔离性,全局锁适用于全库备份,表级锁适合读多写少场景,行级锁(InnoDB)实现高并... 目录一、锁机制基础:从并发问题到锁分类1.1 并发访问的三大问题1.2 锁的核心作用1.3 锁粒度分

MySQL数据库中ENUM的用法是什么详解

《MySQL数据库中ENUM的用法是什么详解》ENUM是一个字符串对象,用于指定一组预定义的值,并可在创建表时使用,下面:本文主要介绍MySQL数据库中ENUM的用法是什么的相关资料,文中通过代码... 目录mysql 中 ENUM 的用法一、ENUM 的定义与语法二、ENUM 的特点三、ENUM 的用法1

MySQL count()聚合函数详解

《MySQLcount()聚合函数详解》MySQL中的COUNT()函数,它是SQL中最常用的聚合函数之一,用于计算表中符合特定条件的行数,本文给大家介绍MySQLcount()聚合函数,感兴趣的朋... 目录核心功能语法形式重要特性与行为如何选择使用哪种形式?总结深入剖析一下 mysql 中的 COUNT

mysql中的服务器架构详解

《mysql中的服务器架构详解》:本文主要介绍mysql中的服务器架构,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录1、背景2、mysql服务器架构解释3、总结1、背景简单理解一下mysqphpl的服务器架构。2、mysjsql服务器架构解释mysql的架

MySQL之InnoDB存储引擎中的索引用法及说明

《MySQL之InnoDB存储引擎中的索引用法及说明》:本文主要介绍MySQL之InnoDB存储引擎中的索引用法及说明,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐... 目录1、背景2、准备3、正篇【1】存储用户记录的数据页【2】存储目录项记录的数据页【3】聚簇索引【4】二

mysql中的数据目录用法及说明

《mysql中的数据目录用法及说明》:本文主要介绍mysql中的数据目录用法及说明,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录1、背景2、版本3、数据目录4、总结1、背景安装mysql之后,在安装目录下会有一个data目录,我们创建的数据库、创建的表、插入的

MySQL中的InnoDB单表访问过程

《MySQL中的InnoDB单表访问过程》:本文主要介绍MySQL中的InnoDB单表访问过程,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录1、背景2、环境3、访问类型【1】const【2】ref【3】ref_or_null【4】range【5】index【6】

MySQL 中 ROW_NUMBER() 函数最佳实践

《MySQL中ROW_NUMBER()函数最佳实践》MySQL中ROW_NUMBER()函数,作为窗口函数为每行分配唯一连续序号,区别于RANK()和DENSE_RANK(),特别适合分页、去重... 目录mysql 中 ROW_NUMBER() 函数详解一、基础语法二、核心特点三、典型应用场景1. 数据分