文章详情页

MySQL 千万级数据量如何快速分页

浏览：122日期：2023-10-11 19:06:38

前言

后端开发中为了防止一次性加载太多数据导致内存、磁盘IO都开销过大，经常需要分页展示，这个时候就需要用到MySQL的LIMIT关键字。但你以为LIMIT分页就万事大吉了么，Too young,too simple啊，LIMIT在数据量大的时候极可能造成的一个问题就是深度分页。

案例

这里我以显示电商订单详情为背景举个例子，新建表如下：

CREATE TABLE `cps_user_order_detail` ( `id` bigint(20) unsigned NOT NULL AUTO_INCREMENT COMMENT ’主键’, `user_id` varchar(32) NOT NULL DEFAULT ’’ COMMENT ’用户ID’, `order_id` bigint(20) DEFAULT NULL COMMENT ’订单id’, `sku_id` bigint(20) unsigned NOT NULL COMMENT ’商品ID’, `order_time` datetime DEFAULT NULL COMMENT ’下单时间,格式yyyy-MM-dd HH:mm:ss’, PRIMARY KEY (`id`), KEY `idx_time_user` (`order_time`,`user_id`) USING BTREE) ENGINE=InnoDB DEFAULT CHARSET=utf8mb4 COLLATE=utf8mb4_bin COMMENT=’用户订单详情’;

然后手动向表里插入120W条数据。

现在有个需求：分页展示用户的订单详情，按照下单时间倒序。

表结构精简了，需求也简单。于是哗哗哗的写完代码，提测上线了。早期运行一切正常，可随着订单量的不断增大，发现系统越发的缓慢，还时不时报出几个慢查询。

这个时候你就该想到是LIMIT偏移的问题了，没错，不是你的SQL不够优美，就是MySQL自身的机制。

这里我就简单以两条SQL为例，如下图，分别是从100和100W的位置偏移分页，可以看到时间相差很大。这还不算其它数据运算和处理的时间，单一条SQL的查询就耗时一秒以上，在对用户提供的功能里这是不能容忍的（电商里经常要求一个接口的RT不超过200ms）。

MySQL 千万级数据量如何快速分页

这里我们再看下执行计划，如下图所示：

MySQL 千万级数据量如何快速分页

在此先介绍一下执行计划Extra列可能出现的值及含义：

Using where：表示优化器需要通过索引回表查询数据。 Using index：即覆盖索引，表示直接访问索引就足够获取到所需要的数据，不需要通过索引回表，通常是通过将待查询字段建立联合索引实现。 Using index condition：在5.6版本后加入的新特性，即大名鼎鼎的索引下推，是MySQL关于减少回表次数的重大优化。 Using filesort:文件排序，这个一般在ORDER BY时候，数据量过大，MySQL会将所有数据召回内存中排序，比较消耗资源。

再看看上图，同样的语句，只以为偏移量不同，就造成了执行计划的千差万别（且容我小小的夸张一下）。第一条语句LIMIT 100,6type列的值是range，表示范围扫描，性能比ref差一个级别，但是也算走了索引，并且还应用了索引下推：就是说在WHERE之后的下单时间删选走了索引，并且之后的ORDER BY也是根据索引下推优化，在执行WHERE条件筛选时同步进行的（没有回表）。而第二条语句LIMIT 1000000,6压根就没走索引，type列的值是ALL，显然是全表扫描。并且Extra列字段里的Using where表示发生了回表，Using filesort表示ORDER BY时发生了文件排序。所以这里慢在了两点：一是文件排序耗时过大，二是根据条件筛选了相关的数据之后，需要根据偏移量回表获取全部值。无论是上面的哪一点，都是LIMIT偏移量过大导致的，所以实际开发环境经常遇到非统计表量级不得超过一百万的要求。

优化

原因分析完了，那么LIMIT深度分页在实际开发中怎么优化呢？这里少侠给两点方案。一是通过主键索引优化。什么意思呢？就是把上面的语句修改成：

SELECT * FROM cps_user_order_detail d WHERE d.id > #{maxId} AND d.order_time>’2020-8-5 00:00:00’ ORDER BY d.order_time LIMIT 6;

如上代码所示，同样也是分页，但是有个maxId的限制条件，这个是什么意思呢，maxId就是上一页中的最大主键Id。所以采用此方式的前提：1）主键必须自增不能是UUID并且前端除了传基本分页参数pageNo,pageSize外，还必须把每次上一页的最大Id带过来，2）该方式不支持随机跳页，也就是说只能上下翻页。如下图所示是某知名电商中的实际页面。

MySQL 千万级数据量如何快速分页

二是通过Elastic Search搜索引擎（基于倒排索引），实际上类似于淘宝这样的电商基本上都是把所有商品放进ES搜索引擎里的（那么海量的数据，放进MySQL是不可能的，放进Redis也不现实）。但即使用了ES搜索引擎，也还是有可能发生深度分页的问题的，这时怎么办呢？答案是通过游标scroll。关于此点这里不做深入，感兴趣的可以做研究。

小结

写这篇博客是因为前段时间在开发中真实经历到了，并且之前在字节面试中确实也和面试官探讨了一番。知道LIMIT的限制以及优化，在面试中能提到是加分项，不能说到MySQL优化就是建索引，调整SQL（实际上在真实开发中这两种优化方案的成效微乎其微）。毕竟MySQL优化那么牛X的话，就不会有那么多中间件产生了。我是少侠露飞，爱技术，爱分享。

以上就是MySQL 千万级数据量如何快速分页的详细内容，更多关于MySQL快速分页的资料请关注好吧啦网其它相关文章！

上一条：MySQL 数据库如何解决高并发问题下一条：MySQL中文乱码问题解决方案

相关文章：

1. 恢复从 Access 2000、 Access 2002 或 Access 2003 中数据库删除表的方法2. 启动MYSQL出错 Manager of pid-file quit without updating file.3. Mysql入门系列：MYSQL创建、删除、索引和更改表4. Mysql入门系列：建立MYSQL客户机程序的一般过程5. Microsoft Office Access修改代码字体大小的方法6. ACCESS转SQL数据库相关的几个技能7. Microsoft Office Access设置默认日期为当前日期的方法8. Mybatis查询方法如何实现没有返回值9. MySQL中InnoDB和MyISAM类型的差别10. DB2 XML 全文搜索之为文本搜索做准备

排行榜

					
					Mysql入门系列：建立MYSQL客户机程序的一般过程
Mysql入门系列：MYSQL创建、删除、索引和更改表
启动MYSQL出错 Manager of pid-file quit without updating file.
ACCESS转SQL数据库相关的几个技能
Microsoft Office Access修改代码字体大小的方法
恢复从 Access 2000、 Access 2002 或 Access 2003 中数据库删除表的方法
Microsoft Office Access设置默认日期为当前日期的方法
MySQL存储过程例子（包含事务、参数、嵌套调用、游标循环等）
Mysql入门系列：MYSQL客户机程序2—增加错误检查
Mysql入门系列：安排预防性的维护MYSQL数据库服务器
MySQL中InnoDB和MyISAM类型的差别
				

热门标签