如何使用分区处理MySQL的亿级数据优化

时间：2022-05-30 13:50:44|栏目：MySQL|点击：次

mysql在查询上千万级数据的时候，通过索引可以解决大部分查询优化问题。但是在处理上亿数据的时候，索引就不那么友好了。

数据表（日志）是这样的：

表大小：1T，约24亿行；
表分区：按时间分区，每个月为一个分区，一个分区约2-3亿行数据（40-70G左右）。

由于数据不需要全量处理，经过与需求方讨论后，我们按时间段抽样一部分数据，比如抽样一个月的数据，约3.5亿行。
数据处理的思路：

1）建表引擎选择Innodb。由于数据是按月分区的，我们将该月分区的数据单独copy出来，源表为myisam引擎，因我们可能需要过滤部分数据，涉及到筛选的字段又没有索引，使用myisam引擎加索引的速度会比较慢；
2）按日分区。将copy出来的表加好索引后（约2-4个小时），过滤掉无用的数据，同时再次新生成一张表，抽取json中需要的字段，并对该表按日分区。

CREATE TABLE `tb_name` (
  `id_`,
  ...,
  KEY `idx_1` (`create_user_`) 
) ENGINE=InnoDB DEFAULT CHARSET=utf8 COMMENT='应用日志'
PARTITION BY RANGE(to_days(log_time_)) (
    PARTITION p1231 VALUES LESS THAN (737425),
    PARTITION p0101 VALUES LESS THAN (737426),
    PARTITION p0102 VALUES LESS THAN (737427),
    PARTITION p0103 VALUES LESS THAN (737428),
    PARTITION p0104 VALUES LESS THAN (737429),
......
);

上一篇：MySQL 亿级数据导入导出及迁移笔记

栏目：MySQL

下一篇：关于Mysql-connector-java驱动版本问题总结

本文标题：如何使用分区处理MySQL的亿级数据优化

本文地址：https://idc91.com/shujuku/3578.html

更多MySQL

MySQL

如何使用分区处理MySQL的亿级数据优化

您可能感兴趣的文章

阅读排行

推荐教程