分库分表？如何做到永不迁移数据和避免热点？

发布时间：2019-04-26 17:08:32 所属栏目：编程来源：老顾聊技术

导读：一、前言中大型项目中，一旦遇到数据量比较大，小伙伴应该都知道就应该对数据进行拆分了。有垂直和水平两种。垂直拆分比较简单，也就是本来一个数据库，数据量大之后，从业务角度进行拆分多个库。如下图，独立的拆分出订单库和用户库。水平拆分的概念，

但又要考虑到数据均匀，那是不是可以在一定的范围内数据均匀的呢?因为我们每次的扩容肯定会事先设计好这次扩容的范围大小，我们只要保证这次的范围内的数据均匀是不是就ok了。

四、方案设计

我们先定义一个group组概念，这组里面包含了一些分库以及分表，如下图：

上图有几个关键点：

1)id=0～4000万肯定落到group01组中。

2)group01组有3个DB，那一个id如何路由到哪个DB?

3)根据hash取模定位DB，那模数为多少?模数要为所有此group组DB中的表数，上图总表数为10。为什么要去表的总数?而不是DB总数3呢?

4)如id=12，id%10=2;那值为2，落到哪个DB库呢?这是设计是前期设定好的，那怎么设定的呢?

5)一旦设计定位哪个DB后，就需要确定落到DB中的哪张表呢?

五、核心主流程

按照上面的流程，我们就可以根据此规则，定位一个id，我们看看有没有避免热点问题。

我们看一下，id在【0，1000万】范围内的，根据上面的流程设计，1000万以内的id都均匀的分配到DB_0,DB_1,DB_2三个数据库中的Table_0表中，为什么可以均匀，因为我们用了hash的方案，对10进行取模。

上面我们也提了疑问，为什么对表的总数10取模，而不是DB的总数3进行取模?我们看一下为什么DB_0是4张表，其他两个DB_1是3张表?

在我们安排服务器时，有些服务器的性能高，存储高，就可以安排多存放些数据，有些性能低的就少放点数据。如果我们取模是按照DB总数3，进行取模，那就代表着【0，4000万】的数据是平均分配到3个DB中的，那就不能够实现按照服务器能力适当分配了。

按照Table总数10就能够达到，看如何达到：

（编辑：核心网）

【声明】本站内容均来自网络，其相关言论仅代表作者个人观点，不代表本站立场。若无意侵犯到您的权利，请及时与联系站长删除相关内容!

把not in 更换成not e	mydumper工具运用介绍
别花冤枉钱买专栏了！	Mysql索引类型创建错误