SpringBoot多数据源分库分表教程
本篇文章向大家介绍《Spring Boot多数据源分库分表实战》,主要包括,具有一定的参考价值,需要的朋友可以参考一下。
在Spring Boot中配置多数据源和分库分表,核心是通过定义多个DataSource bean实现多数据源连接与动态切换,并根据分片键将数据分散到不同数据库或表中以提升系统扩展性。1. 多数据源配置需在application.yml中定义多个数据源信息,并通过@Bean创建多个DataSource实例;2. 使用AbstractRoutingDataSource实现动态数据源切换,结合ThreadLocal和AOP实现运行时上下文识别;3. 分库分表策略包括范围分片、哈希分片、时间分片和业务分片,选择合适的分片键至关重要;4. 可借助ShardingSphere等中间件简化实现,也可自定义规则在DAO层或AOP中处理路由;5. 事务管理复杂,优先避免跨库操作,必要时采用分布式事务方案如TCC或SAGA;6. 需综合考虑数据分布均匀性、扩容迁移可行性及查询复杂度,提前规划并逐步迭代以平衡扩展性与维护成本。
在Spring Boot应用里搞多数据源和分库分表,说白了,就是为了解决数据库单点瓶颈和数据量爆炸的问题。我们不再把所有鸡蛋放一个篮子里,而是把数据分散到多个数据库甚至多台服务器上,让系统能扛住更大的并发和数据增长。这玩意儿,搞好了能让你的应用像打了鸡血一样跑得飞快,但搞不好,那真是给自己挖坑。

搞定多数据源和分库分表,核心思路就是两步:第一,让你的Spring Boot应用能同时连接和管理多个数据库连接;第二,当有数据操作请求过来时,能根据一定的规则(比如用户ID)判断这个数据应该去哪个数据库、哪个表。

具体到Spring Boot,多数据源的配置相对直接,就是定义多个DataSource
bean,然后通过一个动态数据源切换机制(比如继承AbstractRoutingDataSource
)来根据上下文选择使用哪个数据源。分库分表这块就更复杂了,你需要一套规则来决定数据走向,这套规则可以是自己写代码实现,也可以借助像ShardingSphere这样的中间件。自己写代码,通常是在DAO层或Service层前面加一层拦截,或者干脆用AOP,根据业务ID来计算出目标库和表名,然后动态修改SQL或者切换数据源。这个过程中,事务管理是个大挑战,跨库事务通常很麻烦,能避免就避免,实在不行,就得考虑分布式事务方案了,比如XA,但那玩意儿性能损耗大,或者TCC、SAGA这种柔性事务。说实话,我个人倾向于尽量在业务层面规避分布式事务,或者通过最终一致性来解决。
为什么我们需要在Spring Boot中考虑多数据源和分库分表?
其实,这事儿挺无奈的,但又不得不做。当你的用户量和数据量达到一定规模,单台数据库服务器,即便你硬件堆到极致,也总会有扛不住的一天。读写瓶颈、存储容量限制,这些都是明摆着的问题。Spring Boot本身虽然简化了应用开发,但它不负责帮你扩展数据库。所以,一旦你的业务开始高速增长,数据库的横向扩展就成了绕不过去的坎。

考虑多数据源和分库分表,本质上就是为了实现数据库的水平扩展。把一个巨大的数据库拆分成多个小的、易于管理的数据库实例,每个实例只承载一部分数据或请求。这样一来,读写压力分散了,存储空间也扩展了。这就像把一个大水池的水,分流到好几个小水池里,每个小水池的压力都小了,而且可以根据需要增加更多的小水池。当然,这也会带来额外的复杂性,比如数据查询可能需要跨多个库表,数据一致性问题,还有运维的挑战,但这些都是为了高可用和高性能必须付出的代价。我见过太多项目,早期跑得欢,后期因为没提前规划好数据库扩展,导致整个系统性能直线下降,甚至重构。
如何在Spring Boot项目中配置和管理多数据源?
在Spring Boot里配置多个数据源,这算是分库分表的第一步,也是相对直接的一步。你需要在application.yml
或application.properties
里定义好多个数据源的连接信息,比如datasource.db1.url
、datasource.db2.url
等等。
然后,在你的配置类里,为每个数据源定义一个@Bean
。通常会用@ConfigurationProperties
来绑定配置信息,这样能让代码更清晰。例如:
@Configuration public class DataSourceConfig { @Bean(name = "db1DataSource") @ConfigurationProperties(prefix = "spring.datasource.db1") public DataSource db1DataSource() { return DataSourceBuilder.create().build(); } @Bean(name = "db2DataSource") @ConfigurationProperties(prefix = "spring.datasource.db2") public DataSource db2DataSource() { return DataSourceBuilder.create().build(); } // 关键:动态数据源 @Bean(name = "dynamicDataSource") @Primary // 标记为主数据源,Spring会默认注入它 public DataSource dynamicDataSource(@Qualifier("db1DataSource") DataSource db1, @Qualifier("db2DataSource") DataSource db2) { DynamicDataSource dynamicDataSource = new DynamicDataSource(); Map<Object, Object> targetDataSources = new HashMap<>(); targetDataSources.put("db1", db1); targetDataSources.put("db2", db2); dynamicDataSource.setTargetDataSources(targetDataSources); dynamicDataSource.setDefaultTargetDataSource(db1); // 默认使用db1 return dynamicDataSource; } // 事务管理器也需要指向动态数据源 @Bean public PlatformTransactionManager transactionManager(@Qualifier("dynamicDataSource") DataSource dynamicDataSource) { return new DataSourceTransactionManager(dynamicDataSource); } }
这里的DynamicDataSource
就是我们自定义的,它继承自AbstractRoutingDataSource
。你需要重写determineCurrentLookupKey()
方法,这个方法会返回当前请求应该使用哪个数据源的键(比如"db1"或"db2")。这个键通常通过ThreadLocal
来传递,比如你在某个Service方法执行前设置好,执行完再清除。
public class DynamicDataSource extends AbstractRoutingDataSource { @Override protected Object determineCurrentLookupKey() { // 从ThreadLocal获取当前数据源的key return DynamicDataSourceContextHolder.getDataSourceKey(); } } public class DynamicDataSourceContextHolder { private static final ThreadLocal<String> CONTEXT_HOLDER = new ThreadLocal<>(); public static void setDataSourceKey(String key) { CONTEXT_HOLDER.set(key); } public static String getDataSourceKey() { return CONTEXT_HOLDER.get(); } public static void clearDataSourceKey() { CONTEXT_HOLDER.remove(); } }
然后,你可以通过AOP或者自定义注解来在方法执行前后切换数据源。比如定义一个@TargetDataSource
注解,然后用AOP拦截这个注解,在方法执行前设置数据源,方法执行后清除。这样,你的业务代码就不用关心数据源切换的细节了。
分库分表的策略选择与实现考量
分库分表的策略选择,这才是真正的难点和艺术。没有银弹,只有最适合你业务的方案。核心是选择一个合适的“分片键”(Sharding Key),这个键决定了数据最终会落在哪个库、哪个表。
常见的策略有:
- 范围分片(Range Sharding):比如用户ID 1-100000放一个库,100001-200000放另一个库。优点是简单直观,扩容方便。缺点是数据分布可能不均匀,某些范围的数据量大,导致热点问题。
- 哈希分片(Hash Sharding)/取模分片(Modulus Sharding):比如根据用户ID对N取模,结果为0的放库0,为1的放库1。优点是数据分布相对均匀。缺点是扩容时麻烦,可能需要大量数据迁移。
- 时间分片(Time Sharding):按时间维度分表,比如每月一张表。适用于日志、订单等时效性强的数据。优点是查询特定时间范围的数据很快。缺点是跨时间范围查询复杂,历史数据归档麻烦。
- 业务分片(Business Sharding):根据业务属性直接划分,比如电商系统把商品数据放一个库,用户数据放一个库。这种其实更像是垂直拆分,而不是严格意义上的分库分表。
在实现上,我个人倾向于先评估是否真的需要自己手写分片逻辑。如果业务复杂,或者未来扩展性要求高,直接上像ShardingSphere这样的分布式数据库中间件会省心很多。它能帮你处理数据路由、读写分离、分布式事务等一系列问题,你只需要配置好规则,SQL语句基本不用改。当然,引入中间件也会增加系统的复杂度,多了一层维护成本。
如果业务相对简单,数据量没那么恐怖,或者你对性能有极致要求,可以考虑自己实现。这通常意味着你需要一个解析SQL的层,或者在ORM框架(比如MyBatis)的拦截器里做手脚,根据分片键动态生成表名和路由到对应的数据源。
无论哪种方式,都要考虑以下几点:
- 分片键的选择:这是重中之重。理想的分片键应该能均匀分布数据,并且大部分查询都能通过分片键来路由,避免全表扫描或跨库查询。比如用户ID通常是个好选择。
- 数据迁移和扩容:当数据量继续增长,或者某个分片变成热点时,如何平滑地进行数据迁移和扩容,是个大挑战。
- 分布式事务:前面提过,尽量避免。如果实在避免不了,需要深入研究XA、TCC或SAGA这些方案,并评估其对性能的影响。
- 查询复杂性:分库分表后,原本简单的JOIN查询可能变得非常复杂,甚至无法实现。聚合查询也可能需要在应用层进行二次聚合。这会倒逼你重新思考数据模型和业务查询模式。
总之,分库分表是个系统性工程,需要从业务、技术、运维多个角度去权衡。提前规划,小步快跑,逐步迭代,比一开始就追求完美要靠谱得多。
今天带大家了解了的相关知识,希望对你有所帮助;关于文章的技术知识我们会一点点深入介绍,欢迎大家关注golang学习网公众号,一起学习编程~

- 上一篇
- JavaScriptreduceRight方法使用教程

- 下一篇
- LinuxSLIP登录管理详解-sliplogin命令用法
-
- 文章 · java教程 | 1小时前 |
- Java动态类重定义热修复教程
- 458浏览 收藏
-
- 文章 · java教程 | 1小时前 |
- Java实例是什么?类与实例关系全解析
- 346浏览 收藏
-
- 文章 · java教程 | 1小时前 |
- JavaSPI机制详解:服务发现与使用方法
- 212浏览 收藏
-
- 文章 · java教程 | 2小时前 |
- XamarinAndroidBundle.GetParcelable弃用解决方法
- 386浏览 收藏
-
- 文章 · java教程 | 2小时前 |
- Java实现QKD协议:量子密钥操作教程
- 130浏览 收藏
-
- 文章 · java教程 | 2小时前 |
- finally块执行条件及例外情况解析
- 250浏览 收藏
-
- 文章 · java教程 | 2小时前 |
- Java反射修改final字段技巧
- 467浏览 收藏
-
- 文章 · java教程 | 2小时前 |
- Java多线程三种创建方式详解
- 293浏览 收藏
-
- 文章 · java教程 | 3小时前 | 内存泄漏 引用 threadlocal 堆快照 MAT
- Java内存泄漏定位与解决技巧
- 358浏览 收藏
-
- 文章 · java教程 | 3小时前 |
- 空对象模式:优雅应对NullPointerException
- 301浏览 收藏
-
- 文章 · java教程 | 3小时前 |
- Java性能优化方法与实用技巧
- 493浏览 收藏
-
- 文章 · java教程 | 3小时前 |
- Java反射修改final字段技巧
- 232浏览 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 542次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 508次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 497次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 484次学习
-
- 免费AI认证证书
- 科大讯飞AI大学堂推出免费大模型工程师认证,助力您掌握AI技能,提升职场竞争力。体系化学习,实战项目,权威认证,助您成为企业级大模型应用人才。
- 32次使用
-
- 茅茅虫AIGC检测
- 茅茅虫AIGC检测,湖南茅茅虫科技有限公司倾力打造,运用NLP技术精准识别AI生成文本,提供论文、专著等学术文本的AIGC检测服务。支持多种格式,生成可视化报告,保障您的学术诚信和内容质量。
- 161次使用
-
- 赛林匹克平台(Challympics)
- 探索赛林匹克平台Challympics,一个聚焦人工智能、算力算法、量子计算等前沿技术的赛事聚合平台。连接产学研用,助力科技创新与产业升级。
- 220次使用
-
- 笔格AIPPT
- SEO 笔格AIPPT是135编辑器推出的AI智能PPT制作平台,依托DeepSeek大模型,实现智能大纲生成、一键PPT生成、AI文字优化、图像生成等功能。免费试用,提升PPT制作效率,适用于商务演示、教育培训等多种场景。
- 181次使用
-
- 稿定PPT
- 告别PPT制作难题!稿定PPT提供海量模板、AI智能生成、在线协作,助您轻松制作专业演示文稿。职场办公、教育学习、企业服务全覆盖,降本增效,释放创意!
- 169次使用
-
- 提升Java功能开发效率的有力工具:微服务架构
- 2023-10-06 501浏览
-
- 掌握Java海康SDK二次开发的必备技巧
- 2023-10-01 501浏览
-
- 如何使用java实现桶排序算法
- 2023-10-03 501浏览
-
- Java开发实战经验:如何优化开发逻辑
- 2023-10-31 501浏览
-
- 如何使用Java中的Math.max()方法比较两个数的大小?
- 2023-11-18 501浏览