ARTICLE · 1046325
AI 会写 SQL 之后,为什么还要读《分布式数据库》?
直到某次调用超时。数据库已经写入订单,但返回结果时网络中断了。Agent 没收到成功消息,于是决定重试。几秒之后,同一笔订单出现了两次。
这时候,你需要查明:第一次操作到底有没有提交?重试能否识别同一笔业务?查询读到的是最新状态吗?如果任务中断,恢复后该从哪里继续?
每个问题,都把我们带回数据库和分布式系统的基本原理。
这也是我今天想向你介绍《分布式数据库:入门、进阶与实战》的原因。我希望这本书能帮助读者建立一种能力:理解 AI 应用背后的数据系统,并判断它的正确性、可靠性和性能取舍。

《分布式数据库:入门、进阶与实战》|高洪涛 著|机械工业出版社
一、从开源实践到这本书
我是高洪涛,参与过 Apache ShardingSphere 和 Apache SkyWalking 等开源项目的建设,也写过《Apache SkyWalking实战》。数据库中间件、分布式架构和可观测性,是我长期投入的技术方向。
这些领域有很多具体问题需要解决:数据增长后怎样分片,多个节点如何协作,系统故障后怎样恢复,以及业务需要什么程度的一致性。本书也重点讨论这些问题。
决定写这本书,还与同行交流中遇到的学习困惑有关。分布式数据库的资料很多,但往往分散在不同主题里。读过事务、复制和共识算法的介绍,仍然可能不清楚它们在同一个系统中如何配合;了解某种产品的配置,也未必理解它为什么这样设计。
我希望把这些知识联系起来,让读者从基础概念入手,理解各种机制,再回到实际需求,逐步形成完整的认识。
如今,AI 开始参与业务执行,这条学习路径也有了新的应用场景。
二、AI 应用中的三个问题,连接着数据库的基本功
2026 年 DTCC 的议程同时设置了“DB for AI”和“AI for DB”等方向:数据库为 AI 提供数据能力,AI 也参与数据库的管理与优化。DTCC 2026 官方议程
从开发者的角度,可以通过三个具体问题理解这种变化。
第一,Agent 重试一次操作,为什么可能产生重复结果?
开头的订单案例里,数据库事务能够保证事务边界内的操作按照相应规则提交或回滚。但要避免两次请求创建两笔订单,应用通常还需要业务唯一标识、幂等处理和结果确认机制。
书中关于事务、并发控制和失败处理的内容,可以帮助你分清各层的职责,知道故障之后应该检查什么。
一次调用超时,只说明调用方没有及时拿到结果。它不足以证明操作没有发生。
第二,Agent“记住了”,为什么另一个 Agent 还不知道?
假设用户刚把会议偏好改为“工作日下午”,负责排期的 Agent 却仍然安排了上午的会议。问题可能出在上下文供给,也可能是新偏好已经写入,但尚未传播到它读取的副本。
“记住了”在工程上涉及写入、持久化、传播与读取。面向 Agent 的上下文服务,也需要管理共享、更新和数据生命周期。ContextDB 官方说明
复制与一致性章节,能帮助你分析数据何时可见;分片和存储引擎章节,则让你继续判断数据量增长后的扩容与成本问题。
第三,AI 生成的 SQL 能执行,就可以放心使用了吗?
一条查询可能语法正确,却因连接关系不当产生重复统计;也可能结果正确,却需要跨越大量分片、搬运大量数据。
企业级 Text-to-SQL 的复杂度已体现在 Spider 2.0 等评测中:数据库结构经常超过千列,一些任务需要完成多条查询组成的工作流。Spider 2.0 项目介绍
因此,我建议把第24章的大模型与 Text-to-SQL,和第17章的查询引擎联系起来读。前者讨论查询如何生成与校验,后者解释查询计划怎样形成、数据怎样定位,以及多个节点如何执行。
业务口径需要业务知识来确认,数据库原理则帮助你审视结果依赖的数据状态与执行代价。
三、24章内容,怎样形成一条学习路径
全书分为基础篇、进阶篇和扩展篇。三篇各自围绕一个问题,逐步深入。
基础篇,第1—11章:数据分散之后,系统发生了什么变化?
从数据库的发展、SQL与NoSQL、OLTP与HTAP讲起,随后进入数据分片、复制、BASE与CAP、事务基础、存储引擎和LSM树。
读完这一部分,希望你能够解释:为什么要分片和复制,它们带来什么能力,又为什么引出协调、并发与一致性问题。
进阶篇,第12—18章:多个节点怎样可靠、高效地协同工作?
这一部分深入讨论架构、一致性模型、分布式事务、失败处理、Paxos与Raft等共识算法,并进一步讨论查询引擎和软硬结合。
读者可以结合整个系统,逐步理解各项机制:数据操作需要怎样的保证,故障会影响哪些环节,性能成本又产生在哪里。
扩展篇,第19—24章:怎样把原理用于方案选择与设计?
这一部分结合数据库中间件、SQL数据库的演进、行业选型和专用数据库,分析不同技术路线的适用条件。随后围绕SkyWalking的相关需求展开数据库方案设计,最后讲到大模型驱动的智能交互。
我希望这一部分能帮助你从业务需求出发思考:先明确访问特点与约束,再比较架构和机制。

全书三篇、24章的学习路径
四、我希望读者从书中获得的三种理解
其一,把节点内部与节点之间的机制联系起来。
要理解多台机器之间如何复制、协调,需要了解单个节点怎样组织数据、处理事务和执行查询。本书同时讨论这两个层面,把存储引擎、事务、分片与共识的知识联系起来。
例如,研究一次分布式写入的性能,可以沿着这条思路继续分析:时间消耗在网络协调上,还是节点内部的存储处理上?增加节点能够缓解当前瓶颈吗?
其二,通过具体系统理解抽象原理。
书中结合ShardingSphere与TiDB讨论分片,通过MySQL复制技术的演进解释复制方案,借助Spanner与Percolator等讨论分布式事务。
这些案例让读者有机会把概念与具体机制对应起来,理解不同系统为什么选择不同的实现方式。
其三,理解技术选择背后的条件与代价。
分片能够分担存储和处理压力,也让跨分片操作变得复杂;复制提供冗余,也带来了同步问题。面对一种方案,读者需要继续追问:它解决什么问题,依赖什么条件,又付出了什么成本?
第23章的SkyWalking相关设计案例,可以说明这种讲法。
在这个方案推演中,大量指标数据持续写入,查询能够容忍一定的可见性延迟。因此,书中讨论了复制采用弱一致性的方案,以适应这类负载。
但告警查询具有不同的要求。用户收到告警后,往往会马上查看相关数据。如果此时查询到的副本还没有对应记录,就会出现“告警已经收到了,数据却查不到”的情况。
书中由此讨论因果一致性,并说明如何让查询关联到先前的写入:随告警传递写入时间戳,查询侧据此检查相关数据是否可见,必要时请求同步。
这个案例的关键在于先辨认不同操作之间的关系,再决定应当提供什么保证。

第23章方案推演:告警查询与先前写入的关联
把这种方法带到AI应用中,历史摘要和刚刚确认的任务取消状态,也值得分别分析。前者或许允许稍后更新,后者则需要与任务执行机制配合,确保取消操作产生预期效果。
对业务后果的理解,是选择一致性方案的起点。
五、这本书适合谁,怎样开始读
本书适合具备基本SQL知识和数据库使用经验,希望进一步理解分布式原理与架构的读者。
如果你是后端开发工程师,可以重点阅读分片、复制、事务和查询引擎,结合这些机制理解日常遇到的扩容、并发和慢查询问题。
如果你是AI应用开发者,可以根据项目需要,把事务、一致性、失败处理与Text-to-SQL联系起来读,逐步分析Agent所依赖的数据访问和状态管理。
如果你是数据库研发人员或架构师,可以沿着存储、协调、查询和架构设计的路径通读,比较不同方案的假设、收益和代价。
如果你是相关专业学生或教师,三篇递进的结构可以作为学习和讨论的框架,再结合具体章节深入研究。
全书主要讨论分布式数据库。向量索引、GraphRAG和Agent记忆管理,还需要更专门的资料来补充。这些数据库基础能帮助你在继续学习时,理解新技术与系统其他部分的关系。
六、同行推荐
分布式数据库技术博大精深,想要系统掌握绝非易事。高洪涛凭借在ShardingSphere和SkyWalking等顶级开源社区的深厚积累,将晦涩的分布式协议解析得通透淋漓。更难能可贵的是,书中包含了“从零构建分布式数据库”的实战内容,这种“手把手”的教学方式将帮助读者真正打通理论与实践的任督二脉。
——张亮 SphereEx创始人/Apache ShardingSphere 项目主席
本书不仅夯实了数据分片、事务一致性等经典基石,更敏锐地捕捉到了云原生、软硬结合以及大模型(LLM)给数据库带来的革命性变化。对于渴望技术进阶、不愿在AI时代掉队的工程师来说,这是一本不可多得的案头书。
——石磊 Redis亚太区首席架构师
从当当网的高并发电商业务到Tetrate的全球化服务网格架构,高洪涛始终站在技术浪潮的前沿。他将自己十余年的踩坑经验与架构思考毫无保留地注入本书。阅读这本书,就像与一位顶尖架构师进行了一场深度对话,让你在分布式系统的复杂迷宫中找到清晰的方向。
——史海峰 腾讯云最有价值技术专家TVP,华为云最有价值专家MVP
七、图书详情与购买
《分布式数据库:入门、进阶与实战》|高洪涛 著|机械工业出版社
点击下方京东小程序卡片,查看图书详情并购买。
八、希望你能解释自己的系统为什么可靠
随着AI承担更多代码编写、查询生成和诊断工作,工程师会频繁面对它提出的方案。一个索引值不值得加,一种一致性设置是否合适,一次修复会影响哪些状态,都需要有依据的判断。
回到开头那个超时的订货助手。
当你能够查明订单的状态,解释重试为什么安全,知道系统在下一次网络中断时会怎样运行,对这个应用的信任就有了具体依据。
我希望《分布式数据库:入门、进阶与实战》能帮助你建立这样的理解。面对AI应用背后的数据系统,你能看清问题发生在哪里,知道应该验证什么,并逐步形成自己的设计判断。
《分布式数据库:入门、进阶与实战》|高洪涛 著
如果你正在把Agent接入数据库,欢迎在留言区聊聊:最让你困扰的,是状态一致性、查询性能,还是故障后的恢复问题?
《深入分布式缓存》的往事
了解大模型的背后,知其然进而所以然(《深度学习黑箱》译者序)
《语音优先》智能语音技术驱动的交互界面设计与语音机器人设计(译者序)
计算机网络的元认知、实践与未来(《计算机网络问题与解决方案》的译者序)
Web3.0,区块链后花园的姹紫嫣红(《区块链应用开发实战》译者序)