MySQL新特性之哈希连接

最新推荐文章于 2024-02-26 20:27:03 发布

August的分享

最新推荐文章于 2024-02-26 20:27:03 发布

阅读量683

点赞数 2

分类专栏： MySQL

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/springmvc_io/article/details/103997805

版权

概述

很长一段时间，MySQL 执行连接的唯一算法是 嵌套循环算法 ( nested loop algorithm) 的变体，但是 嵌套循环算法 在某些场景下非常低效，也是 MySQL 一直被诟病的一个问题。

随着 MySQL 8.0.18 的发布，MySQL Server 可以使用哈希连接（hash join），这篇文章将会简单介绍下哈希连接如何实现，看看在 MySQL 中它是如何工作的，何时使用它，有什么限制。

哈希连接简介

什么是哈希连接？

哈希连接是一种用于关系型数据库中的连接算法，只能用于有等连接条件的连接中（on a.b = c.b）。它通常比嵌套循环算法更高效（探测端非常非常小除外），尤其是在没有命中索引的情况下。

简单来说，哈希连接算法就是先把一张小表加载到内存哈希表里，然后遍历大表的数据，逐行去哈希表中匹配符合条件的数据，返回到客户端。

（哈希表只是示例，方面理解，实际 hash 的 key 是连接的值，value 是数据行链表）

通常将哈希连接分为两个阶段，构建阶段（build phase）和探测阶段（probe phase）。在构建阶段，先选择合适的表作为「构建输入」，构建哈希表，然后再依次遍历另一个「探测输入」表记录去探测哈希表查找符合连接条件的记录。

以上图为例，查询城市对应的省份。我们假设 city 为构建输入，在构建阶段，服务器构建一个 city 哈希表，遍历 city 表，将行依次放进哈希表，键为 hash(province_id)，值为对应的城市行。`

在探测阶段，服务器开始从探测输入（province）读取行。对于每一行都使用 hash(province.province_id) 值作为查找键探测哈希表以匹配行。

也就是&#

最低0.47元/天解锁文章

评论 1

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。