为什么代码规范要求SQL语句不要过多的join-巨人网络通讯

为什么代码规范要求SQL语句不要过多的join

送分题

面试官：有操作过Linux吗?

我：有的呀

面试官：我想查看内存的使用情况该用什么命令

我：free 或者 top

面试官：那你说一下用free命令都可以看到啥信息

我：那，如下图所示可以看到内存以及缓存的使用情况

total 总内存
used 已用内存
free 空闲内存
buff/cache 已使用的缓存
avaiable 可用内存

面试官：那你知道怎么清理已使用的缓存吗(buff/cache)

我：em… 不知道

面试官：sync; echo 3 > /proc/sys/vm/drop_caches就可以清理buff/cache了，你说说我在线上执行这条命令做好不好?

我：(送分题,内心大喜)好处大大的有，清理出缓存我们就有更多可用的内存空间, 就跟pc上面xx卫士的小火箭一样，点一下，就释放出好多的内存

面试官：em…, 回去等通知吧

再谈SQL Join

面试官：换个话题，谈谈你对join的理解

我：好的（再答错就彻底完了,把握住机会)

回顾

SQL中的join可以根据某些条件把指定的表给结合起来并将数据返回给客户端

join的方式有

inner join 内连接

left join 左连接

right join 右连接

full join 全连接

面试官：在项目开发中如果需要使用join语句，如何优化提升性能?

我：分为两种情况，数据规模小的，数据规模大的。

面试官: 然后?

我：对于

数据规模较小 全部干进内存就完事了嗷
数据规模较大

可以通过增加索引来优化join语句的执行速度可以通过冗余信息来减少join的次数尽量减少表连接的次数，一个SQL语句表连接的次数不要超过5次

面试官：可以总结为join语句是相对比较耗费性能，对吗？

我：是的

面试官: 为什么?

缓冲区

我: 在执行join语句的时候必然要有一个比较的过程

面试官: 是的

我：逐条比较两个表的语句是比较慢的，因此我们可以把两个表中数据依次读进一个内存块中, 以MySQL的InnoDB引擎为例，使用以下语句我们必然可以查到相关的内存区域show variables like '%buffer%'

如下图所示join_buffer_size的大小将会影响我们join语句的执行性能

面试官: 除此之外呢?

一个大前提

我：任何项目终究要上线，不可避免的要产生数据，数据的规模又不可能太小

面试官: 是这样的

我：大部分数据库中的数据最终要保存到硬盘上,并且以文件的形式进行存储。

以MySQL的InnoDB引擎为例

InnoDB以页(page)为基本的IO单位，每个页的大小为16KB
InnoDB会为每个表创建用于存储数据的.ibd文件

验证

我：这意味着我们有多少表要连接就需要读多少个文件，虽然可以利用索引，但还是免不了频繁的移动硬盘的磁头

面试官：也就是说频繁的移动磁头会影响性能对吧

我：是的，现在的开源框架不都喜欢说自己通过顺序读写大大的提升了性能吗，比如hbase、kafka

面试官：说的没错，那你认为Linux有对此做出优化吗?提示，你可以再执行一次free命令看一下

我：奇怪缓存怎么占用了1.2G多

面试官: 你有没有想过

buff/cache 里面存的是什么,？
为什么buff/cache 占了那么多内存，可用内存即availlable还有1.1G？
为什么你可以通过两条命令来清理buff/cache占用的内存，而想要释放used只能通过结束进程来实现?

品，你细品

思考了几分钟后

我：这么随便就释放了buff/cache所占用的内存，说明它就不重要, 清除它不会对系统的运行造成影响

面试官: 不完全对

我：难道是？想起来《CSAPP》（深入理解计算机系统）里面说过一句话

存储器层次结构的本质是，每一层存储设备都是较低一层设备的缓存

翻译成人话，就是说Linux会把内存当作是硬盘的高速缓存

面试官：现在知道那道送分题应该怎么回答了吧

我：我…

Join算法

面试官：再给你个机会，如果让你来实现Join算法你会怎么做?

我：无索引的话,嵌套循环就完事了嗷。有索引的话，则可以利用索引来提升性能.

面试官：说回join_buffer 你认为join_buffer里面存储的是什么?

我：在扫描过程中，数据库会选择一个表把他要返回以及需要进行和其他表进行比较的数据放进join_buffer

面试官：有索引的情况下是怎么处理的？

我：这个就比较简单了，直接读取两个表的索引树进行比较就完事了嗷，我这边介绍一下无索引的处理方式

Nested Loop Join

嵌套循环，每次只读取表中的一行数据，也就是说如果outerTable有10万行数据, innerTable有100行数据，需要读取10000000次(假设这两个表的文件没有被操作系统给缓存到内存, 我们称之为冷数据表)

当然现在没啥数据库引擎使用这种算法（太慢了)

Block nested loop

Block 块，也就是说每次都会取一块数据到内存以减少I/O的开销

当没有索引可以使用的时候，MySQL InnoDB 就会使用这种算法

考虑以下两个表 t_a 和t_b

当无法使用索引执行join操作的时候，InnoDB会自动使用Block nested loop 算法

总结

上学时，数据库老师最喜欢考数据库范式，直到上班才学会一切以性能为准，能冗余就冗余，实在冗余不了的就join如果join真的影响到性能。试着调大你的join_buffer_size, 或者换固态硬盘。

到此这篇关于为什么代码规范要求SQL语句不要过多的join的文章就介绍到这了,更多相关SQL语句不要过多join内容请搜索脚本之家以前的文章或继续浏览下面的相关文章希望大家以后多多支持脚本之家！

您可能感兴趣的文章:

浅谈mysql join底层原理
SQL语句中JOIN的用法场景分析
MYSQL数据库基础之Join操作原理
解决Mysql的left join无效及使用的注意事项说明
mysql left join快速转inner join的过程
mysql高效查询left join和group by(加索引)
MySQL的join buffer原理
SQL之各种join小结详细讲解

上一篇：详解MySQL多版本并发控制机制(MVCC)源码
下一篇：mysql联合索引的使用规则

为什么代码规范要求SQL语句不要过多的join

送分题面试官：有操作过Linux吗我：有的呀面试官：我想查看内存的使用情况该用什么命令我： free 或者 top 面试官：那你说一下用free命令都可以看到啥信息我：那，如下图所示为什么,代码,规范,要求,...

呼和浩特电脑外呼系统（外呼系统怎么租用收费）

本文目录一览： 1、外呼体系怎样处理？2、外呼体系是什么?3、电话外呼体系是什么意...

电销机器人可以在任意时段完成客户的初步筛选

1.工作效率高电销机器人一天可以呼出上千通电话，效率是普通电销人员的十几倍。电...

杭州抗封呼叫中心系统办理公司-价格合理

杭州抗封呼叫中心系统办理公司每天连续工作8小时，可以拨打800-1000通电话。工作状态...

北京餐饮加盟ai外呼机器人办理商家-哪家强?

北京餐饮加盟ai外呼机器人办理商家也是业绩考核的依据，同时，可为企业提供的产品...

电话400怎么办理（怎么办理400电话号码）

电话400怎么办理（怎么办理400电话号码）电话400作为普遍使用的客服热线，对于企业而...

400电话是哪里的，400电话是哪个部门负责

400电话是哪里的，400电话是哪个部门负责400电话代理商为你解答。 400电话是一个全国范...

400电话办理的花费包括哪些

做一件事情之前如果你会做好所有的准备，那么所有的事情都会是非常简单和容易的，...

北京自动外呼系统（外呼系统官网）

今日给各位共享北京主动外呼体系的常识，其间也会对外呼体系官网进行解说，假如能...

山西智能外呼系统怎么样（智能外呼公司排名）

本篇文章给大家谈谈山西智能外呼系统怎么样，以及智能外呼公司排名对应的知识点，...

美国禁用微信？消息称特朗普政府允许美企继续使用微信

继美国宣布禁用微信之后，根据知情人士透漏，特朗普政府正释放出信号，允许包括苹...

吉安电销电话卡（江西吉安电信号码）

本文目录一览：1、电销卡是什么卡?2、电销卡是什么?为什么电销卡也会封号?3、抗封电...

武汉5G外呼线路降价-请看！

武汉5G外呼线路降价导致市面上的电话电销机器人泛滥成灾，多不胜数，很多人在选购...

如何实现textarea中获取动态剩余字数的方法

工作中遇到一个案例，之前没有写过，今儿啃了半个下午硬是给写出来，灰常又成就感...

中国移动公布2019年物联网USIM中标结果 USIM卡大单花落谁

早在2019年1月份中国移动就公布了大规模近4.91亿的USIM卡采购计划，被外界认为是斥资重...

400电话如何监控客服服务情况呢?

企业的客服服务质量直接影响着企业品牌，如何通过监控客服服务情况来改善质量，是...

为什么代码规范要求SQL语句不要过多的join

全 部 栏 目

送分题

再谈SQL Join

回顾

缓冲区

一个大前提

Join算法

总结

全部栏目