• 企业400电话
  • 微网小程序
  • AI电话机器人
  • 电商代运营
  • 全 部 栏 目

    企业400电话 网络优化推广 AI电话机器人 呼叫中心 网站建设 商标✡知产 微网小程序 电商运营 彩铃•短信 增值拓展业务
    为什么代码规范要求SQL语句不要过多的join

    送分题

    面试官:有操作过Linux吗?

    :有的呀

    面试官:我想查看内存的使用情况该用什么命令

    free 或者 top

    面试官:那你说一下用free命令都可以看到啥信息

    :那,如下图所示 可以看到内存以及缓存的使用情况

    面试官:那你知道怎么清理已使用的缓存吗(buff/cache)

    :em… 不知道

    面试官sync; echo 3 > /proc/sys/vm/drop_caches就可以清理buff/cache了,你说说我在线上执行这条命令做好不好?

    :(送分题,内心大喜)好处大大的有,清理出缓存我们就有更多可用的内存空间, 就跟pc上面xx卫士的小火箭一样,点一下,就释放出好多的内存

    面试官:em…, 回去等通知吧

    再谈SQL Join

    面试官:换个话题,谈谈你对join的理解

    : 好的(再答错就彻底完了,把握住机会)

    回顾

    SQL中的join可以根据某些条件把指定的表给结合起来并将数据返回给客户端

    join的方式有

    inner join 内连接

    left join 左连接

    right join 右连接

    full join 全连接

    面试官:在项目开发中如果需要使用join语句,如何优化提升性能?

    : 分为两种情况,数据规模小的,数据规模大的。

    面试官: 然后?

    :对于

    可以通过增加索引来优化join语句的执行速度 可以通过冗余信息来减少join的次数 尽量减少表连接的次数,一个SQL语句表连接的次数不要超过5次

    面试官:可以总结为join语句是相对比较耗费性能,对吗?

    :是的

    面试官: 为什么?

    缓冲区

    : 在执行join语句的时候必然要有一个比较的过程

    面试官: 是的

    :逐条比较两个表的语句是比较慢的,因此我们可以把两个表中数据依次读进一个内存块中, 以MySQL的InnoDB引擎为例,使用以下语句我们必然可以查到相关的内存区域show variables like '%buffer%'

    如下图所示join_buffer_size的大小将会影响我们join语句的执行性能

    面试官: 除此之外呢?

    一个大前提

    :任何项目终究要上线,不可避免的要产生数据,数据的规模又不可能太小

    面试官: 是这样的

    :大部分数据库中的数据最终要保存到硬盘上,并且以文件的形式进行存储。

    以MySQL的InnoDB引擎为例

    验证

    :这意味着我们有多少表要连接就需要读多少个文件,虽然可以利用索引,但还是免不了频繁的移动硬盘的磁头

    面试官:也就是说频繁的移动磁头会影响性能对吧

    :是的,现在的开源框架不都喜欢说自己通过顺序读写大大的提升了性能吗,比如hbasekafka

    面试官:说的没错,那你认为Linux有对此做出优化吗?提示,你可以再执行一次free命令看一下

    :奇怪缓存怎么占用了1.2G多

    面试官: 你有没有想过

    品,你细品

    思考了几分钟后

    :这么随便就释放了buff/cache所占用的内存,说明它就不重要, 清除它不会对系统的运行造成影响

    面试官: 不完全对

    :难道是?想起来《CSAPP》(深入理解计算机系统)里面说过一句话

    存储器层次结构的本质是,每一层存储设备都是较低一层设备的缓存

    翻译成人话,就是说Linux会把内存当作是硬盘的高速缓存

    面试官:现在知道那道送分题应该怎么回答了吧

    :我…

    Join算法

    面试官:再给你个机会,如果让你来实现Join算法你会怎么做?

    :无索引的话,嵌套循环就完事了嗷。有索引的话,则可以利用索引来提升性能.

    面试官:说回join_buffer 你认为join_buffer里面存储的是什么?

    :在扫描过程中,数据库会选择一个表把他要返回以及需要进行和其他表进行比较的数据放进join_buffer

    面试官:有索引的情况下是怎么处理的?

    :这个就比较简单了,直接读取两个表的索引树进行比较就完事了嗷,我这边介绍一下无索引的处理方式

    Nested Loop Join

    嵌套循环,每次只读取表中的一行数据,也就是说如果outerTable有10万行数据, innerTable有100行数据,需要读取10000000次(假设这两个表的文件没有被操作系统给缓存到内存, 我们称之为冷数据表)

    当然现在没啥数据库引擎使用这种算法(太慢了)

    Block nested loop

    Block 块,也就是说每次都会取一块数据到内存以减少I/O的开销

    当没有索引可以使用的时候,MySQL InnoDB 就会使用这种算法

    考虑以下两个表 t_at_b

    当无法使用索引执行join操作的时候,InnoDB会自动使用Block nested loop 算法

    总结

    上学时,数据库老师最喜欢考数据库范式,直到上班才学会一切以性能为准,能冗余就冗余,实在冗余不了的就join如果join真的影响到性能。试着调大你的join_buffer_size, 或者换固态硬盘。

    到此这篇关于为什么代码规范要求SQL语句不要过多的join的文章就介绍到这了,更多相关SQL语句不要过多join内容请搜索脚本之家以前的文章或继续浏览下面的相关文章希望大家以后多多支持脚本之家!

    您可能感兴趣的文章:
    • 浅谈mysql join底层原理
    • SQL语句中JOIN的用法场景分析
    • MYSQL数据库基础之Join操作原理
    • 解决Mysql的left join无效及使用的注意事项说明
    • mysql left join快速转inner join的过程
    • mysql高效查询left join和group by(加索引)
    • MySQL的join buffer原理
    • SQL之各种join小结详细讲解
    上一篇:详解MySQL多版本并发控制机制(MVCC)源码
    下一篇:mysql联合索引的使用规则
  • 相关文章
  • 

    © 2016-2020 巨人网络通讯 版权所有

    《增值电信业务经营许可证》 苏ICP备15040257号-8

    为什么代码规范要求SQL语句不要过多的join 为什么,代码,规范,要求,