数学建模社区-数学中国
标题:
拼多多面试问了数据库基础知识,今天分享出来
[打印本页]
作者:
杨利霞
时间:
2020-4-28 15:19
标题:
拼多多面试问了数据库基础知识,今天分享出来
拼多多面试问了数据库基础知识,今天分享出来
0 Y4 J" z& ~. V
$ X, m) K; f) J3 O" k j/ A8 ^
前言
$ ~5 x" W( \' R/ m, e K
c6 }$ U1 B2 d, j j* R+ u
我是个标题党,所有文章的名字只是我的噱头,我们应该有一颗谦逊的心,所以希望大家怀着空杯心态好好学,一起进步。
; K0 U- A9 ^! ]( E& i
4 |& b8 t, x( F$ W3 {* O' R# C
数据库我想大家应该一点都不陌生吧,我想不管你写啥的,数据库就算没用过也听过了,是我们项目体系里面不可或缺的一环。
' c- ^- y+ D6 C; c8 i
3 P) K4 ?. {( l) L- l2 M9 h
问了一圈,身边朋友公司要么用自研,要么就清一色的MySQL,所以想看Oracle的朋友可能要失望了,但是不影响你了解数据库的通用知识。
4 O! V. b& k# s, U# X, b9 q3 f
+ e% X8 ?* O) _4 D
正文
2 w2 Y) v6 V7 j) `- {
8 F; n0 D/ e: u2 G* [1 c* E0 Q8 f
你知道MySQL的基本架构么?你能在纸上给我大致画出这个示意图么?
* i& m1 o. Q8 ?" ]
2020-4-28 15:17 上传
下载附件
(48.19 KB)
4 S& t5 }; k4 y" B" J$ X1 j
好的那我们按照顺序了解下,连接器是啥?
6 F* l% |5 x. M! g% C X) m% M
我们要进行查询,第一步就是先去链接数据库,那这个时候就是连接器跟我们对接。
2 {# D) w! b8 g: G
$ E3 N) \; h/ n8 G; q! H6 b
他负责跟客户端建立链接、获取权限、维持和管理连接。
8 n3 M' M# T/ a
& a1 T: Z( |3 f, z3 ~
链接的时候会经过TCP握手,然后身份验证,然后我们输入用户名密码就好了。
' G9 A9 |! i* M
& |0 g& a1 d3 k; _
验证ok后,我们就连上了这个MySQL服务了,但是这个时候我们处于空闲状态。
3 U& n) H' U$ f) @
# ]3 b1 ~- A: Y3 ~; H7 ?
怎么查看空闲连接列表?
& \1 D, O6 X3 N# g2 @; v
show processlist,下图就是我在自己的数据库表执行命令的结果,其中的Command列显示为Sleep的这一行,就表示现在系统里面有一个空闲连接。
- ^& v! f/ |% P" S# ~3 j$ F
2020-4-28 15:18 上传
下载附件
(56.41 KB)
; B" O+ ?3 e5 W; l
这里需要注意的是,我们数据库的客户端太久没响应,连接器就会自动断开了,这个时间参数是wait_timeout控制住的,默认时长为8小时。
4 g& @, q: \1 E' }! i( ]8 z7 Q
. f/ w1 Q8 }$ R+ a5 l
断开后重连的时候会报错,如果你想再继续操作,你就需要重连了。
7 Z+ R, _4 p# Y7 u
8 B+ N% v- q# j+ x+ K6 r, C, f
这个有个我看过的书本的案例:
5 R) F$ E x2 t9 y
) _9 D; c% ^. ?4 B& {$ `
一个在政府里的朋友说,他们的系统很奇怪,每天早上都得重启一下应用程序,否则就提示连接数据库失败,他们都不知道该怎么办。
( H6 _% M$ n/ K* M/ P; p
我分析说,按照这个错误提示,应该就是连接时间过长了,断开了连接。数据库默认的超时时间是8小时,而你们平时六点下班,下班之后系统就没有人用了,等到第二天早上九点甚至十点才上班,这中间的时间已经超过10个小时了,数据库的连接肯定就会断开了。
' B4 v" c& z% E4 b1 U- V/ H; d
是的,就是超出了超时时间,然后写代码的人也没注意到这个细节,所以才会出现这个问题。
! J& O( X* F" u2 B% ]/ Y
" r; t# R3 m. @# O" }: {5 z% r
把超时时间改得长一点,问题就解决了。
2 H/ r" ?. f* P) }! l2 I, _2 z
" P' d3 h/ R4 n
这种参数其实我们平时不一定能接触到,但是真的遇到问题的时候,知道每个参数的大概用法,不至于让你变成无头苍蝇。
. {+ f$ o8 O4 ^
8 T( y C# z' Y. A p
那除了重新链接,还有别的方式么?因为建立链接还是比较麻烦的。
( E% X5 b1 W$ N& k' R
使用长连接。
3 B& F) H) \; h. J% l+ j$ [: v7 a* ~% x3 g
) T3 z% M, Q$ e( T# _
但是这里有个缺点,使用长连接之后,内存会飙得很快,我们知道MySQL在执行过程中临时使用的内存是管理在连接对象里面的。
?' b2 O4 Q$ @1 h+ b8 T2 v
* H2 r8 l, {0 o8 B
只有在链接断开的时候才能得到释放,那如果一直使用长连接,那就会导致OOM(Out Of Memory),会导致MySQL重启,在JVM里面就会导致频繁的Full GC。
, I3 _0 G! Q8 `6 u
$ i. K% N: E, D: l& l; N1 e
那你会怎么解决?
( J7 n1 d8 {! Y3 j( L
我一般会定期断开长连接,使用一段时间后,或者程序里面判断执行过一个占用内存比较大的查询后就断开连接,需要的时候重连就好了。
q- d+ _' H6 ~1 R" _. w" Y" {
% c' A7 }, ^6 b" N4 ~6 x: f
还有别的方法么?你这种感觉不优雅呀小老弟。
, P( c5 {3 ]! U" Q
执行比较大的一个查询后,执行mysql_reset_connection可以重新初始化连接资源。这个过程相比上面一种会好点,不需要重连,但是会初始化连接的状态。
5 V+ s1 |' e2 |' x7 I+ X
% n, _7 u/ |. \+ v2 A% _; E, r7 v7 w3 x
你了解MySQL的查询缓存么?
, Z' s" E4 [8 @# i2 i! j: \
MySQL拿到一个查询请求后,会先到查询缓存看看,之前是不是执行过这条语句。
0 Z3 V& I4 w& r1 T& Y
$ X. X" W: \9 _) s, c+ Z9 S/ T
大家是不是好奇同一条语句在MySQL执行两次,第一次和后面的时间是不一样的,后者明显快一些,这就是因为缓存的存在。
$ V9 z; O( e+ v& T1 i k
/ I5 `0 n$ C; j) J- I) x
他跟Redis一样,只要是你之前执行过的语句,都会在内存里面用key-value形式存储着。
# P7 A, H/ P% i! B
0 L8 h I" y5 ^5 }* S
查询的时候就会拿着语句先去缓存中查询,如果能够命中就返回缓存的value,如果不命中就执行后面的阶段。
6 K0 u. q# j7 r( l/ n
g, C0 D4 \+ g
但是我还是不喜欢用缓存,因为缓存弊大于利。
# B K, \+ {- B5 {
2 X, v( y) O2 J! U& V
哦?此话怎讲?
! u" E) R4 p) v+ `/ [9 J
缓存的失效很容易,只要对表有任何的更新,这个表的所有查询缓存就会全部被清空,就会出现缓存还没使用,就直接被清空了,或者积累了很多缓存准备用来着,但是一个更新打回原形。
+ h7 ], U2 z9 F, F. w3 A/ Y m
~8 c) [- A+ V# x- f% s
这就导致查询的命中率低的可怕,只有那种只查询不更新的表适用缓存,但是这样的表往往很少存在,一般都是什么配置表之类的。
; L4 p% N V9 [ z$ @4 M/ i% J
0 G/ H( P3 k7 ^* o. K' H
那我们查询的时候不想用缓存一般都是怎么操作的,或者是用缓存又怎么操作?
% l$ L9 a i6 m9 E
可以显示调用,把query_cache_type设置成为DEMAND,这样SQL默认不适用缓存,想用缓存就用SQL_CACHE。
; m' Z; \$ A: H0 w' A. d6 H
$ {, M1 U+ t6 T! ]
有个小技巧就是,我们之前开发的时候,都会去库里看看sql执行时间,但是可能是有缓存的,一般我们就在sql前面使用SQL_NO_CACHE就可以知道真正的查询时间了。
, @0 C/ A5 d! _$ x) `
4 e$ U6 {% X ^" f
select SQL_NO_CACHE * from B
- m5 C6 f y5 e0 o6 P5 ]6 v
缓存在MySQL8.0之后就取消了,所以大家现在应该不需要太关注这个问题,主要是我之前用的版本都不高,所以缓存一直有,在《高性能MySQL》书中也看到了一些关于缓存的介绍,就想起来给大家也提一下了。
4 s5 @% y# j8 _/ B& M) s; j. v( m
6 [, w: K. R; k& t" a( l, z; v
缓存查询完了应该做啥呢?
/ b5 l, @+ ?5 r( J/ d, U6 C: L: m# I
在缓存没有命中的情况下,就开始执行语句了,你写的语句有没有语法错误,这是接下来MySQL比较关心的点。
5 i8 O) G; I7 V# g
1 L( u' o7 R9 K# N- m2 `8 n5 E, s
那他会怎么做呢?会先做词法分析,你的语句有这么多单词、空格,MySQL就需要识别每个字符串所代表的是什么,是关键字,还是表名,还是列名等等。
/ y% Q- g6 l n$ {# V$ M& m5 I3 ]; l
0 L: d: k' x7 W+ ~% F
然后就开始语法分析,根据词法分析的结果,语法分析会判断你sql的对错,错了会提醒你的,并且会提示你哪里错了。
: X- a' ^0 V3 u) M( q' u- I6 R
2020-4-28 15:19 上传
下载附件
(28.19 KB)
5 }6 Q0 A) R* @5 T) r
分析没错之后就进入下一步,优化器。
& Q& _/ N; _, F& V
' J; `2 D. e9 c# f& J
主要是优化什么呢?
. `* g/ R4 d5 C9 D6 {* S7 r; _: T
优化就比较简单了,因为我们建立表可能会建立很多索引,优化有一步就是要确认使用哪个索引,比如使用你的主键索引,联合索引还是什么索引更好。
9 g) K. \! V5 w% E3 Y
1 N6 X H' F( z) f. u b
还有就是对执行顺序进行优化,条件那么多,先查哪个表,还是先关联,会出现很多方案,最后由优化器决定选用哪种方案。
- h- c3 B6 O3 R6 d- Q! S1 X& G
3 d( a2 _9 h/ Q2 O8 m) z) b* D$ s
最后就是执行了,执行就交给执行器去做。
# l* V& j1 l$ q
+ K) E! S: V6 h2 E$ u) v9 v2 |0 O* D
第一步可能就是权限的判断,其实这里我不确定的一个点就是,我接触的公司很多都是自研的线上查询系统,我们是不能用Navicat直连线上库,只能去网页操作,那表的权限是在MySQL层做的,还是系统做的,我猜应该是系统层做的,MySQL可能默认就全开放了,只是我们 不知道ip。
- H& z- C! W U! r
/ d1 f7 n$ ~( }! O' z x/ m
有知道的小伙伴也可以在公众号【三太子敖丙】去加我微信跟我说。
1 p$ f7 J" d$ @ w1 X+ W! {
$ Z' S4 @1 D8 ^0 q. J# E
执行的时候,就一行一行的去判断是否满足条件,有索引的执行起来可能就好点,一行行的判断就像是接口都提前在引擎定义好了,所以他比较快。
& E) `; Y: g5 p
+ J, L8 R8 B3 @6 X% u
数据库的慢日志有个rows_examined字段,扫描多少行可以看到,还有explain也可以看到执行计划,我们扫描了多少行。
, s. F# D5 J5 q8 J
) e7 m- S2 n- s( l/ i
可以小伙子,基础大致框架还是了解得很清楚的,我们下次深入了解下,索引和部分机制。
& z) R$ v6 }: z9 u) P e& v* G( F
好的,我们下次见。
" K# q1 A8 O- v$ J7 D
7 O/ o. G7 A5 h1 i3 y7 D3 R
总结
6 @, z5 Y* V' F7 q* W; I
$ m1 o9 z4 E8 I7 G4 Y
基本上我把MySQL的逻辑架构的东西都简单聊了一遍,当然你去自信了解的话,你会发现其实里面还有很多细节的,我只是说了一些常见的问题,这还是阿里丁奇学长的《MySQL实战》的思路。
2 V5 j9 b! h6 X
1 U8 m/ b. ^* U9 J% J& I5 ^
我自己在MySQL方面更多的可能就是理论知识了,还做不到深入了解的地步,大家如果有机会一定要深入的去学习一下。
- Y0 m; k, t& T" _1 t- k+ L4 d
————————————————
) ~: m2 N5 w# v5 S
版权声明:本文为CSDN博主「敖 丙」的原创文章,遵循 CC 4.0 BY 版权协议,转载请附上原文出处链接及本声明。
3 i+ A; S( |, I" _" `
原文链接:https://blog.csdn.net/qq_35190492/article/details/104203466
; p4 O4 d2 G: T. p# y
; k5 U" o9 [' ^: \
5 G, `2 r, J5 m7 e8 p. T$ n. E/ O h
欢迎光临 数学建模社区-数学中国 (http://www.madio.net/)
Powered by Discuz! X2.5