在线时间 1630 小时 最后登录 2024-1-29 注册时间 2017-5-16 听众数 82 收听数 1 能力 120 分 体力 566340 点 威望 12 点 阅读权限 255 积分 175125 相册 1 日志 0 记录 0 帖子 5313 主题 5273 精华 3 分享 0 好友 163
TA的每日心情 开心 2021-8-11 17:59
签到天数: 17 天
[LV.4]偶尔看看III
网络挑战赛参赛者
网络挑战赛参赛者
自我介绍 本人女,毕业于内蒙古科技大学,担任文职专业,毕业专业英语。
群组 : 2018美赛大象算法课程
群组 : 2018美赛护航培训课程
群组 : 2019年 数学中国站长建
群组 : 2019年数据分析师课程
群组 : 2018年大象老师国赛优
拼多多面试问了数据库基础知识,今天分享出来 * V- `9 x e3 k0 \5 C% _5 \
; t" {, `% L8 h# A, a4 t% p
前言7 n) D2 Y3 X$ [" p) R$ |
- I+ y! u* g/ ^1 X! L2 b
我是个标题党,所有文章的名字只是我的噱头,我们应该有一颗谦逊的心,所以希望大家怀着空杯心态好好学,一起进步。
$ L$ Y* K8 { r _' Y, v6 H( ` ( z) F8 k1 R: `# U
数据库我想大家应该一点都不陌生吧,我想不管你写啥的,数据库就算没用过也听过了,是我们项目体系里面不可或缺的一环。
" A s. c6 O" A" k
H. Q# `1 V# w- \+ x. o) b7 Y, ]" U 问了一圈,身边朋友公司要么用自研,要么就清一色的MySQL,所以想看Oracle的朋友可能要失望了,但是不影响你了解数据库的通用知识。( _- o; w2 F; O) H; _$ F
7 K, @+ s: i8 w2 e$ ?
正文
|. T. `# L! d+ P# ?0 K 6 s+ v$ T7 V5 ]+ r8 W
你知道MySQL的基本架构么?你能在纸上给我大致画出这个示意图么?
* k. G+ N5 |! y- b& a1 A8 u
+ u5 B: N2 ^9 V 好的那我们按照顺序了解下,连接器是啥?# m- X1 P0 B% F4 P8 \1 G4 y: x: g
我们要进行查询,第一步就是先去链接数据库,那这个时候就是连接器跟我们对接。0 V- e2 H* l& i% Y
# m. c* }- c' n% Y* X L 他负责跟客户端建立链接、获取权限、维持和管理连接。
6 y* c; R1 u& }( M; ]- k + M0 ^; G0 {; n4 \# B
链接的时候会经过TCP握手,然后身份验证,然后我们输入用户名密码就好了。1 {1 c2 N" ]; H, M, b
9 P) A! p7 k9 v" }9 U 验证ok后,我们就连上了这个MySQL服务了,但是这个时候我们处于空闲状态。6 O l( I2 E, A9 w8 H# v( a
' r, j- t8 \- ` 怎么查看空闲连接列表?
9 j2 H" s. ]: @( ?% V" t show processlist,下图就是我在自己的数据库表执行命令的结果,其中的Command列显示为Sleep的这一行,就表示现在系统里面有一个空闲连接。: X7 `# f/ x: ]5 `, H
F# ?1 ~2 l/ v+ ~! d" A+ D$ C
这里需要注意的是,我们数据库的客户端太久没响应,连接器就会自动断开了,这个时间参数是wait_timeout控制住的,默认时长为8小时。
( r5 \6 r/ N( s6 {2 K" j
' X3 Q4 |6 o( Z* s6 S 断开后重连的时候会报错,如果你想再继续操作,你就需要重连了。
, u' k: I2 Q4 j. g' E; V4 ?; S
6 Y1 M! }/ O( d8 E0 r# g" H7 y 这个有个我看过的书本的案例:
/ r7 Q! @4 [* s. D
5 R7 G; V+ R$ ], l7 Y0 k+ Z- y 一个在政府里的朋友说,他们的系统很奇怪,每天早上都得重启一下应用程序,否则就提示连接数据库失败,他们都不知道该怎么办。" c3 A1 z2 D' g9 r
我分析说,按照这个错误提示,应该就是连接时间过长了,断开了连接。数据库默认的超时时间是8小时,而你们平时六点下班,下班之后系统就没有人用了,等到第二天早上九点甚至十点才上班,这中间的时间已经超过10个小时了,数据库的连接肯定就会断开了。" f- n0 J& Z8 `
是的,就是超出了超时时间,然后写代码的人也没注意到这个细节,所以才会出现这个问题。
& b* J) Y* ~$ H 9 ?4 n4 q2 d4 S+ K
把超时时间改得长一点,问题就解决了。
* @. Z# n! ]$ B; c * ~. _# i! k6 I: X5 x$ Y: D$ l
这种参数其实我们平时不一定能接触到,但是真的遇到问题的时候,知道每个参数的大概用法,不至于让你变成无头苍蝇。) q* A( i5 a4 u8 A* u ]
" h; C0 d0 \' Q! q 那除了重新链接,还有别的方式么?因为建立链接还是比较麻烦的。4 ^4 z0 u* C; X, h( b+ `8 u( F6 r
使用长连接。1 H" D9 c( a8 n5 K( z, G1 w4 C
) b4 o5 t2 P$ @! i5 j
但是这里有个缺点,使用长连接之后,内存会飙得很快,我们知道MySQL在执行过程中临时使用的内存是管理在连接对象里面的。2 h, F3 R/ V* \* B, L4 n! E
( C* Z$ r+ z" `2 m
只有在链接断开的时候才能得到释放,那如果一直使用长连接,那就会导致OOM(Out Of Memory),会导致MySQL重启,在JVM里面就会导致频繁的Full GC。! X3 I. O& ~& \5 }6 ^* p; X
% n P7 c/ m% y7 u4 p
那你会怎么解决?
& r5 ?- b( y4 h' ^ 我一般会定期断开长连接,使用一段时间后,或者程序里面判断执行过一个占用内存比较大的查询后就断开连接,需要的时候重连就好了。
7 A1 c; x& A9 y/ D! F
1 M! b0 @; n; M, s1 G, ?/ H: q `% c 还有别的方法么?你这种感觉不优雅呀小老弟。
( E$ X0 f# N1 V; Z 执行比较大的一个查询后,执行mysql_reset_connection可以重新初始化连接资源。这个过程相比上面一种会好点,不需要重连,但是会初始化连接的状态。
0 E& Q. y3 L' n( Z
& o2 a7 e1 B8 e! m 你了解MySQL的查询缓存么?
/ p& n P( u2 C1 m, V: y MySQL拿到一个查询请求后,会先到查询缓存看看,之前是不是执行过这条语句。
0 g- w) D3 p+ g7 }. N ' c0 U. W, q% m! E9 `% A
大家是不是好奇同一条语句在MySQL执行两次,第一次和后面的时间是不一样的,后者明显快一些,这就是因为缓存的存在。
. O* x( y' k3 {! s) B5 U
4 J% h3 R4 `* U Z2 J 他跟Redis一样,只要是你之前执行过的语句,都会在内存里面用key-value形式存储着。
% y# }8 w8 F& |! c
+ P R% f0 x* Y7 m/ k6 m s0 J 查询的时候就会拿着语句先去缓存中查询,如果能够命中就返回缓存的value,如果不命中就执行后面的阶段。
& ?- r+ T) {" x; R2 V; U u( i* K. h6 ~+ P L( q
但是我还是不喜欢用缓存,因为缓存弊大于利。
+ d( E9 r8 C2 ?, q8 [( X
% t) S/ x3 Q' T 哦?此话怎讲?
+ D" H5 ]; U4 g 缓存的失效很容易,只要对表有任何的更新,这个表的所有查询缓存就会全部被清空,就会出现缓存还没使用,就直接被清空了,或者积累了很多缓存准备用来着,但是一个更新打回原形。; @1 h3 S; Q9 D+ O# f% O
$ a* g4 k, {; p5 ^3 [. C
这就导致查询的命中率低的可怕,只有那种只查询不更新的表适用缓存,但是这样的表往往很少存在,一般都是什么配置表之类的。' R o6 H. @, A, N, Z# R7 K
' D; W% B) @) ]" \/ a& I' t 那我们查询的时候不想用缓存一般都是怎么操作的,或者是用缓存又怎么操作?+ f1 I! L( w! S, Y- f0 t
可以显示调用,把query_cache_type设置成为DEMAND,这样SQL默认不适用缓存,想用缓存就用SQL_CACHE。4 ~1 f4 s0 Z& q7 n& h# Y
& O; D' w! ^% @3 ~5 L 有个小技巧就是,我们之前开发的时候,都会去库里看看sql执行时间,但是可能是有缓存的,一般我们就在sql前面使用SQL_NO_CACHE就可以知道真正的查询时间了。
( P0 I3 [( W) |) u, |: _+ u
* d' n. }7 Q& ^) {7 ? select SQL_NO_CACHE * from B* _7 L+ s; ^0 Y+ g6 S8 C
缓存在MySQL8.0之后就取消了,所以大家现在应该不需要太关注这个问题,主要是我之前用的版本都不高,所以缓存一直有,在《高性能MySQL》书中也看到了一些关于缓存的介绍,就想起来给大家也提一下了。# b; J: |0 c7 `
' `$ G' m9 ] y& o2 [6 O: v
缓存查询完了应该做啥呢?
% Z- J8 c+ T& e1 B3 I( g# E 在缓存没有命中的情况下,就开始执行语句了,你写的语句有没有语法错误,这是接下来MySQL比较关心的点。
+ f* A# T0 p* p3 i: O % R# {9 H6 l9 I% r% `
那他会怎么做呢?会先做词法分析,你的语句有这么多单词、空格,MySQL就需要识别每个字符串所代表的是什么,是关键字,还是表名,还是列名等等。% k j1 G' c8 y2 M4 n$ u$ O' ^5 J3 U
' k8 [/ ^/ F8 F! ~( z3 x8 B
然后就开始语法分析,根据词法分析的结果,语法分析会判断你sql的对错,错了会提醒你的,并且会提示你哪里错了。) H+ u W( l8 f5 n
# {% i: u" e' N3 w* T; z 分析没错之后就进入下一步,优化器。% B2 o7 k( Q' F. ^- P; h$ Q* E2 t4 B
9 I- _8 g0 o& a( z 主要是优化什么呢?
' e0 l9 [3 n/ F 优化就比较简单了,因为我们建立表可能会建立很多索引,优化有一步就是要确认使用哪个索引,比如使用你的主键索引,联合索引还是什么索引更好。% u4 q7 Q9 Z& G$ l
Z. @2 o& M1 T$ c+ c; G2 E
还有就是对执行顺序进行优化,条件那么多,先查哪个表,还是先关联,会出现很多方案,最后由优化器决定选用哪种方案。
1 s' b d2 ]7 K3 W. S
: C2 o) K+ H1 i8 b! @/ O 最后就是执行了,执行就交给执行器去做。
! |" v0 w, v8 ]7 r0 ^/ A3 L9 R/ @
5 X$ h/ [6 R6 a0 k5 i9 S: ^! z 第一步可能就是权限的判断,其实这里我不确定的一个点就是,我接触的公司很多都是自研的线上查询系统,我们是不能用Navicat直连线上库,只能去网页操作,那表的权限是在MySQL层做的,还是系统做的,我猜应该是系统层做的,MySQL可能默认就全开放了,只是我们 不知道ip。1 d: b( I0 |4 u
1 b6 v3 s( l" O' t" } 有知道的小伙伴也可以在公众号【三太子敖丙】去加我微信跟我说。
5 a' R3 L# Z, z8 V+ f6 A7 J
+ h" J, t" r6 E& _! A4 ^! o' w4 e9 u3 X 执行的时候,就一行一行的去判断是否满足条件,有索引的执行起来可能就好点,一行行的判断就像是接口都提前在引擎定义好了,所以他比较快。 r( w: W3 S! K5 i( G- ^; K
' o/ ^7 b Q5 l% x, ]9 i" o 数据库的慢日志有个rows_examined字段,扫描多少行可以看到,还有explain也可以看到执行计划,我们扫描了多少行。
$ R/ x& y2 ?$ e: m * d& t- K: f% w3 ^
可以小伙子,基础大致框架还是了解得很清楚的,我们下次深入了解下,索引和部分机制。% R5 ~/ d( B j& n- U( e. E( Z
好的,我们下次见。6 n. z; ~- ` N7 x
7 d B, Y- W4 w8 p9 f0 y
总结2 @% {- @8 v! ]
7 v0 d1 v6 o$ v/ G& j' V 基本上我把MySQL的逻辑架构的东西都简单聊了一遍,当然你去自信了解的话,你会发现其实里面还有很多细节的,我只是说了一些常见的问题,这还是阿里丁奇学长的《MySQL实战》的思路。2 @8 W2 G- @: G) }
- o6 K, p5 H( v 我自己在MySQL方面更多的可能就是理论知识了,还做不到深入了解的地步,大家如果有机会一定要深入的去学习一下。
7 h, S d) i4 J5 c) o/ u ————————————————; [. M$ _) q) L' g6 o, \
版权声明:本文为CSDN博主「敖 丙」的原创文章,遵循 CC 4.0 BY 版权协议,转载请附上原文出处链接及本声明。0 @# ~* N2 c" P$ O" g) u
原文链接:https://blog.csdn.net/qq_35190492/article/details/104203466
, [7 N( f; ?1 M. W1 k- ]) h
- K) N+ _ e" j5 u9 Y1 n! ^
- |& s: R" V0 A/ o
zan