数学建模社区-数学中国

标题: URL编码与SQL注射 [打印本页]

作者: 韩冰    时间: 2004-11-22 23:43
标题: URL编码与SQL注射
<>说到url编码,你或许会想起N年前的url编码漏洞。可惜我是"生不逢时"啊,我接触网络时,那个漏洞早就绝迹咯。
2 K* C  z5 f3 c! n' O
$ R: e/ |! l0 R- o1 m: ]- j1 j言归正传,URL 编码是什么东东呢?看看我从网上抄的定义:, i! r1 i' s( p8 `! @, j  T

, ?7 \0 M( d- D- m6 a引用: </P>) G" R& A2 J6 B( N! I
url编码是一种浏览器用来打包表单输入的格式。浏览器从表单中获取所有的name和其中的值 ,将它们以name/value参数编码(移去那些不能传送的字符, 将数据排行等等)作为URL的一部分或者分离地发给服务器。不管哪种情况, 在服务器端的表单输入格式样子象这样: # y+ X. r  |  j/ W+ l2 |/ s
1 n; E$ I- X  N" L* f
theName=Ichabod+Crane&amp;gender=male&amp;status=missing&amp;headless=yes
4 M! D0 {& Y; N6 T: C# f3 I% z; l; {: n  j5 s" t
URL编码遵循下列规则: 每对name/value由&amp;符分开;每对来自表单的name/value由=符分开。如果用户没有输入值给这个name,那么这个name还是出现,只是无值。任何特殊的字符(就是那些不是简单的七位ASCII,如汉字)将以百分符%用十六进制编码,当然也包括象 =, &amp;, 和 % 这些特殊的字符。
" P) P- T8 e1 y7 U' a9 c9 ]7 t) Q. }: Q2 W0 M2 E
呵呵,明白了吧,其实url编码就是一个字符ascii码的十六进制。不过稍微有些变动,需要在前面加上"%"。比如"\",它的ascii码是92,92的十六进制是5c,所以"\"的url编码就是%5c。那么汉字的url编码呢?很简单,看例子:"胡"的ascii码是-17670,十六进制是BAFA,url编码是"%BA%FA"。呵呵,知道怎么转换的了吧。7 Z! ^0 M# Y3 j: d& R% {7 J9 Q) I
" s" L- P  h* i8 |
URL编码平时我们是用不到的,因为IE会自动将你输入到地址栏的非数字字母转换为url编码。所以对于浏览器来说http://blog.csdn.net/l%61ke2与http://blog.csdn.net/lake2是等效的(注意,第一个url我用%61替换了a)。呵呵,或许你已经想起了,有人提出数据库名字里带上"#"以防止被下载,因为IE遇到#就会忽略后面的字母。破解方法很简单——用url编码%23替换掉#。我本来企图利用url编码来躲过注射检查的,不过失败了,因为服务器端会将url编码转换成字符的。" p8 A! g* A; ~/ J( m: c5 r
! B/ H6 R  f# D
等等,好像跑题了啊,呵呵,不好意思:)) Z! l- c$ K9 W7 y9 l8 P

6 g: S4 U5 ?/ q4 }现在SQL注射非常流行,所以就有人写了一些防注射的脚本。当然啦,思路不一样,效果大不同。各位看官请看下面的××SQL通用防注入asp版部分代码。
! w8 D, S8 r$ ~* {, h4 H; \3 K" m* X
Fy_Url=Request.ServerVariables("QUERY_STRING")
/ }( o8 [/ x0 l( u3 pFy_a=split(Fy_Url,"&amp;")
3 c* `( x& q5 _* @, @! ~8 hredim Fy_Cs(ubound(Fy_a))
) f3 i- C, n5 n# X. n# e" I% j$ _On Error Resume Next
( W5 U5 Q; V% x8 s/ wfor Fy_x=0 to ubound(Fy_a)
- E$ S! `" x( l+ sFy_Cs(Fy_x) = left(Fy_a(Fy_x),instr(Fy_a(Fy_x),"=")-1)
! x5 {. M1 S0 w  ~5 k, ]% _Next9 A4 _8 \$ R+ M# X0 r
For Fy_x=0 to ubound(Fy_Cs)3 Q1 `! O% r+ T6 n2 b( I: G
If Fy_Cs(Fy_x)&lt;&gt;"" Then
: {8 _1 J% ^9 B9 z7 z' a7 ^If Instr(LCase(Request(Fy_Cs(Fy_x))),"and")&lt;&gt;0 then
9 E/ ?& z9 g  Y: CResponse.Write "出现错误!"- ^: f& q1 N) q
Response.End) B4 |$ G( O( U, R0 T- w) J: H
End If* B# r# @$ F+ `8 Q) Q
End If" |$ h7 e! k/ W& c4 U5 g  W
Next
/ ~/ |7 a2 K0 f, x& W1 G% i
/ S) x9 ?9 Q5 _- u% b1 [) c
; a( }( t4 \. D7 ^% p& o它的思路就是先获得提交的数据,以"&amp;"为分界获得并处理name/value组,然后判断value里是否含有定义的关键字(这里为求简便,我只留下了"and"),有之,则为注射。
, T; L5 U4 H0 j# @: W: _3 t7 |# h" F$ y
乍一看去,value被检查了,似乎没有问题。呵呵,是的,value不会有问题,可是,name呢?
; j% q1 @/ `; k+ s) g! M3 \, M2 K+ Q; I9 B' p; |
它的name/value组值来自于Request.ServerVariables("QUERY_STRING"),呵呵,不好意思,这里出问题了。Request.ServerVariables("QUERY_STRING")是得到客户端提交的字符串,这里并不会自动转换url编码,哈哈,如果我们把name进行url编码再提交的话,呵呵,那就可以绕过检查了。比如参数是ph4nt0m=lake2 and lis0,此时程序能够检测到;如果提交%50h4nt0m=lake2 and lis0(对p进行url编码),程序就会去判断%50h4nt0m的值,而%50h4nt0m会被转换为ph4nt0m,所以%50h4nt0m值为空,于是就绕过了检测。
; B0 M# d2 h) `$ R7 r- ^! s, E6 i
# }4 h) d0 ^, O* y0 q% F) p' S9 l等等,为什么既然name不解码可以绕过检查而value就不能绕过呢?因为value的值取自Request(Fy_Cs(Fy_x)),这个服务器就会解码的。
+ F9 H% s0 R4 ]' K# q# t8 F( a9 d2 D. B" ~0 y8 @
程序怎么改进呢?只要能够得到客户端提交的数据是解码后的就可以了,把得到name的语句改为For Each SubmitName In Request.QueryString就可以了。% j5 t7 t7 r" k/ ]

3 \2 S- @1 n' C9 ?7 D7 v呵呵,谢谢阁下耐着性子看完我的文章^_^




欢迎光临 数学建模社区-数学中国 (http://www.madio.net/) Powered by Discuz! X2.5