数学建模社区-数学中国

标题: URL编码与SQL注射 [打印本页]

作者: 韩冰    时间: 2004-11-22 23:43
标题: URL编码与SQL注射
<>说到url编码,你或许会想起N年前的url编码漏洞。可惜我是"生不逢时"啊,我接触网络时,那个漏洞早就绝迹咯。. t0 F5 l# Y; B0 q

" z. [+ M7 f9 r7 W7 g( f# t言归正传,URL 编码是什么东东呢?看看我从网上抄的定义:' {9 I( h8 c2 T3 ~* J/ Q7 j" m  f

; i( a: y- g* s# B引用: </P>
3 |# [- f; i4 g, ~1 Y! C# kurl编码是一种浏览器用来打包表单输入的格式。浏览器从表单中获取所有的name和其中的值 ,将它们以name/value参数编码(移去那些不能传送的字符, 将数据排行等等)作为URL的一部分或者分离地发给服务器。不管哪种情况, 在服务器端的表单输入格式样子象这样: ! S' ~. t1 u# }) }
) g/ I* x! ~: z6 ~
theName=Ichabod+Crane&amp;gender=male&amp;status=missing&amp;headless=yes- U) W. H" ?8 B9 f$ g/ y+ D

3 Q) a/ e% A! ~8 d4 Y- M7 k$ kURL编码遵循下列规则: 每对name/value由&amp;符分开;每对来自表单的name/value由=符分开。如果用户没有输入值给这个name,那么这个name还是出现,只是无值。任何特殊的字符(就是那些不是简单的七位ASCII,如汉字)将以百分符%用十六进制编码,当然也包括象 =, &amp;, 和 % 这些特殊的字符。
2 ?- |2 g! q# J( K
1 M- O7 X$ n. W* O3 S呵呵,明白了吧,其实url编码就是一个字符ascii码的十六进制。不过稍微有些变动,需要在前面加上"%"。比如"\",它的ascii码是92,92的十六进制是5c,所以"\"的url编码就是%5c。那么汉字的url编码呢?很简单,看例子:"胡"的ascii码是-17670,十六进制是BAFA,url编码是"%BA%FA"。呵呵,知道怎么转换的了吧。
0 H1 Y2 s6 x8 |4 p% A: K# I6 l6 F9 |- m/ ]& ~* W) I
URL编码平时我们是用不到的,因为IE会自动将你输入到地址栏的非数字字母转换为url编码。所以对于浏览器来说http://blog.csdn.net/l%61ke2与http://blog.csdn.net/lake2是等效的(注意,第一个url我用%61替换了a)。呵呵,或许你已经想起了,有人提出数据库名字里带上"#"以防止被下载,因为IE遇到#就会忽略后面的字母。破解方法很简单——用url编码%23替换掉#。我本来企图利用url编码来躲过注射检查的,不过失败了,因为服务器端会将url编码转换成字符的。$ u: t6 d$ A/ j2 ~7 m, v- [* G

" u) C+ L, m- V9 x' U等等,好像跑题了啊,呵呵,不好意思:)
7 n3 `& \* p6 _# Z5 Z+ e7 i; K' y1 @0 s# M
现在SQL注射非常流行,所以就有人写了一些防注射的脚本。当然啦,思路不一样,效果大不同。各位看官请看下面的××SQL通用防注入asp版部分代码。
* ?' }1 K$ ^! Y( C! |* A( \/ P
Fy_Url=Request.ServerVariables("QUERY_STRING")
2 U' B) E  r* j. g+ kFy_a=split(Fy_Url,"&amp;")
% M" ~' H( ]. V' I: aredim Fy_Cs(ubound(Fy_a))
( r6 ^( h* T1 Y3 N, f! C$ IOn Error Resume Next7 I% P* D! Z3 z* H( R  C
for Fy_x=0 to ubound(Fy_a)+ p9 V0 z* f$ i# x/ q9 Q" b, @: h
Fy_Cs(Fy_x) = left(Fy_a(Fy_x),instr(Fy_a(Fy_x),"=")-1)
- u! \2 Q( K: \8 [# t+ L7 _& MNext
. h7 h$ Z1 P- F3 BFor Fy_x=0 to ubound(Fy_Cs)
* c7 s: S: ^+ _& i( `If Fy_Cs(Fy_x)&lt;&gt;"" Then' H9 W5 d. t+ S5 H: Z
If Instr(LCase(Request(Fy_Cs(Fy_x))),"and")&lt;&gt;0 then
0 P+ c- ]) e, F  W. B4 qResponse.Write "出现错误!"4 \; c6 x9 L/ e" P5 ]: A- i
Response.End
4 H: w. D8 X, g0 s  J1 ~- CEnd If
1 l8 T+ r' g. J9 x! f7 YEnd If
' t  \# D( L* p- \Next7 C" Z  I+ U% I$ ^1 M

; P; Q! S( {0 T6 G4 F5 a3 @& ^) A' |6 S# W0 P
它的思路就是先获得提交的数据,以"&amp;"为分界获得并处理name/value组,然后判断value里是否含有定义的关键字(这里为求简便,我只留下了"and"),有之,则为注射。& B# s) U& h4 W5 g

4 c2 a+ V* I$ H- e9 D7 q9 @乍一看去,value被检查了,似乎没有问题。呵呵,是的,value不会有问题,可是,name呢?! ^( A5 h% F* k

3 C) F% o# k/ d7 {9 f8 ?  ^5 z2 V它的name/value组值来自于Request.ServerVariables("QUERY_STRING"),呵呵,不好意思,这里出问题了。Request.ServerVariables("QUERY_STRING")是得到客户端提交的字符串,这里并不会自动转换url编码,哈哈,如果我们把name进行url编码再提交的话,呵呵,那就可以绕过检查了。比如参数是ph4nt0m=lake2 and lis0,此时程序能够检测到;如果提交%50h4nt0m=lake2 and lis0(对p进行url编码),程序就会去判断%50h4nt0m的值,而%50h4nt0m会被转换为ph4nt0m,所以%50h4nt0m值为空,于是就绕过了检测。) `) [/ b9 L' B9 S* `. E

9 _0 R+ i$ J! Q( E& W' D等等,为什么既然name不解码可以绕过检查而value就不能绕过呢?因为value的值取自Request(Fy_Cs(Fy_x)),这个服务器就会解码的。
/ V5 r! D+ g7 @' q' G# N
4 D! w) X, M" _. r( R! ]2 J0 k程序怎么改进呢?只要能够得到客户端提交的数据是解码后的就可以了,把得到name的语句改为For Each SubmitName In Request.QueryString就可以了。' i$ x# K! Y6 M* e& o% `$ w

3 `6 W- M: l, _5 }2 J呵呵,谢谢阁下耐着性子看完我的文章^_^




欢迎光临 数学建模社区-数学中国 (http://www.madio.net/) Powered by Discuz! X2.5