张慧的博客

张慧的博客

  BlogJava :: 首页 :: 联系 :: 聚合  :: 管理
  45 Posts :: 0 Stories :: 24 Comments :: 0 Trackbacks
本文主要用python实现了对网站的模拟登录。通过自己构造post数据来用Python实现登录过程。

当你要模拟登录一个网站时,首先要搞清楚网站的登录处理细节(发了什么样的数据,给谁发等...)。我是通过HTTPfox来抓取http数据包来分析该网站的登录流程。同时,我们还要分析抓到的post包的数据结构和header,要根据提交的数据结构和heander来构造自己的post数据和header。

分析结束后,我们要构造自己的HTTP数据包,并发送给指定url。我们通过urllib2等几个模块提供的API来实现request请求的发送和相应的接收。
大部分网站登录时需要携带cookie,所以我们还必须设置cookie处理器来保证cookie。

具体代码和讲解如下

  1. #!/usr/bin/python  
  2.   
  3. import HTMLParser  
  4. import urlparse  
  5. import urllib  
  6. import urllib2  
  7. import cookielib  
  8. import string  
  9. import re  
  10.   
  11. #登录的主页面  
  12. hosturl = '******' //自己填写  
  13. #post数据接收和处理的页面(我们要向这个页面发送我们构造的Post数据)  
  14. posturl = '******' //从数据包中分析出,处理post请求的url  
  15.   
  16. #设置一个cookie处理器,它负责从服务器下载cookie到本地,并且在发送请求时带上本地的cookie  
  17. cj = cookielib.LWPCookieJar()  
  18. cookie_support = urllib2.HTTPCookieProcessor(cj)  
  19. opener = urllib2.build_opener(cookie_support, urllib2.HTTPHandler)  
  20. urllib2.install_opener(opener)  
  21.   
  22. #打开登录主页面(他的目的是从页面下载cookie,这样我们在再送post数据时就有cookie了,否则发送不成功)  
  23. h = urllib2.urlopen(hosturl)  
  24.   
  25. #构造header,一般header至少要包含一下两项。这两项是从抓到的包里分析得出的。  
  26. headers = {'User-Agent' : 'Mozilla/5.0 (Windows NT 6.1; WOW64; rv:14.0) Gecko/20100101 Firefox/14.0.1',  
  27.            'Referer' : '******'}  
  28. #构造Post数据,他也是从抓大的包里分析得出的。  
  29. postData = {'op' : 'dmlogin',  
  30.             'f' : 'st',  
  31.             'user' : '******', //你的用户名  
  32.             'pass' : '******', //你的密码,密码可能是明文传输也可能是密文,如果是密文需要调用相应的加密算法加密  
  33.             'rmbr' : 'true',   //特有数据,不同网站可能不同  
  34.             'tmp' : '0.7306424454308195'  //特有数据,不同网站可能不同  
  35.   
  36.             }  
  37.   
  38. #需要给Post数据编码  
  39. postData = urllib.urlencode(postData)  
  40.   
  41. #通过urllib2提供的request方法来向指定Url发送我们构造的数据,并完成登录过程  
  42. request = urllib2.Request(posturl, postData, headers)  
  43. print request  
  44. response = urllib2.urlopen(request)  
  45. text = response.read()  
  46. print text  

posted on 2012-08-01 21:42 张慧 阅读(61081) 评论(11)  编辑  收藏

Feedback

# re: python实现模拟登录[未登录] 2013-09-17 15:18 edison
很好  回复  更多评论
  

# re: python实现模拟登录 2013-10-27 15:15
你好,请问下,postdata和headers提交时应该怎么判断提交那些信息啊?不同网站除了用户名和密码外还有其他信息,如何判断提交的信息能实现模拟登陆呢?  回复  更多评论
  

# re: python实现模拟登录 2014-01-15 23:30 保永志
进入  回复  更多评论
  

# re: python实现模拟登录 2014-04-12 15:13 sunshinelyc
你好,我想问一下,你的postData里面:
'op' : 'dmlogin',
'f' : 'st',
'user' : '******', //你的用户名
'pass' : '******', //你的密码,密码可能是明文传输也可能是密文,如果是密文需要调用相应的加密算法加密
'rmbr' : 'true', //特有数据,不同网站可能不同
'tmp' : '0.7306424454308195' //特有数据,不同网站可能不同
去哪里来的呢。我在httpfox里面只能找到user和password。谢谢回复  回复  更多评论
  

# re: python实现模拟登录 2014-06-03 08:59 ontseason
@sunshinelyc
抓包,用chrome的开发人员工具审查元素...network里
  回复  更多评论
  

# re: python实现模拟登录 2014-08-01 23:09 yu
如果是验证用户名是否重复咋个实现  回复  更多评论
  

# re: python实现模拟登录 2014-10-01 11:54 jzp113
你好,我按照你的方法进行了模拟登录,能登录成功。但是我用burpsuit 抓包时发现没有cookie这内容。但是我开启debuglog 又在header里面发现了这个cookie。
然后我又再次发送了个get请求,当却不成功  回复  更多评论
  

# re: python实现模拟登录 2014-10-20 13:55 Warmer
页面有checkbox的话,怎么模拟?  回复  更多评论
  

# re: python实现模拟登录[未登录] 2015-05-16 09:47 1
可以转载么  回复  更多评论
  

# re: python实现模拟登录 2015-11-17 15:35 zhangyan
dgrhtr  回复  更多评论
  

# re: python实现模拟登录 2015-11-17 15:35 zhangyan
fegerh  回复  更多评论
  


只有注册用户登录后才能发表评论。


网站导航: