python访问需要登录的网页 -lrfgjj2-ChinaUnix博客

lrfgjj2jiageweiwu.blog.chinaunix.net

首页　| 　博文目录　| 　关于我

lrfgjj2

博客访问： 1542066
博文数量： 164
博客积分： 2993
博客等级：少校
技术积分： 1718
用户组：普通用户
注册时间： 2011-06-24 11:42

文章分类

全部博文（164）

Gideros dev（1）
信息安全（密码学（3）
oauth2.0第三方登（0）
attack（0）
cdn（1）
apache（0）
淘宝（0）
SEO（1）
渗透（6）
jquery（3）
MFC（2）
dos命令（1）
QT（1）
mvc（1）
ajax（2）
mysql（7）
浏览器兼容问题（1）
codeIgniter（1）
nosql（4）
密码算法（2）
openssl（1）
m2crypto（1）
设计模式（6）
面向对象设计（5）
打包程序（2）
算法（7）
php学习（48）
scrapy框架（2）
qvod技术（1）
Pyqt学习笔记（13）
fuzzing（1）
linux使用（5）
python学习（27）
网络协议（6）
未分配的博文（2）

文章存档

2014年（1）

2013年（36）

2012年（90）

2011年（37）

我的朋友

相关博文

python访问需要登录的网页

分类： Python/Ruby

2013-01-25 10:44:16

有些网页需要你登录之后才可以访问,你需要提供账户和密码。

只要在发送http请求时，带上含有正常登陆的cookie就可以了。

1.首先我们要先了解cookie的工作原理。

Cookie是由服务器端生成，发送给User-Agent（一般是浏览器），浏览器会将Cookie的key/value保存到某个目录下的文本文件内，下次请求同一网站时就发送该Cookie给服务器（前提是浏览器设置为启用cookie）。Cookie名称和值可以由服务器端开发自己定义，对于JSP而言也可以直接写入jsessionid，这样服务器可以知道该用户是否合法用户以及是否需要重新登录等。

2.之后我们要获取到用户正常登录的cookie.

python提供了cookieJar的库，只要把cookieJar的实例作为参数传到urllib2的一个opener里面。

然后访问一次登录的页面，cookie就已经保存下来了。之后通过这个实例访问所有的页面都带有正常登陆的cookie了。

以人人网为例子。

#encoding=utf-8
import urllib2
import urllib
import cookielib
def renrenBrower(url,user,password):
    #登陆页面，可以通过抓包工具分析获得，如fiddler，wireshark
    login_page = ""
    try:
        #获得一个cookieJar实例
        cj = cookielib.CookieJar()
        #cookieJar作为参数，获得一个opener的实例
        opener=urllib2.build_opener(urllib2.HTTPCookieProcessor(cj))
        #伪装成一个正常的浏览器，避免有些web服务器拒绝访问。
        opener.addheaders = [('User-agent','Mozilla/4.0 (compatible; MSIE 6.0; Windows NT 5.1)')]
        #生成Post数据，含有登陆用户名密码。
        data = urllib.urlencode({"email":user,"password":password})
        #以post的方法访问登陆页面，访问之后cookieJar会自定保存cookie
        opener.open(login_page,data)
        #以带cookie的方式访问页面
        op=opener.open(url)
        #读取页面源码
        data= op.read()
        return data
    except Exception,e:
        print str(e)
#访问某用户的个人主页，其实这已经实现了人人网的签到功能。
print renrenBrower("","用户名","密码")

阅读(24113) | 评论(0) | 转发(1) |

上一篇：操作XML文档遇到的XMLNS问题及解决方法

下一篇：PHP 文件包含之文件路径截断

给主人留下些什么吧！~~

感谢所有关心和支持过ChinaUnix的朋友们

16024965号-6