惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

J
Java Code Geeks
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
有赞技术团队
有赞技术团队
博客园 - 【当耐特】
云风的 BLOG
云风的 BLOG
Martin Fowler
Martin Fowler
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
量子位
Engineering at Meta
Engineering at Meta
博客园 - 叶小钗
T
The Blog of Author Tim Ferriss
Recent Announcements
Recent Announcements
罗磊的独立博客
B
Blog
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
U
Unit 42
Microsoft Azure Blog
Microsoft Azure Blog
D
Docker
N
Netflix TechBlog - Medium
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
B
Blog RSS Feed
I
InfoQ
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
V
V2EX

老董笔记

尚硅谷机构在哪?尚硅谷培训怎么样?靠谱吗-互联网IT百科 韩顺平介绍,传智讲师,开办泰牛,入尚硅谷等一系列-互联网IT百科 pandas多重索引标准样式(写入excel有空行)-互联网IT百科 cannot join with no overlapping index names-互联网IT百科 pandas多列变多行(即宽表变长表)melt和stack函数-互联网IT百科 pandas多行转多列(长表变宽表)pivot和unstack-互联网IT百科 Index contains duplicate entries, cannot reshape完美解决-互联网IT百科 single positional indexer is out-of-bounds-互联网IT百科 Can only compare identically-labeled Series objects-互联网IT百科 pandas transform用法详解(多个案例)-互联网IT百科 python四舍五入精确实现-互联网IT百科 pandas的groupby使用apply分组排序-互联网IT百科 index 0 is out of bounds for axis 0 with size 0-互联网IT百科 pandas分组过滤filter函数-互联网IT百科 联想Win10系统如何禁用触摸屏关闭触摸-互联网IT百科 groupby分组计算transform转换返回相同长度序列-互联网IT百科 brooks seo教程python教程,brooks seo教程网盘,布鲁seo资源-互联网IT百科 电脑右键文件夹一直转圈电卡死怎么回事-互联网IT百科 施琪嘉的心理成长课(荐)-互联网IT百科 百度SEO公司_SEO推广公司哪家好_SEO外包服务如何选-老董笔记 groupby后agg同1列用多个聚合函数、不同列用不同函数、自定义函数-互联网IT百科 pandas的groupby单列多列分组聚合运算-互联网IT百科 DataFrameGroupBy对象及分组个数、分组大小、组名索引、组数据详解-互联网IT百科 pandas中groupby之Grouper and axis must be same length-互联网IT百科 pandas中groupby的分组原理-互联网IT百科 pandas的groupby的使用详解大全-互联网IT百科 openpyxl单元格自动换行强制换行Alignment(wrapText=True)-互联网IT百科 python教程全套(可就业)-互联网IT百科 联想win10系统CPU显示100%,电脑呼呼响怎么回事-互联网IT百科 如何自制CPU,CPU原理是怎么样的?-互联网IT百科
requests自动登录的2种方法(session对象与cookie)-互联网IT百科
2021-11-12 · via 老董笔记

  Cookie的1个作用是用来标记用户,利用Cookie可以实现自动登录。 实现方法有2种,1种是先手动登录后抓包获取cookie,然后直接传参;另1种是利用s esssion实例自动登录。 但是自动登录有1个前提就是站点要是1个普通的网站,没有刻意的反爬措施,如果有一些反爬策略在里面,就没那么容易登录了!

  现在很多网站都设置了手机验证码、滑块验证码或者在请求头加入了一些按某种规则生成的参数,这使自动登录变得比较艰难,往往需要一些恶心的js逆向才可以解决,本文只是介绍下自动登录原理,具体到某个站得需要专门研究他的算法规则。

  1、直接手动cookie传参登录

  对于普通站点,在请求网页的时候直接在请求头添加cookie(cookie值是提前在浏览器登陆后复制出来的cookie)即可登录,以登录百度为例:

# -*- coding: utf-8 -*-

def get_html(url,retry=1):
    try:
        r = requests.get(url=url, headers=headers)
    except Exception as e:
        print(e)
        if retry > 0:
            get_html(url, retry - 1)
    else:
        html = r.text
        return html

def parse_html(html):
    reobj = re.search('<title>(.*?)</title>',html,re.S|re.I)
    print(reobj.group(1)) # 如果是登录状态,页面title是个人中心

if __name__ == "__main__":
  url = 'https://www.baidu.com/my/index'
  headers = {
        'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/72.0.3626.121 Safari/537.36',
    'Cookie':'登录后从浏览器复制出来cookie'
    }
  html = get_html(url)
  if html:
    parse_html(html)
个人中心

  2、session实例自动登录

  因为session对象可以跨请求保存数据,所以只要找到填写表单提交地址,然后用session实例post用户名密码到这个地址,此时服务器响应的cookie内容会保存到session对象里面,所以下一次可直接请求登录后才可以看到的页面。

  现在太多站反爬比较严格,在请求头里做了很多按规则生成的参数,故而暂时还没找到简单的测试网站,只把流程写一下:

# 1. 创建session实例,保存Cookie值
ssion = requests.session()
# 2. 自定义headers
headers = {"User-Agent": "Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/54.0.2840.99 Safari/537.36"}
# 3. 用户名和密码
key_value = {"user":"xxxxx","password":"yyyy",}
# 4.抓包找到登录接口地址(post提交的地址)假设为:
"http://rrwapi.某域名.com/account/v1/loginByPassword"
# 5.post用户名和密码到接口地址
ssion.post("http://rrwapi.某域名.com/account/v1/loginByPassword", data = key_value)
# 6.session包含用户登录后的Cookie值,可以直接访问那些登录后才可以看的页面
r = ssion.get("登录后的url")
# 6. 返回的内容正常
html = r.text
title = re.search('<title>(.*?)</title>',html) 
print(title.group(1)) 

很赞哦!

python编程网提示:转载请注明来源www.python66.com。
有宝贵意见可添加站长微信(底部),获取技术资料请到公众号(底部)。同行交流请加群 python学习会