惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

量子位
博客园_首页
罗磊的独立博客
云风的 BLOG
云风的 BLOG
J
Java Code Geeks
Last Week in AI
Last Week in AI
D
DataBreaches.Net
Jina AI
Jina AI
博客园 - Franky
大猫的无限游戏
大猫的无限游戏
Apple Machine Learning Research
Apple Machine Learning Research
V
V2EX
D
Docker
MongoDB | Blog
MongoDB | Blog
B
Blog RSS Feed
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
宝玉的分享
宝玉的分享
Engineering at Meta
Engineering at Meta
The Cloudflare Blog
博客园 - 三生石上(FineUI控件)
有赞技术团队
有赞技术团队
人人都是产品经理
人人都是产品经理
H
Help Net Security
T
The Blog of Author Tim Ferriss

老董笔记

尚硅谷机构在哪?尚硅谷培训怎么样?靠谱吗-互联网IT百科 韩顺平介绍,传智讲师,开办泰牛,入尚硅谷等一系列-互联网IT百科 pandas多重索引标准样式(写入excel有空行)-互联网IT百科 cannot join with no overlapping index names-互联网IT百科 pandas多列变多行(即宽表变长表)melt和stack函数-互联网IT百科 pandas多行转多列(长表变宽表)pivot和unstack-互联网IT百科 Index contains duplicate entries, cannot reshape完美解决-互联网IT百科 single positional indexer is out-of-bounds-互联网IT百科 Can only compare identically-labeled Series objects-互联网IT百科 pandas transform用法详解(多个案例)-互联网IT百科 python四舍五入精确实现-互联网IT百科 pandas的groupby使用apply分组排序-互联网IT百科 index 0 is out of bounds for axis 0 with size 0-互联网IT百科 pandas分组过滤filter函数-互联网IT百科 联想Win10系统如何禁用触摸屏关闭触摸-互联网IT百科 groupby分组计算transform转换返回相同长度序列-互联网IT百科 brooks seo教程python教程,brooks seo教程网盘,布鲁seo资源-互联网IT百科 电脑右键文件夹一直转圈电卡死怎么回事-互联网IT百科 施琪嘉的心理成长课(荐)-互联网IT百科 百度SEO公司_SEO推广公司哪家好_SEO外包服务如何选-老董笔记 groupby后agg同1列用多个聚合函数、不同列用不同函数、自定义函数-互联网IT百科 pandas的groupby单列多列分组聚合运算-互联网IT百科 DataFrameGroupBy对象及分组个数、分组大小、组名索引、组数据详解-互联网IT百科 pandas中groupby之Grouper and axis must be same length-互联网IT百科 pandas中groupby的分组原理-互联网IT百科 pandas的groupby的使用详解大全-互联网IT百科 openpyxl单元格自动换行强制换行Alignment(wrapText=True)-互联网IT百科 python教程全套(可就业)-互联网IT百科 联想win10系统CPU显示100%,电脑呼呼响怎么回事-互联网IT百科 如何自制CPU,CPU原理是怎么样的?-互联网IT百科
requests获取状态码与http响应头、请求头-互联网IT百科
2019-07-18 · via 老董笔记

  日常生活中有时候打开一个网页提示404或者500错误,这种404或者500就是一种状态码,代表一种含义来表达这次访问网页的结果咋样。

  访问一个网页就是向服务器发1个请求,实际上在浏览器接收并显示网页前,网页所在的服务器会返回一个响应头(server header),响应头信息里包含1个HTTP状态码,不同的状态码的值代表不同的含义。

  常见的HTTP状态码:

  200 - 请求成功

  301 - 资源(网页等)被永久转移到其它URL

  403 - 禁止此请求

  404 - 请求的资源不存在

  500 - 内部服务器错误

  我们可以通过浏览器或者其他专业的抓包工具(比如fiddler)来查看响应头,随便打开1个网页可以正常访问就是200。

  在requests请求网页的相应对象里面有个status_code属性可以查看状态码。

# -*- coding: utf-8 -*-

r = requests.get("https://www.baidu.com/")
print(r.status_code)

r = requests.get("https://www.baidu.com/python66.com")
print(r.status_code)

200
404

  此外,Requests还附带了一个内置的状态码查询对象requests.codes.ok,不过这个东西尽量少用,因为他的意义并不是想当然的理解的只有200状态码才正确的输出,如果是404请求requests.codes.ok返回也是200。

# -*- coding: utf-8 -*-

r = requests.get("https://www.baidu.com/")
print(requests.codes.ok)

r = requests.get("https://www.baidu.com/python66.com") # 404
print(requests.codes.ok)

200
200

  如果发送了一个错误请求(一个 4XX 客户端错误,或者 5XX 服务器错误响应),我们可以通过Response.raise_for_status()来抛出异常

# -*- coding: utf-8 -*-

r = requests.get("https://www.baidu.com/")
print(r.raise_for_status()) #200输出None

r = requests.get("https://www.baidu.com/python66.com") # 404
print(r.raise_for_status())

None
requests.exceptions.HTTPError: 404 Client Error: Not Found for url: https://www.baidu.com/python66.com

  完整响应头

  状态码属于响应头的一部分,要获取全部响应头也非常简单,直接r.headers就可以查看以一个Python字典形式展示的服务器响应头。

# -*- coding: utf-8 -*-
headers = {
'user-agent':'Mozilla/5.0 (Windows NT 6.1; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/95.0.4638.69 Safari/537.36 Edg/95.0.1020.44',
}

url = 'https://www.baidu.com'
r = requests.get(url,headers=headers)
print(r.headers)
{'Bdpagetype': '1', 'Bdqid': '0xdee12fd40007efc5', 'Cache-Control': 'private', 'Connection': 'keep-alive', 'Content-Encoding': 'gzip', 'Content-Type': 'text/html;charset=utf-8', 'Date': 'Mon, 15 Nov 2021 05:15:44 GMT', 'Expires': 'Mon, 15 Nov 2021 05:15:02 GMT', 'P3p': 'CP=" OTI DSP COR IVA OUR IND COM ", CP=" OTI DSP COR IVA OUR IND COM "', 'Server': 'BWS/1.1', 'Set-Cookie': 'BAIDUID=237ABB0DE68314DD3DBDA5546CCD1E67:FG=1; expires=Thu, 31-Dec-37 23:55:55 GMT; max-age=2147483647; path=/; domain=.baidu.com, BIDUPSID=237ABB0DE68314DD3DBDA5546CCD1E67; expires=Thu, 31-Dec-37 23:55:55 GMT; max-age=2147483647; path=/; domain=.baidu.com, PSTM=1636953344; expires=Thu, 31-Dec-37 23:55:55 GMT; max-age=2147483647; path=/; domain=.baidu.com, BAIDUID=237ABB0DE68314DD0A4420143BA12478:FG=1; max-age=31536000; expires=Tue, 15-Nov-22 05:15:44 GMT; domain=.baidu.com; path=/; version=1; comment=bd, BDSVRTM=0; path=/, BD_HOME=1; path=/, H_PS_PSSID=34942_34443_35105_31660_35049_35097_34584_34518_34917_34606_34815_26350_34973_34866_35145_35018; path=/; domain=.baidu.com', 'Strict-Transport-Security': 'max-age=172800', 'Traceid': '1636953344023825255416060170333759991749', 'X-Frame-Options': 'sameorigin', 'X-Ua-Compatible': 'IE=Edge,chrome=1', 'Transfer-Encoding': 'chunked'}

  HTTP头部是大小写不敏感的,因此可以使用任意大写形式来访问这些响应头字段。

# -*- coding: utf-8 -*-
headers = {
'user-agent':'Mozilla/5.0 (Windows NT 6.1; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/95.0.4638.69 Safari/537.36 Edg/95.0.1020.44',
}

url = 'https://www.baidu.com'
r = requests.get(url,headers=headers)
print(r.headers['Connection'])
print(r.headers['connection'])
keep-alive
keep-alive

  如果想得到发送到服务器的请求头,可以通过如下方法获取

r.request.headers

很赞哦!

python编程网提示:转载请注明来源www.python66.com。
有宝贵意见可添加站长微信(底部),获取技术资料请到公众号(底部)。同行交流请加群 python学习会