惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

小众软件
小众软件
V
Visual Studio Blog
博客园 - 三生石上(FineUI控件)
Last Week in AI
Last Week in AI
Blog — PlanetScale
Blog — PlanetScale
爱范儿
爱范儿
J
Java Code Geeks
A
About on SuperTechFans
F
Fortinet All Blogs
B
Blog
aimingoo的专栏
aimingoo的专栏
H
Hackread – Cybersecurity News, Data Breaches, AI and More
Engineering at Meta
Engineering at Meta
Y
Y Combinator Blog
有赞技术团队
有赞技术团队
G
Google Developers Blog
Apple Machine Learning Research
Apple Machine Learning Research
V
V2EX
博客园_首页
博客园 - 叶小钗
罗磊的独立博客
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
D
Docker
云风的 BLOG
云风的 BLOG

老董笔记

尚硅谷机构在哪?尚硅谷培训怎么样?靠谱吗-互联网IT百科 韩顺平介绍,传智讲师,开办泰牛,入尚硅谷等一系列-互联网IT百科 pandas多重索引标准样式(写入excel有空行)-互联网IT百科 cannot join with no overlapping index names-互联网IT百科 pandas多列变多行(即宽表变长表)melt和stack函数-互联网IT百科 pandas多行转多列(长表变宽表)pivot和unstack-互联网IT百科 Index contains duplicate entries, cannot reshape完美解决-互联网IT百科 single positional indexer is out-of-bounds-互联网IT百科 Can only compare identically-labeled Series objects-互联网IT百科 pandas transform用法详解(多个案例)-互联网IT百科 python四舍五入精确实现-互联网IT百科 pandas的groupby使用apply分组排序-互联网IT百科 index 0 is out of bounds for axis 0 with size 0-互联网IT百科 pandas分组过滤filter函数-互联网IT百科 联想Win10系统如何禁用触摸屏关闭触摸-互联网IT百科 groupby分组计算transform转换返回相同长度序列-互联网IT百科 brooks seo教程python教程,brooks seo教程网盘,布鲁seo资源-互联网IT百科 电脑右键文件夹一直转圈电卡死怎么回事-互联网IT百科 施琪嘉的心理成长课(荐)-互联网IT百科 百度SEO公司_SEO推广公司哪家好_SEO外包服务如何选-老董笔记 groupby后agg同1列用多个聚合函数、不同列用不同函数、自定义函数-互联网IT百科 pandas的groupby单列多列分组聚合运算-互联网IT百科 DataFrameGroupBy对象及分组个数、分组大小、组名索引、组数据详解-互联网IT百科 pandas中groupby之Grouper and axis must be same length-互联网IT百科 pandas中groupby的分组原理-互联网IT百科 pandas的groupby的使用详解大全-互联网IT百科 openpyxl单元格自动换行强制换行Alignment(wrapText=True)-互联网IT百科 python教程全套(可就业)-互联网IT百科 联想win10系统CPU显示100%,电脑呼呼响怎么回事-互联网IT百科 如何自制CPU,CPU原理是怎么样的?-互联网IT百科
python提取url的顶级域名及域名后缀-互联网IT百科
2020-04-25 · via 老董笔记

  python的urlparse模块可以解析域名,但是有个缺陷无法提取url的顶级域名。如果要做一些复杂的提取可以用tld模块。安装方式就是pip命令安装。

	  pip install tld

  以下代码我们用该模块获取一个url的顶级域名(不含后缀部分)、域名后缀、顶级域名(带后缀部分)、子域名部分(不含后缀)

  提醒:必须含有协议,比如http或者https,否则会报错。如下:

  Is not a valid URL www.python66.com!

# -*- coding: utf-8 -*-

import tld

url = 'www.python66.com'
obj = tld.get_tld(url,as_object=True)

Traceback (most recent call last):
  File "D:/pyscript/py3script/python66/test/a.py", line 6, in 
    obj = tld.get_tld(url,as_object=True)
  File "D:python3installlibsite-packages	ldutils.py", line 490, in get_tld
    parser_class=parser_class
  File "D:python3installlibsite-packages	ldutils.py", line 328, in process_url
    raise TldBadUrl(url=url)
tld.exceptions.TldBadUrl: Is not a valid URL www.python66.com!

  1、一个普通的域名

# -*- coding: utf-8 -*-

import tld

url = 'http://www.python66.com'
obj = tld.get_tld(url,as_object=True)

print(obj.domain)
print(obj.extension)
print(obj.fld)
print(obj.subdomain)
print(obj.suffix)


python66
com
python66.com
www
com

  2、一个层级较多的子域名

# -*- coding: utf-8 -*-

import tld


url = 'http://www.python66.com.cn.uk'
obj = tld.get_tld(url,as_object=True)

print(obj.domain)
print(obj.extension)
print(obj.fld)
print(obj.subdomain)
print(obj.suffix)

cn
uk
cn.uk
www.python66.com
uk


  3、一个特殊后缀的域名(如果你写的后悔比较冷门,tld库本身没有记录就会报错)

  didn't match any existing TLD name!

# -*- coding: utf-8 -*-

import tld

url = 'http://www.anjuke.co.ui'
obj = tld.get_tld(url,as_object=True)
print(obj.domain)
print(obj.extension)
print(obj.fld)
print(obj.subdomain)
print(obj.suffix)

Traceback (most recent call last):
  File "D:/pyscript/py3script/python66/test/a.py", line 6, in 
    obj = tld.get_tld(url,as_object=True)
  File "D:python3installlibsite-packages	ldutils.py", line 490, in get_tld
    parser_class=parser_class
  File "D:python3installlibsite-packages	ldutils.py", line 378, in process_url
    raise TldDomainNotFound(domain_name=domain_name)
tld.exceptions.TldDomainNotFound: Domain www.anjuke.co.ui didn't match any existing TLD name!


很赞哦!

python编程网提示:转载请注明来源www.python66.com。
有宝贵意见可添加站长微信(底部),获取技术资料请到公众号(底部)。同行交流请加群 python学习会