Python基本库使用(二)

Python基本库使用(二)

解析链接

urlparse()

urllib内置了parse,parse里面又有urlparse解析url,如下:

from urllib.parse import urlparse

result = urlparse('http://pro.kaikeba.com/course/java/?ss=topj')
print(type(result), result)
# scheme 协议 netloc 域名 path路径 params参数(分号后面的参数) query查询条件 fragment锚点后面的东西

urlparse还有其他的参数urllib.parse.urlparse(urlstring, scheme='', allow_fragments=True),假如urlstring有带协议头则取url的,没有则取我们的第二个参数;
result还是一个元组,可以通过索引来获取urlparse解析出来的参数;
allow_fragments:即是否忽略fragment。如果它被设置为 False,Fragment部分就会被忽略, 它会被解析为 path、parameters 或者query的一部分,而 fragment 部分为空。

urlunparse()

对立于楼上的方法,需要传六个参数

from urllib.parse import urlunparse 
data =['http','www.baidu.com','index.html','user','a=6','comment']
print(urlunparse(data)) 
# http://www.baidu.com/index.html;user?a=6#comment

urlsplit()


from urllib.parse import urlsplit
data ='http://www.baidu.com/index.html;user?a=6#comment'
print(urlsplit(data).scheme,urlsplit(data)[0]) 
# SplitResult(scheme='http', netloc='www.baidu.com', path='/index.html;user', query='a=6', fragment='comment') 
# 元组的方式,可用key的方式获取,也可以用索引的方式

urlunsplit()

必传为五个参数

from urllib.parse import urlunsplit
data =['http','www.baidu.com','index.html','user','a=6','comment']
print(urlunsplit(data));

未完待续。。。

©著作权归作者所有,转载或内容合作请联系作者
【社区内容提示】社区部分内容疑似由AI辅助生成,浏览时请结合常识与多方信息审慎甄别。
平台声明:文章内容(如有图片或视频亦包括在内)由作者上传并发布,文章内容仅代表作者本人观点,简书系信息发布平台,仅提供信息存储服务。

相关阅读更多精彩内容

  • urllib     在 python2 中,有 urllib 和 urllib2 两个库来实现请求的发送,而在 ...
    大千世界1998阅读 979评论 0 2
  • Python内置HTTP请求库之urllib 其中包含的4个模块: -request:最基本的HTTP请求模块,用...
    郑贵烈阅读 432评论 0 4
  • urllib库是python内置的HTTP请求库。 包含以下四个模块: 1.request 模块 1.1 url...
    Fizz翊阅读 727评论 0 1
  • 把微笑找回来 把善良找回来 把温柔找回来 把调皮找回来 把温暖找回来 把希望找回来 重新 塑一个真实的你 捏一个平...
    朱fun阅读 209评论 0 2
  • 无意中来此,或许是心里有很多倾诉无从诉说,又或许是希望看到别人的文字而发生共鸣,不管怎样,我来了,便是来了,就在此刻开始
    桥上桥下阅读 241评论 0 0

友情链接更多精彩内容