分享Python网络爬虫过程中编码和解码的一个库

大家好,我是皮皮。

一、前言

前几天在Python白银钻石群【海南菜同学】问了一个Python编码的问题,提问截图如下:

原始代码如下:

1/show_contract.html?back=%2Fwssc%2Fcontracts.html&contract_id=100934 2

编码截图如下图所示:

二、实现过程

一开始以为不是编码,后来【此类生物】直接看出来了,太强了。

其实关于字符串的编码和解码,Python中有个专门的urllib库,【error】分享了它的两个非常重要的方法,分别是编码和解码,如下图所示:

所以针对上文中发出来的链接进行解码,得到的就是2个斜杆,如下图所示:

原来这个东东在web开发的时候还是蛮常见的呢。

三、总结

大家好,我是皮皮。这篇文章主要盘点了一个Python网络爬虫过程中编码和解码的问题,文中针对该问题给出了具体的解析和代码实现,帮助粉丝顺利解决了问题。

最后感谢粉丝【海南菜同学】提问,感谢【此类生物】、【甯同学】、【error】给出的思路和代码解析,感谢【dcpeng】、【提请问粘给图截报错贴代源码】等人参与学习交流。

点赞
收藏

评论区

加载中...

相关推荐

我想的是将Date那一列转换成时间格式,怎么破?

大家好,我是皮皮。一、前言前几天在Python白银交流群【Joker】问了一个Pandas处理字符串的问题,提问截图如下:二、实现过程这里【甯同学】给了一个代码,示例代码如下所示:importpandasaspddfpd.readexcel('S当然了,这

盘点一个Python网络爬虫实战问题

大家好,我是皮皮。一、前言前几天在Python钻石交流群【海南菜同学】问了一个Python网络爬虫的选择器提取问题,下图是截图:代码初步看上去好像没啥问题,但是结果就是不对。fromlxmlimportetreeimportrequestsurl"http://zw.hainan.gov.cn/wssc/emalls.html"headers

盘点一个Python网络爬虫过程中中文乱码的问题

大家好,我是皮皮。一、前言前几天在Python白银交流群【空翼】问了一个Python网络爬虫中文乱码的问题,提问截图如下:原始代码如下:importrequestsimportparselurl'https://news.p2peye.com/article5147231.html'headers'AcceptLanguage':'zhCN,zh;q

练习爬虫,我想问一下这个xpath语句为啥找不到元素,感谢大佬!

大家好,我是皮皮。一、前言前几天在Python钻石交流群【萤火】问了一个Python网络爬虫的问题,下图是截图:下图是报错截图:二、实现过程这里【error】给了一个代码,如下所示,满足粉丝的需求:用selenium没找到的话,大概率是网页还没渲染出来,代码就运行到了抓取规则,所以抓不到。其实他的匹配规则是可以拿到数据的,只不过用jupyter运行sel

盘点Python网络爬虫过程中xpath的联合查询定位一个案例

大家好,我是皮皮。一、前言前几天在Python钻石交流群【髙鵬】问了一个Python网络爬虫的问题,提问截图如下:原始代码如下:importtimefromseleniumimportwebdriverfromselenium.webdriver.common.byimportBydriverwebdriver.Chrome()drive

我想在一段文字中扣出关键字附近前后30个字,用正则怎么写?

大家好,我是Python进阶者。一、前言前几天在Python白银交流群【此类生物】问了一个Python数据提取的问题,提问截图如下:!(https://uploadimages.jianshu.io/upload_images/2