python3.x以上 爬虫 使用问题 urllib(不能使用urllib2)

栏目: IT技术 · 发布时间: 6年前

内容简介:python3.x以上 爬虫 使用问题 urllib(不能使用urllib2)

问题一: python 3.x 以上版本揽括了 urllib2,把urllib2 和 urllib 整合到一起。

 并且引入模块变成一个,只有 import urllib

# import urllib
# import urllb2

#正确使用

import urllib

  

  所以不能使用 urllib2.urlopen()方法,否则会报错无此模块。

NameError: name 'urllib2' is not defined

  

 3.x以上版本 # urllib2.open  不能使用,用urllib.request 模块 代替urllib2

1 import urllib.request
2 
3 response = urllib.request.urlopen('http://www.baidu.com')

问题二: 变量名不能与引入模块名方法相同,否则会引起错误

  

 1 import urllib.request
 2 
 3 #错误写法
 4 
 5 request = urllib.request.urlopen('http://www.baidu.com')
 6 
 7 #否则 TypeError: 'module' object is not callable
 8 
 9 #正确写法
10 
11 rqs = urllib.request.urlopen('http://www.baidu.com')

问题四 print 输出问题

  3.x  版本 print 已经成为一个方法, 输出任何东西都要需要被 ()括号 包括,不然会出现问题

第一步初步 方法 爬去百度首页

1 import urllib.request
2 
3 rqs = urllib.request.urlopen('http://www.baidu.com')
4 
5 html = rqs.read()
6 
7 print(html)

以上所述就是小编给大家介绍的《python3.x以上 爬虫 使用问题 urllib(不能使用urllib2)》,希望对大家有所帮助,如果大家有任何疑问请给我留言,小编会及时回复大家的。在此也非常感谢大家对 码农网 的支持!

标签: python

猜你喜欢:

本站部分资源来源于网络,本站转载出于传递更多信息之目的,版权归原作者或者来源机构所有,如转载稿涉及版权问题,请联系我们

引爆点

引爆点

[美] 马尔科姆·格拉德威尔 / 钱清、覃爱冬 / 中信出版社 / 2006-1 / 29.80元

这本书是《纽约客》杂志专职作家马尔科姆·格拉德威尔的一部才华横溢之作。他以社会上突如其来的流行风潮研究为切入点,从一个全新的角度探索了控制科学和营销模式。他认为,思想、行为、信息以及产品常常会像传染病爆发一样,迅速传播蔓延。正如一个病人就能引起一场全城流感;如果个别工作人员对顾客大打出手,或几位涂鸦爱好者管不住自己,也能在地铁里掀起一场犯罪浪潮;一位满意而归的顾客还能让新开张的餐馆座无虚席。这些现......一起来看看 《引爆点》 这本书的介绍吧!

图片转BASE64编码
图片转BASE64编码

在线图片转Base64编码工具

MD5 加密
MD5 加密

MD5 加密工具

RGB HSV 转换
RGB HSV 转换

RGB HSV 互转工具