python 包实现 urllib 网络请求操作

一、简介

二、发起请求

三、携带参数请求

四、获取响应数据

五、设置headers

六、使用代理

七、认证登录

八、设置cookie

九、异常处理

十、HTTP异常

十一、超时异常

十二、解析编码

十三、参数拼接

十四、请求链接解析

十五、拼接链接

十六、字典转换参数

一、简介

是一个 python 内置包，不需要额外安装即可使用

urllib 是 Python 标准库中用于网络请求的库，内置四个模块，分别是

urllib.request：用来打开和读取 url，可以用它来模拟发送请求，获取网页响应内容

urllib.error：用来处理 urllib.request 引起的异常，保证程序的正常执行

urllib.parse：用来解析 url，可以对 url 进行拆分、合并等

urllib.robotparse：用来解析 robots.txt 文件，判断网站是否能够进行爬取

二、发起请求

import urllib.request
# 方法一
resp = urllib.request.urlopen('http://www.baidu.com', timeout=1)
print(resp.read().decode('utf-8'))
# 方法二
request = urllib.request.Request('http://www.baidu.com')
response = urllib.request.urlopen(request)
print(response.read().decode('utf-8'))

三、携带参数请求

请求某些网页时需要携带一些数据

import urllib.parse
import urllib.request
params = {
'name':'autofelix',
'age':'25'
}
data = bytes(urllib.parse.urlencode(params), encoding='utf8')
response = urllib.request.urlopen("http://www.baidu.com/", data=data)
print(response.read().decode('utf-8'))

四、获取响应数据

import urllib.request
resp = urllib.request.urlopen('http://www.baidu.com')
print(type(resp))
print(resp.status)
print(resp.geturl())
print(resp.getcode())
print(resp.info())
print(resp.getheaders())
print(resp.getheader('Server'))

五、设置headers

import urllib.request
headers = {
'User-Agent': 'Mozilla/5.0 (Windows NT 6.1; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/56.0.2924.87 Safari/537.36'
}
request = urllib.request.Request(url="http://tieba.baidu.com/", headers=headers)
response = urllib.request.urlopen(request)
print(response.read().decode('utf-8'))

六、使用代理

import urllib.request
proxys = urllib.request.ProxyHandler({
'http': 'proxy.cn:8080',
'https': 'proxy.cn:8080'
})
opener = urllib.request.build_opener(proxys)
urllib.request.install_opener(opener)
request = urllib.request.Request(url="http://www.baidu.com/")
response = urllib.request.urlopen(request)
print(response.read().decode('utf-8'))

七、认证登录

有些网站需要携带账号和密码进行登录之后才能继续浏览网页

import urllib.request
url = "http://www.baidu.com/"
user = 'autofelix'
password = '123456'
pwdmgr = urllib.request.HTTPPasswordMgrWithDefaultRealm()
pwdmgr.add_password(None,url,user,password)
auth_handler = urllib.request.HTTPBasicAuthHandler(pwdmgr)
opener = urllib.request.build_opener(auth_handler)
response = opener.open(url)
print(response.read().decode('utf-8'))

八、设置cookie

如果请求的页面每次需要身份验证，我们可以使用 Cookies 来自动登录，免去重复登录验证的操作

import http.cookiejar
import urllib.request
cookie = http.cookiejar.CookieJar()
handler = urllib.request.HTTPCookieProcessor(cookie)
opener = urllib.request.build_opener(handler)
response = opener.open("http://www.baidu.com/")
f = open('cookie.txt', 'a')
for item in cookie:
f.write(item.name+" = "+item.value+'\n')
f.close()

九、异常处理

from urllib import error, request
try:
resp = request.urlopen('http://www.baidu.com')
except error.URLError as e:
print(e.reason)

十、HTTP异常

from urllib import error, request
try:
resp = request.urlopen('http://www.baidu.com')
except error.HTTPError as e:
print(e.reason, e.code, e.headers, sep='\n')
except error.URLError as e:
print(e.reason)
else:
print('request successfully')

十一、超时异常

import socket, urllib.request, urllib.error
try:
resp = urllib.request.urlopen('http://www.baidu.com', timeout=0.01)
except urllib.error.URLError as e:
print(type(e.reason))
if isinstance(e.reason,socket.timeout):
print('time out')

十二、解析编码

from urllib import parse
name = parse.quote('飞兔小哥')
# 转换回来
parse.unquote(name)

十三、参数拼接

在访问url时，我们常常需要传递很多的url参数

而如果用字符串的方法去拼接url的话，会比较麻烦

from urllib import parse
params = {'name': '飞兔', 'age': '27', 'height': '178'}
parse.urlencode(params)

十四、请求链接解析

from urllib.parse import urlparse
result = urlparse('http://www.baidu.com/index.html?user=autofelix')
print(type(result))
print(result)

十五、拼接链接

如果拼接的是两个链接，则以返回后面的链接

如果拼接是一个链接和参数，则返回拼接后的内容

from urllib.parse import urljoin
print(urljoin('http://www.baidu.com', 'index.html'))

十六、字典转换参数

from urllib.parse import urlencode
params = {
'name': 'autofelix',
'age': 27
}
baseUrl = 'http://www.baidu.com?'
print(baseUrl + urlencode(params))

到此这篇关于python 包中的 urllib 网络请求教程的文章就介绍到这了,更多相关 urllib 网络请求内容请搜索易知道(ezd.cc)以前的文章或继续浏览下面的相关文章希望大家以后多多支持易知道(ezd.cc)！

python 包实现 urllib 网络请求操作

推荐阅读

win10多任务按键怎么设置在底部详细方法

怎么设置电脑桌面|怎么设置电脑桌面壁纸

固定路由器如何设置固定无线路由器设置教程

如何链接路由器设置TP链接无线路由器设置

icloud设置哪些该打开|icloud在设置哪里打

酷派手机恢复出厂设置|酷派手机恢复出厂设

opporeno8参数配置及价格

设置证书密码是什么|证书初始密码

设置里程碑|设置里程碑的方法有哪些

计算机主板BIOS设置详细-BIOS知识

金蝶k3入如何设置公式|金蝶K3中计量单位该

苹果电脑麦克风设置|苹果电脑允许麦克风在

笔记本如何设置Fn快捷键|笔记本如何设置fn

花呗怎么设置额度|花呗怎么设置额度调低

保护眼睛电脑|保护眼睛电脑屏幕设置