requests模块是python中原生的基于网络请求的模块,是python的一个HTTP客户端库,跟urllib,urllib2类似,其主要作用是用来模拟浏览器发起请求。功能强大,用法简洁高 效。在爬虫领域中占据着半壁江山的地 位。今天,小编就介绍一下是requests模块的安装及使用方法。
一、安装
第一步:pip安装
https://pypi.org/project/pip/#files下载pip压缩文件包,最好将其下载到scripts目录下。进入到安装目录下,执行:
python setup.py install
将
D:\envi\python2.7\Scripts添加到环境变量新打开一个命令行窗口,执行
pip list
第二步:requests安装命令
pip install requests
二、使用:爬取百度网站内容
导入模块
#导入requests模块
import requests
指定url
#1:指定url
url='https://www.baidu.com/'
发起请求
#2:发起请求(get方法会返回一个响应对象)
response = requests.get(url=url)
获取响应数据
#3:获取响应数据
page_text = response.text
持久化存储
#4:持久化存储
with open('./baidu.html','w',encoding='utf-8') as fp:
fp.write(page_text)
print('爬完了')
三:requests异常处理
异常:比如网络连接错误、http错误异常、重定向异常、请求url超时异常等等。
处理:可以利用 response.raise_for_status() 语句去捕捉异常,该语句在方法内部判断r.status_code是否等于200,如果不等于,则抛出异常。
爬取网页的通用代码框架:
try:
response=requests.get(url)
response.raise_for_status() #如果状态不是200,则引发异常
except:
print("产生异常")
requests 会自动实现持久连接keep-alive,requests 支持 HTTP 连接保持和连接池,支持使用 cookie 保持会话,支持文件上传,支持自动确定响应内容的编码,支持国际化的 URL 和 POST 数据自动编码,现代、国际化、人性化。
如今python编程语言市场需求大,薪资待遇上万尽在咫尺!如果你也想学习python技术可以填写下面表单,Python学习资料限时免费领取!
上一篇:想学爬虫必看!关于爬虫的基础知识
下一篇: 没有了
一级建造师二级建造师消防工程师造价工程师土建职称房地产经纪人公路检测工程师建筑八大员注册建筑师二级造价师监理工程师咨询工程师房地产估价师 城乡规划师结构工程师岩土工程师安全工程师设备监理师环境影响评价土地登记代理公路造价师公路监理师化工工程师暖通工程师给排水工程师计量工程师
执业药师执业医师卫生资格考试卫生高级职称护士资格证初级护师主管护师住院医师临床执业医师临床助理医师中医执业医师中医助理医师中西医医师中西医助理口腔执业医师口腔助理医师公共卫生医师公卫助理医师实践技能内科主治医师外科主治医师中医内科主治儿科主治医师妇产科医师西药士/师中药士/师临床检验技师临床医学理论中医理论