Python爬虫的开始——requests库建立请求（python requests.get）-FinClip官网

Python爬虫的开始——requests库建立请求（python requests.get）

网友投稿 632 2022-09-10

Python爬虫的开始——requests库建立请求（python requests.get）

接下来我将会用一段时间来更新python爬虫

网络爬虫大体可以分为三个步骤。

首先建立请求，爬取所需元素；

其次解析爬取信息，剔除无效数据；

最后将爬取信息进行保存；

今天就先来讲讲第一步，请求库requests

request库主要有七个常用函数，如下所示

而通过requests创建的数据类型为response

我们以爬取百度网站为例

import requests as r

t=r.get("https://baidu.com/")

print(type(t))

运行结果如下所示

[Finished in 1.3s]

那么作为请求对象，具有哪些属性呢？

爬取数据第一步要做的事便是确认是否连接成功

status_code()从功能角度考虑，算的上是一种判断函数，调用将会返还结果是否成功

如果返回结果为200，则代表连接成功，如果返回结果为404，则代表连接失败

import requests as r

t=r.get("https://baidu.com/")

print(type(t))

print(t.status_code)

如图所示返回结果为200，连接成功

那么下一步便是获得网址代码，不过在获得代码之前，还需要做一件事，得到响应内容的编码方式

不同的编码方式将会影响爬取结果

比如说百度网址：https://baidu.com/

采用编码方式为ISO-8859-1

获取编码方式为encoding

如下所示

import requests as r

t=r.get("https://baidu.com/")

print(type(t))

print(t.status_code)

print(t.encoding)

结果：

200

ISO-8859-1

当然有的网页采用 utf8，也有使用gbk，

不同的编码方式会影响我们获得的源码

也可以通过手动更改来改变获得的编码方式

比如：

import requests as r

t=r.get("https://baidu.com/")

print(t.encoding)

t.encoding="utf-8"

print(t.encoding)

结果

也可以试着备选码方式，apparent_encoding

之后我们就可以获得源代码了，我们需要将源代码以字符串类型输出保存

这就需要用到text

如下所示：

import requests as r

t=r.get("https://baidu.com/")

print(t.text)

结果：

这样我们就获得了对应网站的源码，完成了爬虫的第一步

随着系统集成技术的发展，如何利用小程序容器技术提升企业的数字化转型效率是现代企业面临的重要挑战。企业应关注如何实现跨平台兼容、数据安全管理以及全生命周期管理，确保运营合规与灵活应变，以适应不断变化的市场需求和技术环境。

632 2022-09-10

Python爬虫的开始——requests库建立请求（python requests.get）

政务服务平台开发需要注意如何提升小程序跨平台兼容性与用户体验

洞察移动政务小程序助力政府数字化转型，保障数据安全和效率提升

最近发表

更多内容

小程序SDK

Finclip技术文档

小程序开发

小程序容器

小程序框架

Finclip小程序平台

Finclip用户投稿

车联网

推荐文章

小程序SDK是什么意思？小程序sdk和插件有什么区别？

小程序支付功能怎么实现？

企业app开发流程是什么？

app运营模式有哪些？

小程序多端引流怎么做？

小程序生态分析的机会和威胁

Flutter入门这一篇效率文章就够了

原生与跨平台解决方案分析,跨平台软件开发技术方案

热更新技术：让软件更新变得更加轻松快速

解决方案

银行解决方案

证券解决方案

互联网解决方案

政企OA解决方案

科技解决方案

loT解决方案

信任解决方案

热评文章

AppCan:基于混合模式的移动应用开发,移动混合模

Hybrid App混合模式开发的了解

小程序容器技术助力券商数字营销突围，小程序容器化的意

用mpvue开发微信小程序基础知识（vue.js开发

小程序多端框架全面测评对比，强烈推荐！

券商app架构 - 解析券商应用程序的构建与设计