如何快速入门和使用beautifulsoup?-CDA数据分析师官网

如何快速入门和使用beautifulsoup?

2020-07-15

BeautifulSoup是一款灵活又便捷的HTML/XML的解析器，通常被用来解析和提取 HTML/XML 数据。BeautifulSoup处理速度快，效率高，而且支持多种解析器，不用编写正则表达式也能快速地实现网页信息的提取。

1、BeautifulSoup与其他抓取工具的对比：

2、解析库

3、安装

(1)pip3 install beautifulsoup

（2）导入模块：from bs4 import BeautifulSoup

（3）创建BeautifulSoup对象

参数一：解析的文本内容

参数二：使用的解析器，一般为lxml(必须添加，否则会发出警告)

（4）格式化输出 soup 对象的内容

4、基本使用

html = """

<html><head><title>The Dormouse's story</title></head>

<body>

<p class="title" name="dromouse"><b>The Dormouse's story</b></p>

<p class="story">Once upon a time there were three little sisters; and their names were

<a href="http://example.com/elsie" class="sister" id="link1"><!-- Elsie --></a>,

<a href="http://example.com/lacie" class="sister" id="link2">Lacie</a> and

<a href="http://example.com/tillie" class="sister" id="link3">Tillie</a>;

and they lived at the bottom of a well.</p>

<p class="story">...</p>

"""

from bs4 import BeautifulSoup

soup = BeautifulSoup(html, 'lxml')#传入解析器：lxml

print(soup.prettify())#格式化代码，自动补全

print(soup.title.string)#得到title标签里的内容

CDA数据分析师考试相关入口一览（建议收藏）：

▷ 想报名CDA认证考试，点击>>> “CDA报名” 了解CDA考试详情；

▷ 想学习CDA考试教材，点击>>> “CDA教材” 了解CDA考试详情；

▷ 想加入CDA考试题库，点击>>> “CDA题库” 了解CDA考试详情；

▷ 想了解CDA考试含金量，点击>>> “CDA含金量” 了解CDA考试详情；

正则表达式 beautifulsoup

数据分析咨询请扫描二维码

若不方便扫码，搜微信号：CDAshujufenxi

上一篇scrapy是什么？如何进行安装？

下一篇怎样快速简单地安装requests库？

如何快速入门和使用beautifulsoup?

CDA考试动态

CDA报考指南

热门栏目

最新资讯

【CDA干货】互联网运营必看：私域用户质量数据分析 ...

【CDA持证人案例分享】用 Excel 精准监控电商及推广 ...

【CDA持证人干货分享】13年国企财务：如何借助DeepS ...

【CDA持证人案例分享】Excel动态报表设计：基于业务 ...

【CDA干货】字节大佬：如何通过动态分级快速提升转 ...

Windows 系统和 MacOS 系统下的 Anaconda 安装教程 ...

数据运营的工作内容、技能要求及发展前景 ...

【干货】字节大佬：教培行业销售运营全景作战地图【 ...

四大一线城市约50%人口租房，数据分析能挖出哪些 “ ...

Python 实战案例 —RFM 客户价值分析模型 ...

【案例】奥利奥坚果新品与蒙牛“数字牧场”的成功经 ...

美关税政策下的全球金融市场动荡：深度数据分析与洞 ...

【重磅】苹果捐赠3000万给浙大这专业，透露未来就业 ...

非专业，怎么才能证明自己的数据分析能力？ ...

保姆级教程！一文读懂数据分析师的职业发展路径 ...

【干货】用DeepSeek三步骤搞定Excel数据清洗，效率 ...

被统计公式劝退？这门极简课程让你14天学会用Python ...

【干货】如何用RFM模型精准识别高价值客户？ ...

CDA数据分析师就业班3月29日开班，仅剩1个名额 ...

【案例】网飞Netflix流量漏斗分析案例 ...