python爬虫中BeautifulSoup如何使用

这篇文章主要介绍python爬虫中Beautiful Soup如何使用，文中介绍的非常详细，具有一定的参考价值，感兴趣的小伙伴们一定要看完！

创新互联建站为客户提供专业的成都网站制作、成都网站建设、外贸营销网站建设、程序、域名、空间一条龙服务，提供基于WEB的系统开发. 服务项目涵盖了网页设计、网站程序开发、WEB系统开发、微信二次开发、手机网站开发等网站方面业务。

一、Tag

Tag 是什么？通俗点讲就是 HTML 中的一个个标签，例如

The Dormouse's story
Elsie

二、NavigableString

既然我们已经得到了标签的内容，那么问题来了，我们要想获取标签内部的文字怎么办呢？很简单，用 .string 即可，例如

print soup.p.string
#The Dormouse's story

三、BeautifulSoup

BeautifulSoup 对象表示的是一个文档的全部内容。大部分时候，可以把它当作 Tag 对象，是一个特殊的 Tag，我们可以分别获取它的类型，名称，以及属性来感受一下

print type(soup.name)
#
print soup.name
# [document]
print soup.attrs
#{} 空字典

四、Comment

Comment 对象是一个特殊类型的 NavigableString 对象，其实输出的内容仍然不包括注释符号，但是如果不好好处理它，可能会对我们的文本处理造成意想不到的麻烦。我们找一个带注释的标签

print soup.a
print soup.a.string
print type(soup.a.string)

以上是python爬虫中Beautiful Soup如何使用的所有内容，感谢各位的阅读！希望分享的内容对大家有帮助，更多相关知识，欢迎关注创新互联行业资讯频道！

网页名称：python爬虫中BeautifulSoup如何使用
网址分享：http://cqcxhl.cn/article/pdcsoi.html