最新公告
  • 欢迎您光临知事网,本站秉承服务宗旨 履行“站长”责任,销售只是起点 服务永无止境!立即加入我们
  • python爬虫中Beautiful Soup有哪些种类?

    作为python中优秀获取数据的工具,Beautiful Soup种类也比较多。每一个种类对应着不同的知识点,小伙伴们学习的时候要用心记忆。当然知识不是一天就能学会的,就像罗马也不是一天就建成的。勤学勤练才是进阶python大神的唯一路径。接下来就开始我们今天对于Beautiful Soup的学习吧。

    一、Tag

    Tag 是什么?通俗点讲就是 HTML 中的一个个标签,例如

    <title>The Dormouse's story</title>
    <a href="http://example.com/elsie" id="link1">Elsie</a>

    二、NavigableString

    既然我们已经得到了标签的内容,那么问题来了,我们要想获取标签内部的文字怎么办呢?很简单,用 .string 即可,例如

    print soup.p.string
    #The Dormouse's story

    三、BeautifulSoup

    BeautifulSoup 对象表示的是一个文档的全部内容。大部分时候,可以把它当作 Tag 对象,是一个特殊的 Tag,我们可以分别获取它的类型,名称,以及属性来感受一下

    print type(soup.name)
    #<type 'unicode'>
    print soup.name
    # [document]
    print soup.attrs
    #{} 空字典

    四、Comment

    Comment 对象是一个特殊类型的 NavigableString 对象,其实输出的内容仍然不包括注释符号,但是如果不好好处理它,可能会对我们的文本处理造成意想不到的麻烦。 我们找一个带注释的标签

    print soup.a
    print soup.a.string
    print type(soup.a.string)

    以上就是python爬虫中Beautiful Soup的4个种类。更多Python学习推荐:PyThon学习网教学中心。

    猜你在找

    找互联网优质资源,上知事网!
    知事网 » python爬虫中Beautiful Soup有哪些种类?

    常见问题FAQ

    网盘提取密码在哪里?
    在网站右侧有个“文件密码”,点击复制即可!
    网站的积分如何获得?
    注册登录后,每天签到可获得2个积分,每天可签到一次!

    发表评论

    • 1247会员总数(位)
    • 665资源总数(个)
    • 3本周发布(个)
    • 1 今日发布(个)
    • 3458稳定运行(天)

    提供最优质的资源集合

    Mac软件 Dedecms源码
    升级SVIP尊享更多特权立即升级