美文网首页
Beautiful Soup 搜索文档树

Beautiful Soup 搜索文档树

作者: 大爱周星驰 | 来源:发表于2017-12-21 17:03 被阅读0次

    1.find_all(name, attrs, recursive, text, **kwargs)

    name 参数:可以查找所有名字为 name 的tag,字符串对象会被自动忽略掉,

    findall()可以传字符串,正则表达式,列表

    2.CSS选择器

    在这里我们也可以利用类似的方法来筛选元素,用到的方法是soup.select(),返回类型是list

    通过标签名查找、通过类名查找、通过 id 名查找、并集查找、

    属性查找:查找时还可以加入属性元素,属性需要用中括号括起来,注意属性和标签属于同一节点,所以中间不能加空格,否则会无法匹配到。

    获取内容:以上的 select 方法返回的结果都是列表形式,可以遍历形式输出,然后用 get_text() 方法来获取它的内容。

    相关文章

      网友评论

          本文标题:Beautiful Soup 搜索文档树

          本文链接:https://www.haomeiwen.com/subject/ootowxtx.html