位置: 编程技术 - 正文
推荐整理分享Python爬取京东的商品分类与链接(python爬虫京东),希望有所帮助,仅作参考,欢迎阅读内容。
文章相关热门搜索词:python爬虫爬取京东商品步骤,京东爬虫代码,python爬虫爬取京东商品步骤,爬取京东商品,python爬虫爬取京东某个商品,python爬取京东数据,python爬取京东数据,python爬取京东图书并可视化,内容如对您有帮助,希望把文章链接给更多的朋友!
前言
本文主要的知识点是使用Python的BeautifulSoup进行多层的遍历。
如图所示。只是一个简单的哈,不是爬取里面的隐藏的东西。
示例代码
运行这段代码以及达到了我们的目的。
我们来解读一下这段代码。
首先我们要访问到京东的首页。
然后通过BeautifulSoup对访问到的首页进行解析。
这个时候,我们就要定位元素,来获取我们需要的东西了。
在浏览器中通过F,我们可以看到下图所示的东西:
我们来看看下面这句代码:
这一行代码完全满足我们的需求,首先用find方法,定位到了class=“dd-inner”的div,然后使用find_all对该标签下所有的a标签。
最后,我想打印出所有的商品分类以及对应的链接,于是,我使用了i.get_text()和i.get('href')的方法终于获取到了商品分类和对应的链接。
总结
其实不是很难,主要是要用对方法。笔者因为是初学方法没有用对。花了差不多两天时间才搞定。这里也是告诉大家,可以使用find().find_all()的方法进行多层的遍历。
标签: python爬虫京东
本文链接地址:https://www.jiuchutong.com/biancheng/386196.html 转载请保留说明!友情链接: 武汉网站建设