位置：首页-资讯-后端开发

Python爬取京东的商品分类与链接

2022-06-04 18:50

短信预约 -IT技能 免费直播动态提醒

前言

本文主要的知识点是使用Python的BeautifulSoup进行多层的遍历。

查看图片

如图所示。只是一个简单的哈，不是爬取里面的隐藏的东西。

示例代码


from bs4 import BeautifulSoup as bs
import requests
headers = {
  "host": "www.jd.com",
  "User-Agent": "Mozilla/5.0 (Windows NT 6.1; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/47.0.2526.80 Safari/537.36 Core/1.47.933.400 QQBrowser/9.4.8699.400",
  "Accept": "text/html,application/xhtml+xml,application/xml;q=0.9,image/webp,*/*;q=0.8"
  }
session = requests.session()
def get_url():
  renspned = bs(session.get('http://www.jd.com/',headers = headers).text,'html.parser')
  for i in renspned.find("div", {"class": "dd-inner"}).find_all("a",{"target":"_blank"}):
    print(i.get_text(),':',i.get('href'))
get_url()

运行这段代码以及达到了我们的目的。

查看图片

我们来解读一下这段代码。

首先我们要访问到京东的首页。

然后通过BeautifulSoup对访问到的首页进行解析。

这个时候，我们就要定位元素，来获取我们需要的东西了。

在浏览器中通过F12，我们可以看到下图所示的东西：

查看图片

我们来看看下面这句代码：


for i in renspned.find("div", {"class": "dd-inner"}).find_all("a",{"target":"_blank"})

这一行代码完全满足我们的需求，首先用find方法，定位到了class=“dd-inner”的div，然后使用find_all对该标签下所有的a标签。

最后，我想打印出所有的商品分类以及对应的链接，于是，我使用了i.get_text()和i.get('href')的方法终于获取到了商品分类和对应的链接。

总结

其实不是很难，主要是要用对方法。笔者因为是初学方法没有用对。花了差不多两天时间才搞定。这里也是告诉大家，可以使用find().find_all()的方法进行多层的遍历。以上就是我利用Python爬取京东的商品分类与链接的一些经验，希望对大家学习python能有所帮助。

免责声明：

① 本站未注明“稿件来源”的信息均来自网络整理。其文字、图片和音视频稿件的所属权归原作者所有。本站收集整理出于非商业性的教育和科研之目的，并不意味着本站赞同其观点或证实其内容的真实性。仅作为临时的测试数据，供内部测试之用。本站并未授权任何人以任何方式主动获取本站任何信息。

② 本站未注明“稿件来源”的临时测试数据将在测试完成后最终做删除处理。有问题或投稿请发送至: 邮箱/279061341@qq.com QQ/279061341

商品分类京东链接

阅读原文内容投诉

Python爬取京东的商品分类与链接

下载Word文档到电脑，方便收藏和打印～

下载Word文档

Python爬取京东的商品分类与链接

Python爬取京东的商品分类与链接

相关文章

猜你喜欢

Python爬取京东的商品分类与链接

python制作爬虫爬取京东商品评论教程

python如何爬取京东指定商品评论

Python爬取京东商品信息评论存并进MySQL

python 爬取京东指定商品评论并进行情感分析

python怎么爬取天猫店铺商品链接

Python怎么爬取京东商品信息评论存并进MySQL

Python爬虫实战之爬取京东商品数据并实实现数据可视化

Python中如何爬取京东商品数据并实现数据可视化

Python大神利用正则表达式教你搞定京东商品信息的示例分析

PHP与Vue开发：如何实现支付后获取不同类型商品的会员积分

热门标签

编程热搜

编程资源站

目录

感谢您的提交，我们服务专员将在30分钟内给您回复