我的编程空间,编程开发者的网络收藏夹
学习永远不晚

如何使用Golang爬取必应壁纸

短信预约 -IT技能 免费直播动态提醒
省份

北京

  • 北京
  • 上海
  • 天津
  • 重庆
  • 河北
  • 山东
  • 辽宁
  • 黑龙江
  • 吉林
  • 甘肃
  • 青海
  • 河南
  • 江苏
  • 湖北
  • 湖南
  • 江西
  • 浙江
  • 广东
  • 云南
  • 福建
  • 海南
  • 山西
  • 四川
  • 陕西
  • 贵州
  • 安徽
  • 广西
  • 内蒙
  • 西藏
  • 新疆
  • 宁夏
  • 兵团
手机号立即预约

请填写图片验证码后获取短信验证码

看不清楚,换张图片

免费获取短信验证码

如何使用Golang爬取必应壁纸

这篇文章主要讲解了“如何使用Golang爬取必应壁纸”,文中的讲解内容简单清晰,易于学习与理解,下面请大家跟着小编的思路慢慢深入,一起来研究和学习“如何使用Golang爬取必应壁纸”吧!

爬虫流程概述

graph TD请求数据 --> 解析数据 --> 数据入库

接下来具体聊聊每一步需要做什么

  • 请求数据:在这里我们需要使用golang中的内置包http包向目标地址发起请求,这一步就完成了

  • 解析数据:这里我们需要对请求到的数据进行解析,因为不是整个请求到的数据我们都需要,我们只需要某些具体的关键的数据而已。这一步也叫数据清洗

  • 数据入库:不难理解,这就是将解析好的数据进行入库操作

实战分析

先到必应壁纸官网上观察,做爬虫的话是需要对数据特别敏感的。

接下来,需要调出浏览器的开发者工具(这个大家应该都非常熟悉吧,不熟悉的话很难跟下去的喔)。直接按下F12或者右键点击检查如何使用Golang爬取必应壁纸如何使用Golang爬取必应壁纸但是呢?在必应壁纸上,右键不能调用控制台,只能手动调出了。大家不用担心,按照第一张图操作就好。如果有同学的chrome是中文的,也是一样的操作,选择更多工具,选择开发者工具即可

不出意外呢,大家肯定看到的是这样的页面

如何使用Golang爬取必应壁纸这个没关系的,只是必应壁纸网站的一些反爬错误而已。(我很久之前爬的时候还没有这个反爬错误)这个是不影响我们操作的

接下来选择这个工具,帮助我们快速定位到我们想要的元素上如何使用Golang爬取必应壁纸然后我们就能找到我们所需的图片信息

如何使用Golang爬取必应壁纸

代码实战

下面是爬取一页的数据

package mainimport (    "fmt"    "github.com/PuerkitoBio/goquery"    "io"    "io/ioutil"    "log"    "net/http"    "os"    "time")func Run(method, url string, body io.Reader, client *http.Client) {    req, err := http.NewRequest(method, url, body)    if err != nil {        log.Println("获取请求对象失败")        return    }    req.Header.Set("user-agent", "Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/110.0.0.0 Safari/537.36")    resp, err := client.Do(req)    if err != nil {        log.Println("发起请求失败")        return    }    if resp.StatusCode != http.StatusOK {        log.Printf("请求失败,状态码:%d", resp.StatusCode)        return    }    defer resp.Body.Close() // 关闭响应对象中的body    query, err := goquery.NewDocumentFromReader(resp.Body)    if err != nil {        log.Println("生成goQuery对象失败")        return    }    query.Find(".container .item").Each(func(i int, s *goquery.Selection) {        imgUrl, _ := s.Find("a.ctrl.download").Attr("href")        imgName := s.Find(".description>h4").Text()        fmt.Println(imgUrl)        fmt.Println(imgName)        DownloadImage(imgUrl, i, client)        time.Sleep(time.Second)        fmt.Println("-------------------------")    })}func DownloadImage(url string, index int, client *http.Client) {    req, err := http.NewRequest("POST", url, nil)    if err != nil {        log.Println("获取请求对象失败")        return    }    req.Header.Set("user-agent", "Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/110.0.0.0 Safari/537.36")    resp, err := client.Do(req)    if err != nil {        log.Println("发起请求失败")        return    }    data, err := ioutil.ReadAll(resp.Body)    if err != nil {        log.Println("读取请求体失败")        return    }    baseDir := "./image/image-%d.jpg"    f, err := os.OpenFile(fmt.Sprintf(baseDir, index), os.O_CREATE|os.O_TRUNC|os.O_WRONLY, 0666)    if err != nil {        log.Println("打开文件失败", err.Error())        return    }    defer f.Close()    _, err = f.Write(data)    if err != nil {        log.Println("写入数据失败")        return    }    fmt.Println("下载图片成功")}func main() {    client := &http.Client{}    url := "https://bing.ioliu.cn/?p=%d"    method := "GET"    Run(method, url, nil, client)}

下面是爬取多页数据爬取多页的代码没有多大的改动,我们还是需要先观察网站的特点

如何使用Golang爬取必应壁纸

发现什么了吗?第一页p=1,第二页p=2,第十页p=10

所以我们直接起一个for循环,然后复用之前爬取单页的代码就行

// 爬取多页的main函数如下func main() {    client := &http.Client{}    url := "https://bing.ioliu.cn/?p=%d"    method := "GET"    for i := 1; i < 5; i++ { // 实现分页操作        Run(method, fmt.Sprintf(url, i), nil, client)    }}

感谢各位的阅读,以上就是“如何使用Golang爬取必应壁纸”的内容了,经过本文的学习后,相信大家对如何使用Golang爬取必应壁纸这一问题有了更深刻的体会,具体使用情况还需要大家实践验证。这里是编程网,小编将为大家推送更多相关知识点的文章,欢迎关注!

免责声明:

① 本站未注明“稿件来源”的信息均来自网络整理。其文字、图片和音视频稿件的所属权归原作者所有。本站收集整理出于非商业性的教育和科研之目的,并不意味着本站赞同其观点或证实其内容的真实性。仅作为临时的测试数据,供内部测试之用。本站并未授权任何人以任何方式主动获取本站任何信息。

② 本站未注明“稿件来源”的临时测试数据将在测试完成后最终做删除处理。有问题或投稿请发送至: 邮箱/279061341@qq.com QQ/279061341

如何使用Golang爬取必应壁纸

下载Word文档到电脑,方便收藏和打印~

下载Word文档

猜你喜欢

如何使用Golang爬取必应壁纸

这篇文章主要讲解了“如何使用Golang爬取必应壁纸”,文中的讲解内容简单清晰,易于学习与理解,下面请大家跟着小编的思路慢慢深入,一起来研究和学习“如何使用Golang爬取必应壁纸”吧!爬虫流程概述graph TD请求数据 --> 解析数据
2023-07-05

python如何爬取壁纸网站

这篇文章主要介绍python如何爬取壁纸网站,文中介绍的非常详细,具有一定的参考价值,感兴趣的小伙伴们一定要看完!本次爬虫用到的网址是:http://www.netbian.com/index.htm: 彼岸桌面.里面有很多的好看壁纸,而且
2023-06-14

python如何爬取某网站原图作为壁纸

这篇文章主要介绍python如何爬取某网站原图作为壁纸,文中介绍的非常详细,具有一定的参考价值,感兴趣的小伙伴们一定要看完!完整代码# -*- coding: utf-8 -*-"""Created on Wed May 26 17:53:
2023-06-15

如何Python爬取5K分辨率高清桌面壁纸

本篇文章为大家展示了如何Python爬取5K分辨率高清桌面壁纸,内容简明扼要并且容易理解,绝对能使你眼前一亮,通过这篇文章的详细介绍希望你能有所收获。前言相信大家都很需要哪些既好看又能符合自己当时的心情的高清壁纸,很多时候壁纸反应我们当时的
2023-06-02

Linux下如何使用脚本随机更换壁纸

这篇文章将为大家详细讲解有关Linux下如何使用脚本随机更换壁纸,小编觉得挺实用的,因此分享给大家做个参考,希望大家阅读完这篇文章后可以有所收获。下载并安装、运行打开一个终端,并克隆 GitHub 仓库。如果没有安装的话,你需要安装 feh
2023-06-27

如何使用Python爬虫爬取网站图片

这篇文章主要介绍了如何使用Python爬虫爬取网站图片,具有一定借鉴价值,感兴趣的朋友可以参考下,希望大家阅读完这篇文章之后大有收获,下面让小编带着大家一起了解一下。此次python3主要用requests,解析图片网址主要用beautif
2023-06-22

如何使用Java爬虫批量爬取图片

这篇文章主要介绍了如何使用Java爬虫批量爬取图片,对于爬虫的入门来说,图片相对来说是比较容易获取的,因为大部分图片都不是敏感数据,所以不会遇到什么反爬措施,对于入门爬虫来说是比较合适的,需要的朋友可以参考下
2023-05-15

如何使用python爬取整个网站

要使用Python爬取整个网站,可以使用以下步骤:1. 导入所需的库,例如`requests`和`BeautifulSoup`。```import requestsfrom bs4 import BeautifulSoup```2. 使用`
2023-08-14

如何使用python爬虫爬取大学排名信息

这篇文章将为大家详细讲解有关如何使用python爬虫爬取大学排名信息,小编觉得挺实用的,因此分享给大家做个参考,希望大家阅读完这篇文章后可以有所收获。2. 这次爬取的网址请搜索“阿凡题”(纯技术讨论)“阿凡题”(纯技术讨论)3. 在该网址选
2023-06-02

如何使用python爬取电商数据

要使用Python爬取电商数据,可以按照以下步骤进行:1. 确定目标网站:首先要确定你要爬取的电商网站,以及你要爬取的数据类型。2. 分析网站结构:使用开发者工具或者浏览器插件,查看目标网站的源代码,分析网站的结构和数据获取方式。3. 安装
2023-08-23

如何使用python爬虫抓取弹幕

这篇文章主要讲解了“如何使用python爬虫抓取弹幕”,文中的讲解内容简单清晰,易于学习与理解,下面请大家跟着小编的思路慢慢深入,一起来研究和学习“如何使用python爬虫抓取弹幕”吧!一、爬虫是什么?百度百科这样说:自动获取网页内容的程序
2023-06-29

python如何爬取华为应用市场评论

小编给大家分享一下python如何爬取华为应用市场评论,相信大部分人都还不怎么了解,因此分享这篇文章给大家参考一下,希望大家阅读完这篇文章后大有收获,下面让我们一起去了解一下吧!代码分享分别爬取的一些应用信息以及应用的评论信息,数据结构如下
2023-06-15

如何使用PHP做异步爬取数据

这篇“如何使用PHP做异步爬取数据”文章的知识点大部分人都不太理解,所以小编给大家总结了以下内容,内容详细,步骤清晰,具有一定的借鉴价值,希望大家阅读完这篇文章能有所收获,下面我们一起来看看这篇“如何使用PHP做异步爬取数据”文章吧。什么是
2023-07-05

python如何使用Scrapy爬取网易新闻

这篇文章主要介绍python如何使用Scrapy爬取网易新闻,文中介绍的非常详细,具有一定的参考价值,感兴趣的小伙伴们一定要看完!1. 新建项目在命令行窗口下输入scrapy startproject scrapytest, 如下然后就自动
2023-06-14

编程热搜

  • Python 学习之路 - Python
    一、安装Python34Windows在Python官网(https://www.python.org/downloads/)下载安装包并安装。Python的默认安装路径是:C:\Python34配置环境变量:【右键计算机】--》【属性】-
    Python 学习之路 - Python
  • chatgpt的中文全称是什么
    chatgpt的中文全称是生成型预训练变换模型。ChatGPT是什么ChatGPT是美国人工智能研究实验室OpenAI开发的一种全新聊天机器人模型,它能够通过学习和理解人类的语言来进行对话,还能根据聊天的上下文进行互动,并协助人类完成一系列
    chatgpt的中文全称是什么
  • C/C++中extern函数使用详解
  • C/C++可变参数的使用
    可变参数的使用方法远远不止以下几种,不过在C,C++中使用可变参数时要小心,在使用printf()等函数时传入的参数个数一定不能比前面的格式化字符串中的’%’符号个数少,否则会产生访问越界,运气不好的话还会导致程序崩溃
    C/C++可变参数的使用
  • css样式文件该放在哪里
  • php中数组下标必须是连续的吗
  • Python 3 教程
    Python 3 教程 Python 的 3.0 版本,常被称为 Python 3000,或简称 Py3k。相对于 Python 的早期版本,这是一个较大的升级。为了不带入过多的累赘,Python 3.0 在设计的时候没有考虑向下兼容。 Python
    Python 3 教程
  • Python pip包管理
    一、前言    在Python中, 安装第三方模块是通过 setuptools 这个工具完成的。 Python有两个封装了 setuptools的包管理工具: easy_install  和  pip , 目前官方推荐使用 pip。    
    Python pip包管理
  • ubuntu如何重新编译内核
  • 改善Java代码之慎用java动态编译

目录