目录
前段时间写了写爬虫,我公众号的结尾的福利环节会留一些图,前一段时间有个大佬留言说多放一些汉服妹子,今天也刚好有点时间就百度了下汉服的网站,找到了一个汉服的网站,就写个爬虫来搜集一些照片,废话不多说了,开始吧。

1、目标网站分析
目标网站:https://www.hanfuhui.com/

可以看到主页是流式布局的,向下拖动会加载新的数据。
打开一个子页面,查看每个图片的对应链接信息。
![]()
可以看到这个图片的链接信息。
http
本文介绍了如何使用Python爬虫从汉服网站获取图片链接。通过分析目标网站,发现了翻页和图片链接的规律,利用API请求获取多页数据,并展示了简化版的爬虫代码。在复盘中提到了遇到的问题,如非原图下载及可能对网站产生的影响。
目录
前段时间写了写爬虫,我公众号的结尾的福利环节会留一些图,前一段时间有个大佬留言说多放一些汉服妹子,今天也刚好有点时间就百度了下汉服的网站,找到了一个汉服的网站,就写个爬虫来搜集一些照片,废话不多说了,开始吧。

目标网站:https://www.hanfuhui.com/

可以看到主页是流式布局的,向下拖动会加载新的数据。
打开一个子页面,查看每个图片的对应链接信息。
![]()
可以看到这个图片的链接信息。
http
1万+
16万+
890
5075
6939

被折叠的 条评论
为什么被折叠?