上一篇: TODO Brillio感觉没啥技术的电面下一篇:10-01

爬虫练习【三方Pixiv】

程序笔记发布时间：2022-07-09 发布网站：大佬教程 code.js-code.com

大佬教程收集整理的这篇文章主要介绍了爬虫练习【三方Pixiv】，大佬教程大佬觉得挺不错的，现在分享给大家，也给大家做个参考。

网页链接使用scrapy框架

class Huashi6Spider(scrapy.Spider):
    name = 'huashi6'
    allowed_domains = ['huashi6.com']
    mouth = 9

    base_url = 'https://rt.huashi6.com/front/works/rank_page?index={}&size=10&date=2021-{}-{}'
    start_urls = [f'https://rt.huashi6.com/front/works/rank_page?index={index}&size=10&date=2021-9-{day}' 
                  for day in range(1, 31)
                  for index in range(1, 6)]
    print(start_urls)

    def parse(self, responsE):
        # @R_616_10288@ct = @R_616_10288@ctor(responsE)
        item = items.ChuzhanItem()
        print('HI')
        # f = open('pickLinks.txt', 'a')
        text = response.text
        list = re.findall('path":"(.*?)","width', text)

        for li in list:
            url = 'https://img2.huashi6.com/' + li
            item['url'] = url
            yield item

大佬总结

以上是大佬教程为你收集整理的爬虫练习【三方Pixiv】全部内容，希望文章能够帮你解决爬虫练习【三方Pixiv】所遇到的程序开发问题。

如果觉得大佬教程网站内容还不错，欢迎将大佬教程推荐给程序员好友。

本图文内容来源于网友网络收集整理提供，作为学习参考使用，版权属于原作者。
如您有任何意见或建议可联系处理。小编QQ：384754419，请注明来意。

标签：list php scrapy 程序员

上一篇: TODO Brillio感觉没啥技术的电面下一篇:10-01

猜你在找的程序笔记相关文章

You can't specify target table 'xxx' for update in FROM clause的解决 2022-07-21
【UNIAPP】上传视频，进度条的前台与后端 2022-07-21
十款代码表白特效，一个比一个浪漫！ 2022-07-04
作业3 2022-07-06
linux系统下部署项目访问报404错误的解决方法 2022-05-30
C++带有指针成员的类处理方式详解 2022-06-07
Linux——（1）基本命令 2022-07-21
JavaScript之正则表达式学习笔记 2019-11-07
Redux源码学习笔记 2019-11-07
Webpack学习笔记 2019-11-07