python中怎么重写start_requests方法-快上网网站建设公司

python中怎么重写start_requests方法

今天小编给大家分享一下python中怎么重写start_requests方法的相关知识点，内容详细，逻辑清晰，相信大部分人都还太了解这方面的知识，所以分享这篇文章给大家参考一下，希望大家阅读完这篇文章后有所收获，下面我们一起来了解一下吧。

成都创新互联为企业级客户提高一站式互联网+设计服务，主要包括网站制作、成都网站制作、重庆APP开发、小程序制作、宣传片制作、LOGO设计等，帮助客户快速提升营销能力和企业形象，创新互联各部门都有经验丰富的经验，可以确保每一个作品的质量和创作周期，同时每年都有很多新员工加入，为我们带来大量新的创意。

说明

1、在scrapy中，start_url是由start_requests处理的，通过重写这种方法，start_url可以携带请求头信息。

2、cookie不能放在scrapy中的headers中，在构建请求时有专门的cookies参数。

可以接收字典形式的cookie。可能需要在settings中设置ROBOTS协议和USER_AGENT。

实例

import scrapy
 
 
class Git1Spider(scrapy.Spider):
    name = 'git1'
    allowed_domains = ['github.com']
    start_urls = ['https://github.com/GitLqr']
 
    def start_requests(self):
        """
        重写start_requests，发送携带cookies的Request。
        默认start_requests只是普通的get请求，不会携带自定义的头信息
        """
        url = self.start_urls[0]
 
        temp = '_octo=GH1.1.1045146750.1615451260; _device_id=cd8d64981fcb3fd4ba7f587873e97804'
        # 把cookies字符串转成字典
        cookies = {data.split('=')[0]: data.split('=')[-1] for data in temp.split('; ')}
 
        yield scrapy.Request(
            url=url,
            callback=self.parse,
            cookies=cookies
        )
 
    def parse(self, response):
        print(response.xpath('/html/head/title/text()').extract_first())

以上就是“python中怎么重写start_requests方法”这篇文章的所有内容，感谢各位的阅读！相信大家阅读完这篇文章都有很大的收获，小编每天都会为大家更新不同的知识，如果还想学习更多的知识，请关注创新互联行业资讯频道。

名称栏目：python中怎么重写start_requests方法
本文URL：http://cdkjz.cn/article/igoigo.html

多年建站经验

多一份参考，总有益处

联系快上网，免费获得专属《策划方案》及报价

咨询相关问题或预约面谈，可以通过以下方式与我们联系

网站建设

网站推广

案例

方案

电商网站开发

微信小程序

我们

联系

精准传达 • 有效沟通

查看其它板块

python中怎么重写start_requests方法

多一份参考，总有益处

联系快上网，免费获得专属《策划方案》及报价

大客户专线成都：13518219792 座机：028-86922220

友情链接交换友情链接

网络推广

Network promotion

网站方案

Solution

电商网站开发

E-commerce & System

我们

About Us

联系

Contact Us

精准传达 • 有效沟通

查看其它板块

python中怎么重写start_requests方法

相关资讯

怎么用springboot+easypoi大数据量excel导出

OpenStack架构----keystone组件（一）

怎么正确使用RabbitMQ异步编程

Raid磁盘阵列重建后怎么恢复原来的数据

Python和JavaScript这两种流行的编程语言之间的主要区别是什么

Linux在怎么使用curses图形库实现一个贪吃蛇游戏

windows中64位操作系统的概念是什么

ThinkPHP怎么利用.htaccess文件的Rewrite规则隐藏URL中的index.php

多一份参考，总有益处

联系快上网，免费获得专属《策划方案》及报价

大客户专线 成都：13518219792 座机：028-86922220

友情链接 交换友情链接

大客户专线成都：13518219792 座机：028-86922220

友情链接交换友情链接