Я создал следующий файл в каталоге spiders
проекта scrapy. Проблема, с которой я сталкиваюсь, заключается в том, что функции внутри middlewares.py
, а именно process_request
и process_response
, не вызываются. В чем может быть причина этого?
import scrapy
class QuotesSpider(scrapy.Spider):
name = "quotes"
def start_requests(self):
urls = [
'https://liv.ai/'
]
for url in urls:
yield scrapy.Request(url=url, callback=self.parse)
def parse(self, response):
print(response.url,"...", response.status)
page = response.url.split("/")[-2]
filename = 'quotes-%s.html' % page
with open(filename, 'wb') as f:
f.write(response.body)
self.log('Saved file %s' % filename)
Я хочу загрузить HTML с веб-страницы, используя другой процесс, а не копирование. По этой причине я хочу прослушать промежуточное программное обеспечение и обратиться к другому источнику, который может загрузить HTML и отправить ответ.