遍历请求翻页的url
for i in range(3):
yield Request("http:xx/page/%s"%str(i),callback=self.parse_page)
结果response请求成功 但是每次内容都一样的没变化都是第一次请求时的内容,但是用postman分别请求分页的url就没有这问题。= = 是被ban了吗 之前就不会这样
遍历请求翻页的url
for i in range(3):
yield Request("http:xx/page/%s"%str(i),callback=self.parse_page)
结果response请求成功 但是每次内容都一样的没变化都是第一次请求时的内容,但是用postman分别请求分页的url就没有这问题。= = 是被ban了吗 之前就不会这样
看下控制台打印的log,看看是否正确抓取了下一页
2017-06-29 09:26:13 [scrapy] DEBUG: Scraped from <200 http:xx/page/x>,
注意最后一个x(http:xx/page/x)是否是变化的
4 回答4.4k 阅读✓ 已解决
4 回答3.8k 阅读✓ 已解决
1 回答3k 阅读✓ 已解决
3 回答2.1k 阅读✓ 已解决
1 回答4.5k 阅读✓ 已解决
1 回答3.8k 阅读✓ 已解决
1 回答2.8k 阅读✓ 已解决
那就要分析一下用postman或者浏览器访问时请求的header头和用scrapy请求头有什么区别