- 44
- 0
在看《精通python爬虫框架scrapy》的时候遇到一些小疑问。
首先需要说明一下,下面的爬虫是针对同一个示例页面的。
书中的示例代码如下,首先定义了项目的project/items.py
from scrapy.item import Item, Field
class ProjectItem(Item):
......
title = Field()
price = Field()
......
然后定义了一个示例爬虫project/spiders/basic.py
import scrapy
from project.item import ProjectItem
class BasicSpyder(scrapy.Spider):
......
def parse(self, response):
self.log("title %s" % response.xpath(
'//*[@itemprop = "title"][1]/text()').extract())
self.log("price %s" % response.xpath(
'//*[@itemprop = "price"][1]/text()').re('[.0-9]+'))
......
接着书中又用ItemLoader改装了一下project/spiders/basic.py
import scrapy.loader import ItemLoader
from project.item import ProjectItem
class BasicSpyder(scrapy.Spider):
......
def parse(self, response):
p = ItemLoader(item = ProjectItem(), response = response)
p.add_xpath('title', '//*[@itemprop = "title"][1]/text()')
p.add_xpath('price', './/*[@itemprop = "price"][1]/text()', re = '[,.0-9]+')
......
为什么在使用self.log的时候price的xpath是//*[@itemprop = "price"][1]/text()
而在ItemLoader的xpath却是.//*[@itemprop = "price"][1]/text()呢?
这一.之差是为什么?
0
打赏
收藏
点击回答
您的回答被采纳后将获得:提问者悬赏的 10 元积分
网站公告
- 扫一扫访问手机版
回答动态

- 神奇的四哥:发布了悬赏问题阿里云幻兽帕鲁服务器更新之后。服务器里面有部分玩家要重新创建角色是怎么回事啊?预计能赚取 0积分收益

- 神奇的四哥:发布了悬赏问题函数计算不同地域的是不能用内网吧?预计能赚取 0积分收益

- 神奇的四哥:发布了悬赏问题ARMS可以创建多个应用嘛?预计能赚取 0积分收益

- 神奇的四哥:发布了悬赏问题在ARMS如何申请加入公测呀?预计能赚取 0积分收益

- 神奇的四哥:发布了悬赏问题前端小程序接入这个arms具体是如何接入监控的,这个init方法在哪里进行添加?预计能赚取 0积分收益

- 神奇的四哥:发布了悬赏问题阿里云幻兽帕鲁服务器刚到期,是不是就不能再导出存档了呢?预计能赚取 0积分收益

- 神奇的四哥:发布了悬赏问题阿里云幻兽帕鲁服务器的游戏版本不兼容 尝试更新怎么解决?预计能赚取 0积分收益

- 神奇的四哥:发布了悬赏问题阿里云幻兽帕鲁服务器服务器升级以后 就链接不上了,怎么办?预计能赚取 0积分收益

- 神奇的四哥:发布了悬赏问题阿里云幻兽帕鲁服务器转移以后服务器进不去了,怎么解决?预计能赚取 0积分收益

- 神奇的四哥:发布了悬赏问题阿里云幻兽帕鲁服务器修改参数后游戏进入不了,是什么情况?预计能赚取 0积分收益
- 回到顶部
- 回到顶部

