xpath中可以插入正则表达式吗？

0 0

xpath中可以插入正则表达式吗？

想要爬取一个网站，这个网站的不同网页的正文部分的xpath是不一样的，比如：
有个页面的正文部分是： //*[@id='postmessage_32199']
另一个是： //*[@id='postmessage_32153']
......
它们的格式是 postmessage_xxxxx ,x为数字。

我的问题是：xpath中可以使用用正则表达式吗？如果不能那怎么匹配这么多不同的xpath？

ps:我是用的是python的scrapy框架

提前感谢各位了。

xpath 正则表达式 python scrapy

12 years, 4 months ago

诺德皇家卫士

诺德皇家卫士 12 years, 4 months ago

你用 https://github.com/binux/pyspider 我就告诉你

//*[starts-with(@id, "postmessage_")]
或者
doc.xpath(r'//*[re:match(@id, "postmessage_\d+")]', namespaces={"re": "http://exslt.org/regular-expressions"})

answered 12 years, 4 months ago

NiceLyt

NiceLyt answered 12 years, 4 months ago

xpath中可以插入正则表达式吗？

诺德皇家卫士

Answers

NiceLyt

Your Answer