python - scrapy无法正常爬取这段html的内容？-PHP 중국어 네트워크 Q&A

기사 주제 학습 다운로드 Q&A 프로그래밍 사전 게임 최근 업데이트

简体中文(ZH-CN) English(EN) 繁体中文(ZH-TW) 日本語(JA) 한국어(KO) Melayu(MS) Français(FR) Deutsch(DE)

python - scrapy无法正常爬取这段html的内容？

黄舟 2017-04-17 16:57:04

0

1

382

如图，爬取途中的时间部分，网址在此：http://sh.huodongxing.com/event/6313289154400?utm_source=%E5%8F%91%E7%8E%B0%E6%B4%BB%E5%8A%A8%E5%88%97%E8%A1%A8%E9%A1%B5&utm_medium=&utm_campaign=eventspage

我用的是scrapy的selector（基于lxml），
用的xpath语句是：//p[1]/p/p[1]/text())[7]
在火狐的xpath checker上测试都可以定位到时间部分，但在爬取时都是\R\N等空字符，后来看到网友的办法：

sel = Selector(response, response.body_as_unicode().replace('\r','').replace('\n',''), 'html')

尝试了下，依然有问题（只是把\r\n换成了空格），想请问到底是在哪里出了问题呢

黄舟

人生最曼妙的风景，竟是内心的淡定与从容！

모든 응답 (1)

Ty802017-04-17 16:59:04 1층

用 chrome dev 看到的是最终的页面效果。

你试试查看源代码，在里面找找。因为这段 html 可能是 javascript 处理后的。

如果确认源码里面有，可以：右键 --> Copy --> Copy XPath

//*[@id="container-lg"]/p[1]/p/p[1]

좋다+0

답글 추가

인기 주제

더>

인기 기사

인기 튜토리얼

더>

관련 튜토리얼

인기 추천

최신 강좌

최신 다운로드

더>

웹 효과

웹사이트 소스 코드

웹사이트 자료

프론트엔드 템플릿

회사 소개 부인 성명 Sitemap: PHP 중국어 웹사이트：공공복지 온라인 PHP 교육，PHP 학습자의 빠른 성장을 도와주세요！