Python 網頁爬蟲
Thomas Laetsch
Data Scientist, NYU
Selector 與 Response:
xpath 和 css 方法,後接 extract 與 extract_first 方法。xpath 方法與 Selector 用法相同response.xpath( '//div/span[@class=\"bio\"]' )
css 方法與 Selector 用法相同response.css( 'div > span.bio' )
response.xpath('//div').css('span.bio')
response.xpath('//div').css('span.bio').extract()
response.xpath('//div').css('span.bio').extract_first()
response 會在 response.url 變數中記錄 URL。response.url
>>> 'http://www.DataCamp.com/courses/all'
response 讓我們用 follow() 方法「跟隨」新連結# next_url 是我們想爬取的下一個網址字串路徑
response.follow( next_url )
follow。Python 網頁爬蟲