Web Scraping în Python
Thomas Laetsch
Data Scientist, NYU
Selector vs Response:
xpath și css urmate de metodele extract și extract_first.xpath funcționează ca un Selectorresponse.xpath( '//div/span[@class="bio"]' )
css funcționează ca un Selectorresponse.css( 'div > span.bio' )
response.xpath('//div').css('span.bio')
response.xpath('//div').css('span.bio').extract()
response.xpath('//div').css('span.bio').extract_first()
response reține URL-ul în variabila response url.response.url
>>> 'http://www.DataCamp.com/courses/all'
response ne permite să „urmărim" un nou link cu metoda follow()# next_url este calea string a următorului url pe care vrem să-l extragem
response.follow( next_url )
follow ulterior.Web Scraping în Python