Вебскрапінг у Python
Thomas Laetsch
Data Scientist, NYU
Selector vs Response:
xpath і css, а далі методи extract та extract_first.xpath працює як Selectorresponse.xpath( '//div/span[@class=\"bio\"]' )
css працює як Selectorresponse.css( 'div > span.bio' )
response.xpath('//div').css('span.bio')
response.xpath('//div').css('span.bio').extract()
response.xpath('//div').css('span.bio').extract_first()
response зберігає URL у змінній response url.response.url
>>> 'http://www.DataCamp.com/courses/all'
response дозволяє «follow» перейти за новим посиланням методом follow()# next_url — це рядок-шлях до наступного url для скрейпінгу
response.follow( next_url )
follow — далі.Вебскрапінг у Python