Python으로 하는 웹 스크레이핑
Thomas Laetsch
Data Scientist, NYU
Selector vs Response:
xpath와 css 메서드, 그리고 이어지는 extract, extract_first 메서드.xpath 메서드는 Selector처럼 동작합니다response.xpath( '//div/span[@class="bio"]' )
css 메서드는 Selector처럼 동작합니다response.css( 'div > span.bio' )
response.xpath('//div').css('span.bio')
response.xpath('//div').css('span.bio').extract()
response.xpath('//div').css('span.bio').extract_first()
response는 응답의 url 변수로 URL을 보관합니다.response.url
>>> 'http://www.DataCamp.com/courses/all'
response는 follow() 메서드로 새 링크를 "따라갈" 수 있게 합니다# next_url은 스크레이핑할 다음 url의 문자열 경로입니다
response.follow( next_url )
follow는 이후에 더 배웁니다.Python으로 하는 웹 스크레이핑