एट्रिब्यूट और टेक्स्ट चयन

Python में Web Scraping

Thomas Laetsch

Data Scientist, NYU

Colon का सही उपयोग करने की हिम्मत रखें

  • XPath का उपयोग: <xpath-to-element>/@attr-name
xpath = '//div[@id="uid"]/a/@href'
  • CSS लोकेटर का उपयोग: <css-to-element>::attr(attr-name)
css_locator = 'div#uid > a::attr(href)'
Python में Web Scraping

टेक्स्ट एक्सट्रैक्शन

<p id="p-example">
  Hello world! 
  Try <a href="http://www.datacamp.com">DataCamp</a> today!
</p>
  • XPath में text() का उपयोग करें
sel.xpath('//p[@id="p-example"]/text()').extract()

# result: ['\n Hello world!\n Try ', ' today!\n']
sel.xpath('//p[@id="p-example"]//text()').extract()

# result: ['\n Hello world!\n Try ', 'DataCamp', ' today!\n']
Python में Web Scraping

टेक्स्ट एक्सट्रैक्शन

<p id="p-example">
  Hello world! 
  Try <a href="http://www.datacamp.com">DataCamp</a> today!
</p>
  • CSS लोकेटर के लिए ::text का उपयोग करें
sel.css('p#p-example::text').extract()

# result: ['\n Hello world!\n Try ', ' today!\n']
sel.css('p#p-example ::text').extract()

# result: ['\n Hello world!\n Try ', 'DataCamp', ' today!\n']
Python में Web Scraping

Colon का स्कोपिंग

Python में Web Scraping

Preparing Video For Download...