R로 배우는 웹 스크레이핑
Timo Grossenbacher
Instructor
<html>
<body>
<h2>첫 번째 예제</h2>
<p>텍스트 단락.</p>
<p>
다음은 목록입니다:
</p>
</body>
</html>


...
<div>
다음은 목록입니다:
<ul>
<li>항목 1</li>
<li>항목 2</li>
<li>항목 3</li>
</ul>
</div>
...

...
<p>
다음은
<a href="https://google.com">링크</a>입니다.
</p>
...
library(rvest)
html <- read_html(html_document)
html
{html_document}
<html>
[1] <body> \n <h2>첫 번째 예제</h2>\n <p>텍스트 단락.</p>\n ...
class(html)
"xml_document" "xml_node"
library(xml2)
xml_structure(html)
<html>
<body>
{text}
<h2>
{text}
{text}
<p>
{text}
{text}
<p>
{text}
<a [href]>
{text}
{text}
{text}
R로 배우는 웹 스크레이핑