Hugging Face 활용하기
Jacob H. Marquez
Lead Data Engineer


pip install datasets

from datasets import load_dataset
data = load_dataset("IVN-RIN/BioBERT_Italian")
$$
split 매개변수
data = load_dataset("IVN-RIN/BioBERT_Italian", split="train")

data = load_dataset("IVN-RIN/BioBERT_Italian", split="train")# " bella " 패턴으로 필터링 filtered = data.filter(lambda row: " bella " in row['text']) print(filtered)
Dataset({
features: ['text'],
num_rows: 1122
})
# 처음 두 행 선택 sliced = filtered.select(range(2))print(sliced)
Dataset({features: ['text'], num_rows: 2})
# 첫 번째 행의 'text' 추출
print(sliced[0]['text'])
Concentrazioni atmosferiche di PCDD/PCDF...
Hugging Face 활용하기