데이터셋: SNLI
term_id: datasetsnli
Category: basic_concepts
Definition
SNLI는 50만 개 이상의 레이블이 지정된 문장 쌍을 포함하는 벤치마크 데이터셋으로, 함축(entailment), 모순(contradiction), 중립(neutral)의 세 가지 클래스로 주석이 달려 있습니다. 이 데이터셋은 자연어 추론 연구 발전을 위해 제작되었습니다.
Summary
스탠퍼드 자연어 추론 코퍼스(Stanford Natural Language Inference Corpus)로, 영어 문장 쌍과 인간이 작성한 텍스트 함축 라벨이 포함된 대규모 데이터셋입니다.
Key Concepts
- 자연어 추론
- 텍스트 함축
- 문장 쌍
- 벤치마크
Use Cases
- 의미적 유사성 모델 평가
- NLI 분류기 훈련
- NLP 내 논리적 추론 연구