데이터셋: SNLI

term_id: datasetsnli

Category: basic_concepts

Definition

SNLI는 50만 개 이상의 레이블이 지정된 문장 쌍을 포함하는 벤치마크 데이터셋으로, 함축(entailment), 모순(contradiction), 중립(neutral)의 세 가지 클래스로 주석이 달려 있습니다. 이 데이터셋은 자연어 추론 연구 발전을 위해 제작되었습니다.

Summary

스탠퍼드 자연어 추론 코퍼스(Stanford Natural Language Inference Corpus)로, 영어 문장 쌍과 인간이 작성한 텍스트 함축 라벨이 포함된 대규모 데이터셋입니다.

Key Concepts

  • 자연어 추론
  • 텍스트 함축
  • 문장 쌍
  • 벤치마크

Use Cases

  • 의미적 유사성 모델 평가
  • NLI 분류기 훈련
  • NLP 내 논리적 추론 연구