Dataset:Multi Nli
term_id: datasetmulti_nli
Category: basic_concepts
Definition
MultiNLI là một bộ dữ liệu được đóng góp bởi cộng đồng, có sẵn thông qua benchmark GLUE, được thiết kế để đánh giá suy luận ngôn ngữ tự nhiên (NLI) trên nhiều thể loại văn nói và văn viết khác nhau. Nó cung cấp các cặp tiền đề (premise) và giả thuyết (hypothesis) để kiểm tra khả năng suy luận logic của mô hình.
Summary
Corpus Suy luận Ngôn ngữ Tự nhiên Đa thể loại, một bộ dữ liệu lớn chứa hàng triệu câu tiếng Anh do con người viết cùng với các chú thích chính xác của con người về sự entailment (kéo theo) văn bản.
Key Concepts
- Suy luận ngôn ngữ tự nhiên (Natural Language Inference)
- Sự entailment văn bản (Textual Entailment)
- GLUE Benchmark
- Độ tương đồng ngữ nghĩa (Semantic Similarity)
Use Cases
- Đánh giá khả năng hiểu ngữ nghĩa
- Huấn luyện các mô hình NLI
- Kiểm tra khả năng tổng quát hóa qua các thể loại khác nhau