Adatkészlet: Snli
term_id: datasetsnli
Category: basic_concepts
Definition
Az SNLI egy benchmark adatkészlet, amely több mint 500 000 címkézett mondatpárt tartalmaz, amelyek három kategóriába sorolhatók: entalpia (következik), ellentmondás és semleges. A természetes nyelvi feldolgozás területén végzett kutatások előmozdítása érdekében készült.
Summary
Stanford Natural Language Inference Corpus: egy nagy méretű, angol nyelvű mondatpárokat tartalmazó adatkészlet emberi által írt szöveges következtetési címkékkel.
Key Concepts
- Természetes nyelvű következtetés
- Szöveges entalpia
- Mondatpárok
- Benchmark
Use Cases
- Szemantikai hasonlóságot mérő modellek értékelése
- NLI (Natural Language Inference) osztályozók betanítása
- Logikai érvelés kutatása a NLP területén