Adatkészlet: Snli

term_id: datasetsnli

Category: basic_concepts

Definition

Az SNLI egy benchmark adatkészlet, amely több mint 500 000 címkézett mondatpárt tartalmaz, amelyek három kategóriába sorolhatók: entalpia (következik), ellentmondás és semleges. A természetes nyelvi feldolgozás területén végzett kutatások előmozdítása érdekében készült.

Summary

Stanford Natural Language Inference Corpus: egy nagy méretű, angol nyelvű mondatpárokat tartalmazó adatkészlet emberi által írt szöveges következtetési címkékkel.

Key Concepts

  • Természetes nyelvű következtetés
  • Szöveges entalpia
  • Mondatpárok
  • Benchmark

Use Cases

  • Szemantikai hasonlóságot mérő modellek értékelése
  • NLI (Natural Language Inference) osztályozók betanítása
  • Logikai érvelés kutatása a NLP területén