Dataset:Multi Nli

term_id: datasetmulti_nli

Category: basic_concepts

Definition

Το MultiNLI είναι ένα σώμα δεδομένων που έχει δημιουργηθεί μέσω συλλογής από το κοινό (crowdsourced) και διατίθεται μέσω του δείκτη GLUE. Σχεδιάστηκε για την αξιολόγηση της φυσικής γλωσσικής συλλογιστικής (NLI) σε διάφορα είδη ομιλούμενου και γραπτού κειμένου. Παρέχει ζεύγη προτάσεων (premise-hypothesis) για να δοκιμάσει την ικανότητα ενός μοντέλου να συμπεράνει αν μια υπόθεση ακολουθεί λογικά από μια προκείμενη πρόταση.

Summary

Το Σώμα Φυσικής Γλωσσικής Συλλογιστικής Πολλαπλών Ειδών (Multi-Genre Natural Language Inference Corpus), ένα μεγάλο σύνολο δεδομένων που περιλαμβάνει εκατομμύρια ανθρώπινα γραμμένα αγγλικά πρόταση με χρυσές ανθρώπινες σημειώσεις για την κειμενική επαγωγικότητα.

Key Concepts

  • Φυσική Γλωσσική Συλλογιστική
  • Κειμενική Επαγωγικότητα (Textual Entailment)
  • Δείκτης GLUE
  • Ημιαντική Ομοιότητα

Use Cases

  • Αξιολόγηση ημιαντικής κατανόησης
  • Εκπαίδευση μοντέλων φυσικής γλωσσικής συλλογιστικής
  • Δοκιμές γενίκευσης σε διαφορετικά είδη κειμένου