Dataset:Multi Nli
term_id: datasetmulti_nli
Category: basic_concepts
Definition
Το MultiNLI είναι ένα σώμα δεδομένων που έχει δημιουργηθεί μέσω συλλογής από το κοινό (crowdsourced) και διατίθεται μέσω του δείκτη GLUE. Σχεδιάστηκε για την αξιολόγηση της φυσικής γλωσσικής συλλογιστικής (NLI) σε διάφορα είδη ομιλούμενου και γραπτού κειμένου. Παρέχει ζεύγη προτάσεων (premise-hypothesis) για να δοκιμάσει την ικανότητα ενός μοντέλου να συμπεράνει αν μια υπόθεση ακολουθεί λογικά από μια προκείμενη πρόταση.
Summary
Το Σώμα Φυσικής Γλωσσικής Συλλογιστικής Πολλαπλών Ειδών (Multi-Genre Natural Language Inference Corpus), ένα μεγάλο σύνολο δεδομένων που περιλαμβάνει εκατομμύρια ανθρώπινα γραμμένα αγγλικά πρόταση με χρυσές ανθρώπινες σημειώσεις για την κειμενική επαγωγικότητα.
Key Concepts
- Φυσική Γλωσσική Συλλογιστική
- Κειμενική Επαγωγικότητα (Textual Entailment)
- Δείκτης GLUE
- Ημιαντική Ομοιότητα
Use Cases
- Αξιολόγηση ημιαντικής κατανόησης
- Εκπαίδευση μοντέλων φυσικής γλωσσικής συλλογιστικής
- Δοκιμές γενίκευσης σε διαφορετικά είδη κειμένου