Veri Seti: Gömme Verisi/Flickr30K Altyazıları
term_id: datasetembedding_dataflickr30k_captions
Category: training_techniques
Definition
Flickr30K Altyazıları, görsel içeriği açıklayan beş farklı İngilizce cümle ile etiketlenmiş 31.783 görüntüden oluşan yaygın olarak kullanılan bir referans veri setidir. Temel bir kaynak olarak hizmet verir.
Summary
31.000 görüntüyü insan tarafından oluşturulan altyazılarla eşleştirerek çapraz modlu gömme modellerini eğitmek için kullanılan çok modlu bir veri seti.
Key Concepts
- Çok Modlu Öğrenme
- Görüntü-Met Hizalaması
- Çapraz-Modül Arama
- Görsel Tabanlandırma
Use Cases
- Görüntü arama motorları oluşturma
- Görüntü açıklamaları üretme
- Görünüm-dil modellerini eğitme