Veri Seti: Gömme Verisi/Flickr30K Altyazıları

term_id: datasetembedding_dataflickr30k_captions

Category: training_techniques

Definition

Flickr30K Altyazıları, görsel içeriği açıklayan beş farklı İngilizce cümle ile etiketlenmiş 31.783 görüntüden oluşan yaygın olarak kullanılan bir referans veri setidir. Temel bir kaynak olarak hizmet verir.

Summary

31.000 görüntüyü insan tarafından oluşturulan altyazılarla eşleştirerek çapraz modlu gömme modellerini eğitmek için kullanılan çok modlu bir veri seti.

Key Concepts

  • Çok Modlu Öğrenme
  • Görüntü-Met Hizalaması
  • Çapraz-Modül Arama
  • Görsel Tabanlandırma

Use Cases

  • Görüntü arama motorları oluşturma
  • Görüntü açıklamaları üretme
  • Görünüm-dil modellerini eğitme