מושִׁי (Moshi)
Definition
מושִׁי הוא מודל AI מתקדם שנוצר על ידי Kyutai המשלב עיבוד דיבור וטקסט במסגור מאוחד. בניגוד …
Terms tagged with Multimodal
מושִׁי הוא מודל AI מתקדם שנוצר על ידי Kyutai המשלב עיבוד דיבור וטקסט במסגור מאוחד. בניגוד …
Ltx Video מייצג התקדמות ב-AI יוצר עבור וידאו, תוך שימוש בתהליכי דיפוזיה במרחב הסמוי …
תהליך ‘תמונה-טקסט לטקסט’ מתייחס למודלים המעבדים קלטים חזותיים לצד שאילתות …
ג’יני מתייחס למשפחה של מודלים יוצרים המיועדים במיוחד לסנתזת וידאו. פותחו על ידי …
צינור זה מתאים את היכולות הגנרטיביות של מודלי Qwen-VL לסינתזת תמונות. הוא מאפשר למשתמשים …
DeepSeek VL V2 מרחיב את יכולות המודל השפתי הסטנדרטי לתחום הרב-מודאלי, ומאפשר לו לפרש …
כיתובי Flickr30K היא מערכת נתוני בנק סימון נפוצה הכוללת 31,783 תמונות, שלכל אחת מהן חמישה …
לומדי תבניות מקושרות נועדו לטפל בנתונים שבהם מקרים משני מרחבים שונים קשורים זה לזה, כמו …
הכנה מקדימה מנוגדת לשפה ותמונה (CLIP) היא ארכיטקטורת רשת נוירונים שאומנה על תמונות …
מונח ‘כל אחד לכל אחד’ מתייחס לארכיטקטורות רב-מודאליות מאוחדות שיכולות לטפל …
מודלים של שפת-ראייה, המכונים לעיתים קרובות מודלי שפה גדולים רב-מודאליים (MLLMs), משלבים …
בינה מלאכותית חצי-מודאלית כוללת עיבוד והתאמה של נתונים ממודליות שונות, כגון שילוב קלטים …
המונח ‘ויזואלי’ ב-AI מתייחס בעיקר לראיית מחשב (Computer Vision), התחום המוקדש …
בבינה מלאכותית, יצירה מתייחסת ליכולתם של מודלים, ובפרט רשתות גנרטיביות מתחרות (GANs) …