Forent modell
Definition
En forent modell refererer til et kunstig intelligenssystem som er i stand til å utføre …
Terms tagged with Multimodal
En forent modell refererer til et kunstig intelligenssystem som er i stand til å utføre …
Tekst-til-video refererer til generative AI-modeller som lager dynamisk visuelt innhold …
Tekst til bilde refererer til anvendelsen av generativ kunstig intelligens for å …
Moshi er en avansert AI-modell laget av Kyutai som integrerer tale- og tekstbehandling i …
Ltx Video representerer en fremgang i generativ AI for video, ved å bruke latente …
Bilde-tekst-til-tekst refererer til modeller som behandler visuelle inndata sammen med …
Genie refererer til en familie av generative modeller designet spesielt for videosyntese. …
Denne pipeline-en tilpasser de generative evnene til Qwen-VL-modeller for bildesyntese. …
DeepSeek VL V2 utvider evnene til den vanlige språkmodellen inn i det multimodale …
Flickr30K Captions er et mye brukt benchmark-datasett som består av 31 783 bilder, der …
Koblede mønstergjenkjennere er designet for å håndtere data der instanser fra to …
Kontrastiv språk-bilde-forhåndsopplæring (CLIP) er en nevralt nettverksarkitektur trent …
Any-to-any refererer til enhetlige multimodale arkitekturer som kan håndtere ulike …
Visjonsspråkmodeller, ofte omtalt som multimodale store språkmodeller (MLLMs), integrerer …
Tverrmodal AI innebærer å behandle og korrelere data fra distinkte moduser, for eksempel …
Begrepet ‘visuell’ innen AI gjelder primært Datamaskinsyn, feltet dedikert …
Innen kunstig intelligens refererer generering til evnen til modeller, spesielt …