Text-zu-Bild
Definition
Die Text-zu-Bild-Generierung (T2I) beinhaltet die Verwendung von Deep-Learning-Modellen, …
Terms tagged with Computer Vision
Die Text-zu-Bild-Generierung (T2I) beinhaltet die Verwendung von Deep-Learning-Modellen, …
Beim Ähnlichkeitslernen werden Modelle trainiert, um Eingaben in einen Vektorraum …
Sam3 ist kein allgemein anerkannter öffentlicher KI-Begriff wie SAM (Segment Anything …
Sam3 Video bezieht sich auf die Anwendung fortschrittlicher Segmentierungsmodelle, …
Darstellungskollaps tritt auf, wenn ein neuronales Netz, insbesondere in …
Optical Character Recognition (OCR) nutzt Bildverarbeitung und …
Die Objekterkennung erweitert die Bildklassifizierung, indem sie nicht nur bestimmt, …
Die Maskengenerierung umfasst das Erzeugen räumlicher oder zeitlicher Masken, die …
LocateAnything ist ein vielseitiges Computer-Vision-Framework, das die Erkennung und …
Intelligente Worterkennung bezieht sich auf fortschrittliche Technologien der optischen …
Bild-zu-Bild (I2I) beinhaltet die Verwendung von Deep-Learning-Modellen wie GANs oder …
Die Bild-zu-Bild-(I2I)-Übersetzung beinhaltet das Abbilden von Pixeln aus einer …
Histogram of Oriented Displacements (HOD) ist eine Methode zur Merkmalsextraktion für die …
Google Clips war ein Consumer-Elektronikgerät von Google, das maschinelles Lernen direkt …
Entwickelt von Google, verwendet EfficientNet eine Methode zur kombinierten Skalierung, …
Dieser Begriff bezieht sich auf eine spezifische Implementierung innerhalb der Hugging …
Diella bezeichnet spezifische neuronale Netzwerkmodelle, die zur Verbesserung der …
Anti-Aliasing im Deep Learning bezeichnet Methoden, die neuronale Netze einsetzen, um …
Flickr30K Captions ist ein weit verbreiteter Benchmark-Datensatz, der 31.783 Bilder …
Kontrastives Vorabtraining von Sprache und Bild (CLIP) ist eine neuronale …
CAM erzeugt Heatmaps, die über Eingabebilder gelegt werden, um zu zeigen, welche Pixel am …
Zweistufige Architekturen teilen eine komplexe Aufgabe in zwei separate Schritte auf, …
Feingranulare Analyse beinhaltet das Identifizieren und Kategorisieren von Objekten oder …
Der Begriff ‘visual’ bezieht sich in der KI primär auf Computer Vision, das …
KI-Wahrnehmung beinhaltet die Umwandlung roher Sensordaten in sinnvolle Informationen, …
In der Computer Vision und Robotik bezieht sich Bewegung auf die Erkennung und Analyse …
Matching ist eine kritische Technik im maschinellen Lernen, die verwendet wird, um …
Detektion ist eine Kernaufgabe im Computersehen und in der Signalverarbeitung, bei der …