Similar Items: Generative AI meets Architecture: Transforming visions from text, sketches, and 3D models
- VTMA: Vision Transformer-Enabled Multi-Level Attentive Model for Image–Text-Based Multimodal Sentiment Analysis
- Generative AI Meets Cataloging Practice
- A Quantitative and Computational Efficiency Comparison of CNN and Vision Transformer Architectures for Pneumonia Detection from Chest X-rays
- Text-2-Diagnosis: an exploration of text-to-image generation in medical diagnostic imaging
- Bridging semantics and vision: text-guided feature alignment for few-shot object detection
- Classification of Gastrointestinal Diseases Using Hybrid Recurrent Vision Transformers With Wavelet Transform