Resource Efficient Semantic Retrieval Pipeline via Generative Captioning and Text-to-Text Transformers for Bridging the Modality Gap

The rapid expansion of multimodal digital content necessitates the development of robust information retrieval systems capable of bridging the semantic gap between visual and textual data. However, contemporary cross- modal models, such as CLIP, impose significant computational demands, rendering th...

Full description

Bibliographic Details
Published in:Journal of Intelligent Computing and Health Informatics
Main Authors: Muhammad Firmansyah, Dhendra Marutho, Irwansyah Saputra, Eleni Vogiatzi
Format: Article
Language:English
Published: Universitas Muhammadiyah Semarang 2025-10-01
Subjects:
Online Access:https://jurnal.unimus.ac.id/index.php/ICHI/article/view/19240