TB-AVA: Text as a Semantic Bridge for Audio-Visual Parameter Efficient Finetuning

Published in Under review, 2026

Recommended citation: Seongah Kim, Dinh Phu Tran, Hyeontaek Hwang, Saad Wazir, Duc Do Minh, and Daeyoung Kim. "TB-AVA: Text as a Semantic Bridge for Audio-Visual Parameter Efficient Finetuning." Under review, 2026.