@inproceedings{jia2025from,
title = {From Contrast to Commonality: Audio Commonality Captioning for Enhanced Audio-Text Cross-modal Understanding in Multimodal LLMs},
author = {Yuhang Jia and Xu Zhang and Yujie Guo and Yang Chen and Shiwan Zhao},
year = {2025},
booktitle = {IEEE International Conference on Acoustics, Speech, and Signal Processing},
eprint = {2508.01659},
archivePrefix = {arXiv},
url = {https://arxiv.org/abs/2508.01659},
}