Reducing Object Hallucination in Large Audio-Language Models via Audio-Aware Decoding.
Tzu-Wen Hsu, Ke-Han Lu, Cheng-Han Chiang, Hung-Yi Lee
Browse the full ASRU paper archive.
Tzu-Wen Hsu, Ke-Han Lu, Cheng-Han Chiang, Hung-Yi Lee
Browse the full ASRU paper archive.