Coarse-to-Fine Multimodal Information Selection for Video Speaking Style Recognition with Large Language Models.
Beibei Zhang, Yanan Lu, Fen Lin, Tongwei Ren
Browse the full ACL paper archive.
Beibei Zhang, Yanan Lu, Fen Lin, Tongwei Ren
Browse the full ACL paper archive.