Skip to content

From Sparse Dependence to Sparse Attention: Unveiling How Chain-of-Thought Enhances Transformer Sample Efficiency.

Kaiyue Wen, Huaqing Zhang, Hongzhou Lin, Jingzhao Zhang

VenueA*ICLR
Year2025
ProceedingsICLR

Browse the full ICLR paper archive.