Skip to content

Sanjiv Kumar

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

89

Venues

12

Active years

2003–2025

Best venue rank

A*

Where they publish

Papers

89 indexed papers, newest first.

YearVenueTitleAuthors
2025ICLRBetter autoregressive regression with LLMs via regression-aware fine-tuning.Michal Lukasik, Zhao Meng, Harikrishna Narasimhan, Yin-Wen Chang, Aditya Krishna Menon, Felix Yu, Sanjiv Kumar
2025ICLRFaster Cascades via Speculative Decoding.Harikrishna Narasimhan, Wittawat Jitkrittum, Ankit Singh Rawat, Seungyeon Kim, Neha Gupta, Aditya Krishna Menon, Sanjiv Kumar
2025ICLREfficient stagewise pretraining via progressive subnetworks.Abhishek Panigrahi, Nikunj Saunshi, Kaifeng Lyu, Sobhan Miryoosefi, Sashank J. Reddi, Satyen Kale, Sanjiv Kumar
2025ICLRReasoning with Latent Thoughts: On the Power of Looped Transformers.Nikunj Saunshi, Nishanth Dikkala, Zhiyuan Li, Sanjiv Kumar, Sashank J. Reddi
2025ICLRLoRA Done RITE: Robust Invariant Transformation Equilibration for LoRA Optimization.Jui-Nan Yen, Si Si, Zhao Meng, Felix X. Yu, Sai Surya Duvvuri, Inderjit S. Dhillon, Cho-Jui Hsieh, Sanjiv Kumar
2025ICMLBipartite Ranking From Multiple Labels: On Loss Versus Label Aggregation.Michal Lukasik, Lin Chen, Harikrishna Narasimhan, Aditya Krishna Menon, Wittawat Jitkrittum, Felix X. Yu, Sashank J. Reddi, Gang Fu, MohammadHossein Bateni, Sanjiv Kumar
2025ICMLLAuReL: Learned Augmented Residual Layer.Gaurav Menghani, Ravi Kumar, Sanjiv Kumar
2025ICMLStructured Preconditioners in Adaptive Optimization: A Unified Analysis.Shuo Xie, Tianhao Wang, Sashank J. Reddi, Sanjiv Kumar, Zhiyuan Li
2024CVPRMarkovGen: Structured Prediction for Efficient Text-to-Image Generation.Sadeep Jayasumana, Daniel Glasner, Srikumar Ramalingam, Andreas Veit, Ayan Chakrabarti, Sanjiv Kumar
2024CVPRRethinking FID: Towards a Better Evaluation Metric for Image Generation.Sadeep Jayasumana, Srikumar Ramalingam, Andreas Veit, Daniel Glasner, Ayan Chakrabarti, Sanjiv Kumar
2024EMNLPRegression Aware Inference with LLMs.Michal Lukasik, Harikrishna Narasimhan, Aditya Krishna Menon, Felix X. Yu, Sanjiv Kumar
2024ICLROn Bias-Variance Alignment in Deep Models.Lin Chen, Michal Lukasik, Wittawat Jitkrittum, Chong You, Sanjiv Kumar
2024ICLRThink before you speak: Training Language Models With Pause Tokens.Sachin Goyal, Ziwei Ji, Ankit Singh Rawat, Aditya Krishna Menon, Sanjiv Kumar, Vaishnavh Nagarajan
2024ICLRLanguage Model Cascades: Token-Level Uncertainty And Beyond.Neha Gupta, Harikrishna Narasimhan, Wittawat Jitkrittum, Ankit Singh Rawat, Aditya Krishna Menon, Sanjiv Kumar
2024ICLRFunctional Interpolation for Relative Positions improves Long Context Transformers.Shanda Li, Chong You, Guru Guruganesh, Joshua Ainslie, Santiago Ontan, Manzil Zaheer, Sumit Sanghai, Yiming Yang, Sanjiv Kumar, Srinadh Bhojanapalli
2024ICLRLearning to Reject Meets Long-tail Learning.Harikrishna Narasimhan, Aditya Krishna Menon, Wittawat Jitkrittum, Neha Gupta, Sanjiv Kumar
2024ICLRPlugin estimators for selective classification with out-of-distribution detection.Harikrishna Narasimhan, Aditya Krishna Menon, Wittawat Jitkrittum, Sanjiv Kumar
2024ICLRTwo-stage LLM Fine-tuning with Less Specialization and More Generalization.Yihan Wang, Si Si, Daliang Li, Michal Lukasik, Felix X. Yu, Cho-Jui Hsieh, Inderjit S. Dhillon, Sanjiv Kumar
2024ICLRDistillSpec: Improving Speculative Decoding via Knowledge Distillation.Yongchao Zhou, Kaifeng Lyu, Ankit Singh Rawat, Aditya Krishna Menon, Afshin Rostamizadeh, Sanjiv Kumar, Jean-Franois Kagy, Rishabh Agarwal
2024ICMLCan Looped Transformers Learn to Implement Multi-step Gradient Descent for In-context Learning?Khashayar Gatmiry, Nikunj Saunshi, Sashank J. Reddi, Stefanie Jegelka, Sanjiv Kumar
2024ICMLUSTAD: Unified Single-model Training Achieving Diverse Scores for Information Retrieval.Seungyeon Kim, Ankit Singh Rawat, Manzil Zaheer, Wittawat Jitkrittum, Veeranjaneyulu Sadhanala, Sadeep Jayasumana, Aditya Krishna Menon, Rob Fergus, Sanjiv Kumar
2024ICMLPromises and Pitfalls of Generative Masked Language Modeling: Theoretical Framework and Practical Guidelines.Yuchen Li, Alexandre Kirchmeyer, Aashay Mehta, Yilong Qin, Boris Dadachev, Kishore Papineni, Sanjiv Kumar, Andrej Risteski
2024ICMLTandem Transformers for Inference Efficient LLMs.Aishwarya P. S., Pranav Ajit Nair, Yashas Samaga, Toby Boyd, Sanjiv Kumar, Prateek Jain, Praneeth Netrapalli
2023ACLLarge Language Models with Controllable Working Memory.Daliang Li, Ankit Singh Rawat, Manzil Zaheer, Xin Wang, Michal Lukasik, Andreas Veit, Felix X. Yu, Sanjiv Kumar
2023ICLRLeveraging Importance Weights in Subset Selection.Gui Citovsky, Giulia DeSalvo, Sanjiv Kumar, Srikumar Ramalingam, Afshin Rostamizadeh, Yunjuan Wang
2023ICLRSupervision Complexity and its Role in Knowledge Distillation.Hrayr Harutyunyan, Ankit Singh Rawat, Aditya Krishna Menon, Seungyeon Kim, Sanjiv Kumar
2023ICLRThe Lazy Neuron Phenomenon: On Emergence of Activation Sparsity in Transformers.Zonglin Li, Chong You, Srinadh Bhojanapalli, Daliang Li, Ankit Singh Rawat, Sashank J. Reddi, Ke Ye, Felix Chern, Felix X. Yu, Ruiqi Guo, Sanjiv Kumar
2023ICLRServing Graph Compression for Graph Neural Networks.Si Si, Felix X. Yu, Ankit Singh Rawat, Cho-Jui Hsieh, Sanjiv Kumar
2023ICLRAutomating Nearest Neighbor Search Configuration with Constrained Optimization.Philip Sun, Ruiqi Guo, Sanjiv Kumar
2023ICLRTeacher Guided Training: An Efficient Framework for Knowledge Transfer.Manzil Zaheer, Ankit Singh Rawat, Seungyeon Kim, Chong You, Himanshu Jain, Andreas Veit, Rob Fergus, Sanjiv Kumar
2023ICMLEfficient Training of Language Models using Few-Shot Learning.Sashank J. Reddi, Sobhan Miryoosefi, Stefani Karp, Shankar Krishnan, Satyen Kale, Seungyeon Kim, Sanjiv Kumar
2023ICMLAA Framework for Developing the Next Generation Interactive Soil Moisture Forecasting System Using the Long-Short Term Memory Model.Guna Shekar M., Wonjun Lee, Sanjiv Kumar, Yanan Duan, Imtiaz Rangwala
2022ICMLRobust Training of Neural Networks Using Scale Invariant Architectures.Zhiyuan Li, Srinadh Bhojanapalli, Manzil Zaheer, Sashank J. Reddi, Sanjiv Kumar
2022ICMLIn defense of dual-encoders for neural ranking.Aditya Krishna Menon, Sadeep Jayasumana, Ankit Singh Rawat, Seungyeon Kim, Sashank J. Reddi, Sanjiv Kumar
2021AISTATSRankDistil: Knowledge Distillation for Ranking.Sashank J. Reddi, Rama Kumar Pasumarthi, Aditya Krishna Menon, Ankit Singh Rawat, Felix X. Yu, Seungyeon Kim, Andreas Veit, Sanjiv Kumar
2021ICLREvaluations and Methods for Explanation through Robustness Analysis.Cheng-Yu Hsieh, Chih-Kuan Yeh, Xuanqing Liu, Pradeep Kumar Ravikumar, Seungyeon Kim, Sanjiv Kumar, Cho-Jui Hsieh
2021ICLRLong-tail learning via logit adjustment.Aditya Krishna Menon, Sadeep Jayasumana, Ankit Singh Rawat, Himanshu Jain, Andreas Veit, Sanjiv Kumar
2021ICLROverparameterisation and worst-case generalisation: friend or foe?Aditya Krishna Menon, Ankit Singh Rawat, Sanjiv Kumar
2021ICLRAdaptive Federated Optimization.Sashank J. Reddi, Zachary Charles, Manzil Zaheer, Zachary Garrett, Keith Rush, Jakub Konecn, Sanjiv Kumar, Hugh Brendan McMahan
2021ICLRCoping with Label Shift via Distributionally Robust Optimisation.Jingzhao Zhang, Aditya Krishna Menon, Andreas Veit, Srinadh Bhojanapalli, Sanjiv Kumar, Suvrit Sra
2021ICMLA statistical perspective on distillation.Aditya Krishna Menon, Ankit Singh Rawat, Sashank J. Reddi, Seungyeon Kim, Sanjiv Kumar
2021ICMLDisentangling Sampling and Labeling Bias for Learning in Large-output Spaces.Ankit Singh Rawat, Aditya Krishna Menon, Wittawat Jitkrittum, Sadeep Jayasumana, Felix X. Yu, Sashank J. Reddi, Sanjiv Kumar
2020AISTATSTight Analysis of Privacy and Utility Tradeoff in Approximate Differential Privacy.Quan Geng, Wei Ding, Ruiqi Guo, Sanjiv Kumar
2020CVPRHow Does Noise Help Robustness? Explanation and Exploration under the Neural SDE Framework.Xuanqing Liu, Tesi Xiao, Si Si, Qin Cao, Sanjiv Kumar, Cho-Jui Hsieh
2020EMNLPSemantic Label Smoothing for Sequence to Sequence Problems.Michal Lukasik, Himanshu Jain, Aditya Krishna Menon, Seungyeon Kim, Srinadh Bhojanapalli, Felix X. Yu, Sanjiv Kumar
2020ICLRPre-training Tasks for Embedding-based Large-scale Retrieval.Wei-Cheng Chang, Felix X. Yu, Yin-Wen Chang, Yiming Yang, Sanjiv Kumar
2020ICLRCan gradient clipping mitigate label noise?Aditya Krishna Menon, Ankit Singh Rawat, Sashank J. Reddi, Sanjiv Kumar
2020ICLRLearning to Learn by Zeroth-Order Oracle.Yangjun Ruan, Yuanhao Xiong, Sashank J. Reddi, Sanjiv Kumar, Cho-Jui Hsieh
2020ICLRLarge Batch Optimization for Deep Learning: Training BERT in 76 minutes.Yang You, Jing Li, Sashank J. Reddi, Jonathan Hseu, Sanjiv Kumar, Srinadh Bhojanapalli, Xiaodan Song, James Demmel, Kurt Keutzer, Cho-Jui Hsieh
2020ICLRAre Transformers universal approximators of sequence-to-sequence functions?Chulhee Yun, Srinadh Bhojanapalli, Ankit Singh Rawat, Sashank J. Reddi, Sanjiv Kumar
2020ICMLLow-Rank Bottleneck in Multi-head Attention Models.Srinadh Bhojanapalli, Chulhee Yun, Ankit Singh Rawat, Sashank J. Reddi, Sanjiv Kumar
2020ICMLAccelerating Large-Scale Inference with Anisotropic Vector Quantization.Ruiqi Guo, Philip Sun, Erik Lindgren, Quan Geng, David Simcha, Felix Chern, Sanjiv Kumar
2020ICMLDoes label smoothing mitigate label noise?Michal Lukasik, Srinadh Bhojanapalli, Aditya Krishna Menon, Sanjiv Kumar
2020ICMLFederated Learning with Only Positive Labels.Felix X. Yu, Ankit Singh Rawat, Aditya Krishna Menon, Sanjiv Kumar
2019AAAILearning Adaptive Random Features.Yanjun Li, Kai Zhang, Jun Wang, Sanjiv Kumar
2019AISTATSOptimal Noise-Adding Mechanism in Additive Differential Privacy.Quan Geng, Wei Ding, Ruiqi Guo, Sanjiv Kumar
2019AISTATSStochastic Negative Mining for Learning with Large Output Spaces.Sashank J. Reddi, Satyen Kale, Felix X. Yu, Daniel Niels Holtmann-Rice, Jiecao Chen, Sanjiv Kumar
2019ICLRLearning to Screen for Fast Softmax Inference on Large Vocabulary Neural Networks.Patrick H. Chen, Si Si, Sanjiv Kumar, Yang Li, Cho-Jui Hsieh
2019ICMLEscaping Saddle Points with Adaptive Gradient Methods.Matthew Staib, Sashank J. Reddi, Satyen Kale, Sanjiv Kumar, Suvrit Sra
2019ICMLLearning a Compressed Sensing Measurement Matrix via Gradient Unrolling.Shanshan Wu, Alex Dimakis, Sujay Sanghavi, Felix X. Yu, Daniel Niels Holtmann-Rice, Dmitry Storcheus, Afshin Rostamizadeh, Sanjiv Kumar
2018ICLROn the Convergence of Adam and Beyond.Sashank J. Reddi, Satyen Kale, Sanjiv Kumar
2018ICMLLoss Decomposition for Fast Learning in Large Output Spaces.Ian En-Hsu Yen, Satyen Kale, Felix X. Yu, Daniel Niels Holtmann-Rice, Sanjiv Kumar, Pradeep Ravikumar
2017AISTATSFast Classification with Binary Prototypes.Kai Zhong, Ruiqi Guo, Sanjiv Kumar, Bowei Yan, David Simcha, Inderjit S. Dhillon
2017ICCVLearning Spread-Out Local Feature Descriptors.Xu Zhang, Felix X. Yu, Sanjiv Kumar, Shih-Fu Chang
2017ICMLStochastic Generative Hashing.Bo Dai, Ruiqi Guo, Sanjiv Kumar, Niao He, Le Song
2017ICMLDistributed Mean Estimation with Limited Communication.Ananda Theertha Suresh, Felix X. Yu, Sanjiv Kumar, H. Brendan McMahan
2016AISTATSQuantization based Fast Inner Product Search.Ruiqi Guo, Sanjiv Kumar, Krzysztof Choromanski, David Simcha
2016ICMLBinary embeddings with structured hashed projections.Anna Choromanska, Krzysztof Choromanski, Mariusz Bojarski, Tony Jebara, Sanjiv Kumar, Yann LeCun
2015ICASSPExemplar-based large vocabulary speech recognition using k-nearest neighbors.Yanbo Xu, Olivier Siohan, David Simcha, Sanjiv Kumar, Hank Liao
2015ICCVAn Exploration of Parameter Redundancy in Deep Networks with Circulant Projections.Yu Cheng, Felix X. Yu, Rogrio Schmidt Feris, Sanjiv Kumar, Alok N. Choudhary, Shih-Fu Chang
2015ICCVFast Orthogonal Projection Based on Kronecker Product.Xu Zhang, Felix X. Yu, Ruiqi Guo, Sanjiv Kumar, Shengjin Wang, Shih-Fu Chang
2014ICMLCirculant Binary Embedding.Felix X. Yu, Sanjiv Kumar, Yunchao Gong, Shih-Fu Chang
2013CVPRLearning Binary Codes for High-Dimensional Data Using Bilinear Projections.Yunchao Gong, Sanjiv Kumar, Henry A. Rowley, Svetlana Lazebnik
2013ICML\(\propto\)SVM for Learning with Label Proportions.Felix X. Yu, Dong Liu, Sanjiv Kumar, Tony Jebara, Shih-Fu Chang
2012ICMLOn the Difficulty of Nearest Neighbor Search.Junfeng He, Sanjiv Kumar, Shih-Fu Chang
2012ICMLCompact Hyperplane Hashing with Bilinear Functions.Wei Liu, Jun Wang, Yadong Mu, Sanjiv Kumar, Shih-Fu Chang
2011ICMLHashing with Graphs.Wei Liu, Jun Wang, Sanjiv Kumar, Shih-Fu Chang
2010CVPRYouTubeCat: Learning to categorize wild web videos.Zheshen Wang, Ming Zhao, Yang Song, Sanjiv Kumar, Baoxin Li
2010ICMLSequential Projection Learning for Hashing with Compact Codes.Jun Wang, Sanjiv Kumar, Shih-Fu Chang
2009ICMLOn sampling-based approximate spectral decomposition.Sanjiv Kumar, Mehryar Mohri, Ameet Talwalkar
2008CVPRFace tracking and recognition with visual constraints in real-world videos.Minyoung Kim, Sanjiv Kumar, Vladimir Pavlovic, Henry A. Rowley
2008CVPRLarge-scale manifold learning.Ameet Talwalkar, Sanjiv Kumar, Henry A. Rowley
2008ECCVA New Baseline for Image Annotation.Ameesh Makadia, Vladimir Pavlovic, Sanjiv Kumar
2007ICCVClassification of Weakly-Labeled Data with Partial Equivalence Relations.Sanjiv Kumar, Henry A. Rowley
2005CVPRDigital Tapestry.Carsten Rother, Sanjiv Kumar, Vladimir Kolmogorov, Andrew Blake
2005ICCVA Hierarchical Field Framework for Unified Context-Based Classification.Sanjiv Kumar, Martial Hebert
2004IROSPath planning with hallucinated worlds.Bart C. Nabbe, Sanjiv Kumar, Martial Hebert
2003CVPRMan-Made Structure Detection in Natural Images using a Causal Multiscale Random Field.Sanjiv Kumar, Martial Hebert
2003ICCVDiscriminative Random Fields: A Discriminative Framework for Contextual Interaction in Classification.Sanjiv Kumar, Martial Hebert