| 2011 | PAC-Bayesian Policy Evaluation for Reinforcement Learning. | Mahdi Milani Fard, Joelle Pineau, Csaba Szepesvri |
| 2011 | Boosting as a Product of Experts. | Narayanan Unny Edakunni, Gary Brown, Tim Kovacs |
| 2011 | A Unifying Framework for Linearly Solvable Control. | Krishnamurthy Dvijotham, Emanuel Todorov |
| 2011 | Efficient Optimal Learning for Contextual Bandits. | Miroslav Dudk, Daniel J. Hsu, Satyen Kale, Nikos Karampatziakis, John Langford, Lev Reyzin, Tong Zhang |
| 2011 | Active Learning for Developing Personalized Treatment. | Kun Deng, Joelle Pineau, Susan A. Murphy |
| 2011 | Bayesian network learning with cutting planes. | James Cussens |
| 2011 | Ensembles of Kernel Predictors. | Corinna Cortes, Mehryar Mohri, Afshin Rostamizadeh |
| 2011 | Learning high-dimensional DAGs with latent and selection variables (Abstract). | Diego Colombo, Marloes H. Maathuis, Markus Kalisch, Thomas S. Richardson |
| 2011 | A Logical Characterization of Constraint-Based Causal Discovery. | Tom Claassen, Tom Heskes |
| 2011 | Strictly Proper Mechanisms with Cooperating Players. | SangIn Chun, Ross D. Shachter |
| 2011 | EDML: A Method for Learning Parameters in Bayesian Networks. | Arthur Choi, Khaled S. Refaat, Adnan Darwiche |
| 2011 | Smoothing Proximal Gradient Method for General Structured Sparse Learning. | Xi Chen, Qihang Lin, Seyoung Kim, Jaime G. Carbonell, Eric P. Xing |
| 2011 | A temporally abstracted Viterbi algorithm. | Shaunak Chatterjee, Stuart Russell |
| 2011 | A Framework for Optimizing Paper Matching. | Laurent Charlin, Richard S. Zemel, Craig Boutilier |
| 2011 | Filtered Fictitious Play for Perturbed Observation Potential Games and Decentralised POMDPs. | Archie C. Chapman, Simon Andrew Williamson, Nicholas R. Jennings |
| 2011 | Near-Optimal Target Learning With Stochastic Binary Signals. | Mithun Chakraborty, Sanmay Das, Malik Magdon-Ismail |
| 2011 | Factored Filtering of Continuous-Time Systems. | E. Busra Celikkaya, Christian R. Shelton, William Lam |
| 2011 | Incentives in Group Decision-Making With Uncertainty and Subjective Beliefs. | Ruggiero Cavallo |
| 2011 | Fractional Moments on Bandit Problems. | Ananda Narayanan B., Balaraman Ravindran |
| 2011 | Deconvolution of mixing time series on a graph. | Alexander W. Blocker, Edoardo M. Airoldi |
| 2011 | Semi-supervised Learning with Density Based Distances. | Avleen Singh Bijral, Nathan D. Ratliff, Nathan Srebro |
| 2011 | Active Diagnosis via AUC Maximization: An Efficient Approach for Multiple Fault Identification in Large Scale, Noisy Networks. | Gowtham Bellala, Jason Stanley, Clayton Scott, Suresh K. Bhavnani |
| 2011 | Solving Cooperative Reliability Games. | Yoram Bachrach, Reshef Meir, Michal Feldman, Moshe Tennenholtz |
| 2011 | Learning is planning: near Bayes-optimal reinforcement learning via Monte-Carlo tree search. | John Asmuth, Michael L. Littman |
| 2011 | Extended Lifted Inference with Joint Formulas. | Udi Apsel, Ronen I. Brafman |