| 2015 | CEC | Annealing linear scalarized based multi-objective multi-armed bandit algorithm. | Saba Q. Yahyaa, Madalina M. Drugan, Bernard Manderick |
| 2015 | ESANN | Thompson Sampling for Multi-Objective Multi-Armed Bandits Problem. | Saba Q. Yahyaa, Bernard Manderick |
| 2015 | ICAART | Thompson Sampling in the Adaptive Linear Scalarized Multi Objective Multi Armed Bandit. | Saba Q. Yahyaa, Madalina M. Drugan, Bernard Manderick |
| 2014 | ESANN | Linear Scalarized Knowledge Gradient in the Multi-Objective Multi-Armed Bandits Problem. | Saba Q. Yahyaa, Madalina M. Drugan, Bernard Manderick |
| 2014 | ICAART | Knowledge Gradient for Multi-objective Multi-armed Bandit Algorithms. | Saba Q. Yahyaa, Madalina M. Drugan, Bernard Manderick |
| 2014 | ICAART | Online Knowledge Gradient Exploration in an Unknown Environment. | Saba Q. Yahyaa, Bernard Manderick |
| 2014 | ICAART | Knowledge Gradient for Online Reinforcement Learning. | Saba Q. Yahyaa, Bernard Manderick |
| 2014 | IJCNN | The scalarized multi-objective multi-armed bandit problem: An empirical study of its exploration vs. exploitation tradeoff. | Saba Q. Yahyaa, Madalina M. Drugan, Bernard Manderick |
| 2013 | ICAART | Empirical Evaluation of Shortest Path Gaussian Kernels over State Action Graphs. | Saba Q. Yahyaa, Bernard Manderick |
| 2013 | ICAART | Knowledge Gradient Exploration in Online Least Squares Policy Iteration. | Saba Q. Yahyaa, Bernard Manderick |
| 2012 | ESANN | The Exploration vs Exploitation Trade-Off in Bandit Problems: An Empirical Study. | Bernard Manderick, Saba Q. Yahyaa |