Skip to content

Piotr Milos

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

14

Venues

7

Active years

2017–2025

Best venue rank

A*

Where they publish

Papers

14 indexed papers, newest first.

YearVenueTitleAuthors
2025AAAIStructured Packing in LLM Training Improves Long Context Utilization.Konrad Staniszewski, Szymon Tworkowski, Sebastian Jaszczur, Yu Zhao, Henryk Michalewski, Lukasz Kucinski, Piotr Milos
2025ICMLJoint MoE Scaling Laws: Mixture of Experts Can Be Memory Efficient.Jan Ludziejewski, Maciej Piro, Jakub Krajewski, Maciej Stefaniak, Michal Krutul, Jan Malasnicki, Marek Cygan, Piotr Sankowski, Kamil Adamczewski, Piotr Milos, Sebastian Jaszczur
2025ICMLSince Faithfulness Fails: The Performance Limits of Neural Causal Discovery.Mateusz Olko, Mateusz Gajewski, Joanna Wojciechowska, Mikolaj Morzy, Piotr Sankowski, Piotr Milos
2024ACLAnalysing The Impact of Sequence Composition on Language Model Pre-Training.Yu Zhao, Yuanbin Qu, Konrad Staniszewski, Szymon Tworkowski, Wei Liu, Piotr Milos, Yuxiang Wu, Pasquale Minervini
2024ICLRMagnushammer: A Transformer-Based Approach to Premise Selection.Maciej Mikula, Szymon Tworkowski, Szymon Antoniak, Bartosz Piotrowski, Albert Q. Jiang, Jin Peng Zhou, Christian Szegedy, Lukasz Kucinski, Piotr Milos, Yuhuai Wu
2024ICMLOverestimation, Overfitting, and Plasticity in Actor-Critic: the Bitter Lesson of Reinforcement Learning.Michal Nauman, Michal Bortkiewicz, Piotr Milos, Tomasz Trzcinski, Mateusz Ostaszewski, Marek Cygan
2024ICMLFine-tuning Reinforcement Learning Models is Secretly a Forgetting Mitigation Problem.Maciej Wolczyk, Bartlomiej Cupial, Mateusz Ostaszewski, Michal Bortkiewicz, Michal Zajac, Razvan Pascanu, Lukasz Kucinski, Piotr Milos
2023ICLRFast and Precise: Adjusting Planning Horizon with Adaptive Subgoal Search.Michal Zawalski, Michal Tyrolski, Konrad Czechowski, Tomasz Odrzygzdz, Damian Stachura, Piotr Piekos, Yuhuai Wu, Lukasz Kucinski, Piotr Milos
2022IJCNNPlanning and Learning using Adaptive Entropy Tree Search.Piotr Kozakowski, Mikolaj Pacek, Piotr Milos
2021IJCNNStructure and Randomness in Planning and Reinforcement Learning.Konrad Czechowski, Piotr Januszewski, Piotr Kozakowski, Lukasz Kucinski, Piotr Milos
2021IJCNNTrust, but Verify: Alleviating Pessimistic Errors in Model-Based Exploration.Konrad Czechowski, Tomasz Odrzygzdz, Michal Izworski, Marek Zbysinski, Lukasz Kucinski, Piotr Milos
2020ICLRModel Based Reinforcement Learning for Atari.Lukasz Kaiser, Mohammad Babaeizadeh, Piotr Milos, Blazej Osinski, Roy H. Campbell, Konrad Czechowski, Dumitru Erhan, Chelsea Finn, Piotr Kozakowski, Sergey Levine, Afroz Mohiuddin, Ryan Sepassi, George Tucker, Henryk Michalewski
2020ICRASimulation-Based Reinforcement Learning for Real-World Autonomous Driving.Blazej Osinski, Adam Jakubowski, Pawel Ziecina, Piotr Milos, Christopher Galias, Silviu Homoceanu, Henryk Michalewski
2017CoRLHierarchical Reinforcement Learning with Parameters.Maciej Klimek, Henryk Michalewski, Piotr Milos