Skip to content

Piotr Stanczyk

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

7

Venues

4

Active years

2010–2025

Best venue rank

A*

Where they publish

Papers

7 indexed papers, newest first.

YearVenueTitleAuthors
2025ICLRBOND: Aligning LLMs with Best-of-N Distillation.Pier Giuseppe Sessa, Robert Dadashi-Tazehozi, Lonard Hussenot, Johan Ferret, Nino Vieillard, Alexandre Ram, Bobak Shahriari, Sarah Perrin, Abram L. Friesen, Geoffrey Cideron, Sertan Girgin, Piotr Stanczyk, Andrea Michi, Danila Sinopalnikov, Sabela Ramos Garea, Amlie Hliou, Aliaksei Severyn, Matthew Hoffman, Nikola Momchev, Olivier Bachem
2024ICLROn-Policy Distillation of Language Models: Learning from Self-Generated Mistakes.Rishabh Agarwal, Nino Vieillard, Yongchao Zhou, Piotr Stanczyk, Sabela Ramos Garea, Matthieu Geist, Olivier Bachem
2023ACLFactually Consistent Summarization via Reinforcement Learning with Textual Entailment Feedback.Paul Roit, Johan Ferret, Lior Shani, Roee Aharoni, Geoffrey Cideron, Robert Dadashi, Matthieu Geist, Sertan Girgin, Lonard Hussenot, Orgad Keller, Nikola Momchev, Sabela Ramos Garea, Piotr Stanczyk, Nino Vieillard, Olivier Bachem, Gal Elidan, Avinatan Hassidim, Olivier Pietquin, Idan Szpektor
2021ICLRWhat Matters for On-Policy Deep Actor-Critic Methods? A Large-Scale Study.Marcin Andrychowicz, Anton Raichuk, Piotr Stanczyk, Manu Orsini, Sertan Girgin, Raphal Marinier, Lonard Hussenot, Matthieu Geist, Olivier Pietquin, Marcin Michalski, Sylvain Gelly, Olivier Bachem
2020AAAIGoogle Research Football: A Novel Reinforcement Learning Environment.Karol Kurach, Anton Raichuk, Piotr Stanczyk, Michal Zajac, Olivier Bachem, Lasse Espeholt, Carlos Riquelme, Damien Vincent, Marcin Michalski, Olivier Bousquet, Sylvain Gelly
2020ICLRSEED RL: Scalable and Efficient Deep-RL with Accelerated Central Inference.Lasse Espeholt, Raphal Marinier, Piotr Stanczyk, Ke Wang, Marcin Michalski
2010SOFSEMPerfect Matching for Biconnected Cubic Graphs inKrzysztof Diks, Piotr Stanczyk