Publications
List of Publications
Refined Analysis of Entropy-Regularized Actor-Critic
Safwan Labbi, Paul Mangold, Daniil Tiapkin, Eric Moulines.
ICML 2026.Beyond Softmax and Entropy: Convergence Rates of Policy Gradients with f-SoftArgmax Parameterization & Coupled Regularization
Safwan Labbi, Daniil Tiapkin, Paul Mangold, Eric Moulines.
ICLR 2026.On Global Convergence Rates for Federated Softmax Policy Gradient under Heterogeneous Environments
Safwan Labbi, Paul Mangold, Daniil Tiapkin, Eric Moulines.
AISTATS 2026.Federated UCBVI: Communication-Efficient Federated Regret Minimization with Heterogeneous Agents
Safwan Labbi, Daniil Tiapkin, Lorenzo Mancini, Paul Mangold, Eric Moulines.
AISTATS 2025.Mean-Field Multi-Agent Learning: A Trust Region Approach
Antonio Ocello, Lorenzo Mancini, Safwan Labbi, Daniil Tiapkin, Adel Belouchrani, Eric Moulines.
EUSIPCO 2025.Integrating FedDRL for Efficient Vehicular Communication in Smart Cities
Lorenzo Mancini, Safwan Labbi, Karim Abed Meraim, Fouzi Boukhalfa, Alain Durmus, Paul Mangold, Eric Moulines.
Lecture Notes in Intelligent Transportation and Infrastructure. Springer, 2025.SCAFFLSA: Taming Heterogeneity in Federated Linear Stochastic Approximation and TD Learning
Paul Mangold, Sergey Samsonov, Safwan Labbi, Ilya Levin, Reda Alami, Alexey Naumov, Eric Moulines.
NeurIPS 2024.Joint Channel Selection using FedDRL in V2X
Lorenzo Mancini, Safwan Labbi, Karim Abed Meraim, Fouzi Boukhalfa, Alain Durmus, Paul Mangold, Eric Moulines.
IEEE MECOM, 2024.
