← People
Giorgia Ramponi
following
UZH.AI Hub, ETH AI Center
Website
Papers in the feed →
Papers · 20
Multi-agent imitation learning with function approximation: Linear Markov games and beyond
arXiv.org
2026-02-26
alphaXiv
arXiv
S2
Aligning Language Models from User Interactions
arXiv.org
2026-02-18
alphaXiv
arXiv
S2
MAVRL: Learning Reward Functions from Multiple Feedback Types with Amortized Variational Inference
arXiv.org
2026-02-16
alphaXiv
arXiv
S2
Optimal Sample Complexity for Single Time-Scale Actor-Critic with Momentum
arXiv.org
2026-02-02
alphaXiv
arXiv
S2
From Words To Rewards: Leveraging Natural Language For Reinforcement Learning
Trans. Mach. Learn. Res.
2026
S2
Rate optimal learning of equilibria from data
arXiv.org
2025-10-10
alphaXiv
arXiv
S2
Fine-tuning Behavioral Cloning Policies with Preference-Based Reinforcement Learning
arXiv.org
2025-09-30
alphaXiv
arXiv
S2
Learning Acrobatic Flight from Preferences
2025-08-26
alphaXiv
arXiv
S2
Corrupted by Reasoning: Reasoning Language Models Become Free-Riders in Public Goods Games
arXiv.org
2025-06-29
alphaXiv
arXiv
S2
Policy Gradient with Tree Search: Avoiding Local Optimas through Lookahead
arXiv.org
2025-06-08
alphaXiv
arXiv
S2
Learning Equilibria from Data: Provably Efficient Multi-Agent Imitation Learning
Neural Information Processing Systems
2025-05-23
alphaXiv
arXiv
S2
Clustered KL-barycenter design for policy evaluation
arXiv.org
2025-03-04
alphaXiv
arXiv
S2
Dual Formulation for Non-Rectangular Lp Robust Markov Decision Processes
arXiv.org
2025-02-13
alphaXiv
arXiv
S2
Non-rectangular Robust MDPs with Normed Uncertainty Sets
Neural Information Processing Systems
2025
S2
On Feasible Rewards in Multi-Agent Inverse Reinforcement Learning
Neural Information Processing Systems
2024-11-22
alphaXiv
arXiv
S2
Learning Collusion in Episodic, Inventory-Constrained Markets
Adaptive Agents and Multi-Agent Systems
2024-10-24
alphaXiv
arXiv
S2
On the Convergence of Single-Timescale Actor-Critic
Advances in Neural Information Processing Systems 38
2024-10-11
alphaXiv
arXiv
S2
Reinforcement Learning from Human Text Feedback: Learning a Reward Model from Human Text Input
S2
HIP-RL: Hallucinated Inputs for Preference-based Reinforcement Learning in Continuous Domains
S2
On Imitation in Mean-field Games
S2