← People
Barna Pásztor

Barna Pásztor following

ETH Zurich
@pasztorbPapers in the feed →

Papers · 7
  1. ActiveUltraFeedback: Efficient Preference Data Generation using Active Learning
    arXiv.org2026-03-10alphaXiv arXiv S2
  2. RewardUQ: A Unified Framework for Uncertainty-Aware Reward Models
    arXiv.org2026-02-27alphaXiv arXiv S2
  3. Aligning Language Models from User Interactions
    arXiv.org2026-02-18alphaXiv arXiv S2
  4. Apertus: Democratizing Open and Compliant LLMs for Global Language Environments
    Annual Meeting of the Association for Computational Linguistics2026S2
  5. Stackelberg Learning from Human Feedback: Preference Optimization as a Sequential Game
    arXiv.org2025-12-18alphaXiv arXiv S2
  6. Scalable ride-sourcing vehicle rebalancing with service accessibility guarantee: A constrained mean-field reinforcement learning approach
    Transportation Research Part C: Emerging Technologies2025-03-31alphaXiv arXiv S2
  7. Learning Collusion in Episodic, Inventory-Constrained Markets
    Adaptive Agents and Multi-Agent Systems2024-10-24alphaXiv arXiv S2