Peering Through Preferences: Unraveling Feedback Acquisition for Aligning Large Language Models

2024-01-16 · ICLR 2024 poster · anchor

Findings