Quantifying Language Models' Sensitivity to Spurious Features in Prompt Design or: How I learned to start worrying about prompt formatting

2024-01-16 · ICLR 2024 poster · anchor

Findings