Modelpedia
Work in progress
About
Findings
Models
Concepts
Methods
Datasets
Sources
Light
Dark
BoolQ
anchor
Findings
IC-401
Ablating safety attention heads minimally degrades helpfulness on zero-shot tasks and also impairs course-correction capability in Llama-2-7b-chat
[eval]
IC-626
Llama 7B retains 95% of its common sense reasoning performance when compressed to 2 GB using JLCM
[eval]