AI & ML interests
Frontier research around Safe and aligned intelligence
Recent Activity
Papers
Forgetting That Sticks: Quantization-Permanent Unlearning via Circuit Attribution
$C$-$ฮฮ$: Circuit-Restricted Weight Arithmetic for Selective Refusal
None public yet