SAEVerbalizer Collection SAEVerbalizer: Generating Explanations for Sparse Autoencoder Features via Representation Verbalization • 3 items • Updated 4 days ago
Guiding LLM Post-training Data Engineering with Model Internals from Sparse Autoencoders Paper • 2605.27354 • Published May 26 • 14