Sign in

Sumedh Hindupur

@sumedh-hindupur.bsky.social
24 followers 12 following 9 posts

Grad Student at Harvard SEAS Interested in ML Interpretability, Computational Neuroscience, Signal Processing

PostsRepliesMedia
Sumedh Hindupur @sumedh-hindupur.bsky.social · 07/03/2025
New preprint alert! Do Sparse Autoencoders (SAEs) reveal all concepts a model relies on? Or do they impose hidden biases that shape what we can even detect? We uncover a fundamental duality between SAE architectures and concepts they can recover. Link: arxiv.org/abs/2503.01822
1142