Haoran Jin@haoran-jin · 1 worksStudies sparse autoencoders for interpretability of large language models.