Philippe Chlenski
@philippe-chlenski · 1 works
Researches mechanistic interpretability methods for language models without full internal access.
@philippe-chlenski · 1 works
Researches mechanistic interpretability methods for language models without full internal access.