Aaryam Sharma@aaryam-sharma · 1 worksWorks on accelerating language model inference through speculative decoding.