mikeayles@mikeayles · 1 worksBuilds tiny language models that run at 21,000 tokens per second on low-cost FPGAs.